跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
  • LCZ-Black
折叠
品牌标识

抡锤者

首页 版块 标签 硬件 AI 广场
G

Gavin2024

@Gavin2024
取消关注 关注
关于
帖子
11
主题
3
分享
0
群组
0
粉丝
0
关注
0

帖子

最新 最佳 有争议的

  • 3090+3080 20G+3080 10G,计划升级TRX40平台
    G Gavin2024

    @applejuice

    @terry

    28dcb9fd-9f16-4cd7-9004-62fe69f6fd8f-image.jpeg

    我的3090是三风扇卡, 研究了一下我若卖掉3080换3090组Nvlink,需要4槽的才行,好像淘宝都没有卖的了。

    而且查了不少博主的数据显示,在3090这样的卡,跑CPU直连的Pcie4.0*16通道,只比Nvlink大概损失10%的速度。因此我决定还是改成3960X TRX40主板,3090+双3080 20G,让两张3080加载Qwen, 让3090加载comfy UI的模型。

    我最在乎prefill阶段的速度应该可以通过更换平台得到很大提升,生成阶段速度应该是在20tk/s左右,是能接受范围。到时候实测看看。

    AI硬件 rtx3090 rtx3080

  • 3090+3080 20G+3080 10G,计划升级TRX40平台
    G Gavin2024

    @terry 謝謝指教,研究一下nvlink去

    AI硬件 rtx3090 rtx3080

  • 3090+3080 20G+3080 10G,计划升级TRX40平台
    G Gavin2024

    @terry 但是雙卡3090才48g, 如果三卡最多可以64g,vram更多不是更好嗎?

    AI硬件 rtx3090 rtx3080

  • 3090+3080 20G+3080 10G,计划升级TRX40平台
    G Gavin2024

    目前配置是:
    13600KF
    GIGABYTE Z690 AORUS MASTER
    16G2+24G2 频率5266
    3090+3080 20g+3080 10g

    Lm studio Qwen 3.6 27b Q6_k, Hermes Agent 128K上下文.
    发现两张3080跑在3.0X4速度上,prompt processing 特别慢,token速度也是17/18 tk/s,
    为了摆脱瓶颈,计划升到撕裂者
    3960X
    华硕 STRIX TRX40-E GAMING
    16G4 ECC UDIMM DDR4 要不要16G6加到96G?
    显卡要不要把3080 10g 也换成3080 20g?

    这样我的电源1300W 不够了,手上还有个550W的 SFX电源,打算塞进去机箱,双电源,辅助电源单独供应3090,其余由主电源供应。

    请帮我看看这样是否合适,还是说我可以用X99平台,更省钱?我是想维持三卡系统

    AI硬件 rtx3090 rtx3080

  • 想把主機弄成縫合怪3090+3080+3060可以嗎
    G Gavin2024

    這樣說,我是不是可以考慮增加3080 魔改20gb?

    AI硬件 rtx3090 rtx3080 rtx3060

  • 用於電商搭建自運營的模型選擇qwen3.6 27b 用Q4還是Q8合適
    G Gavin2024

    @AGI 13600kf 32gb內存, 3090 24gb+3080 10gb。 想添加3060 12gb, 湊到46gb顯存

    LLM讨论区 本地模型 qwen-27b 量化

  • 用於電商搭建自運營的模型選擇qwen3.6 27b 用Q4還是Q8合適
    G Gavin2024

    @kop-wang 討教一下,q4和q8區別是什麼呢? 我一直不太明白,不是專業技術人員, 簡單理解為壓縮率的差別,所以以為q8會聰明很多。

    LLM讨论区 本地模型 qwen-27b 量化

  • 想把主機弄成縫合怪3090+3080+3060可以嗎
    G Gavin2024

    @Xiaote 電源已經準備好了,coolmaster的gx 1300W, 應該足夠了。 但是為什麼說4060ti更好呢? 4060ti 16gb 每gb成本比3060 12gb的高。我猜想第三槽pcie已經時X4速率了,第三張顯卡的帶寬和算力低一點影響也不大,主要考慮的是性價比

    AI硬件 rtx3090 rtx3080 rtx3060

  • 用於電商搭建自運營的模型選擇qwen3.6 27b 用Q4還是Q8合適
    G Gavin2024

    想做電商,讓Hermes agent來搭建,打算用next js技術棧, 平時使用Lm studio 加載qwen3.6 27b q4_k_m, 我總覺得不夠聰明,很多時候頁面明明未做好就說做好。我想說,換成q8_0 會不會效率好一點? 準確率高一點?
    日後上線,Hermes agent自己運營網站,維護,推廣,那是不是q8_0會更合適?

    LLM讨论区 本地模型 qwen-27b 量化

  • 想把主機弄成縫合怪3090+3080+3060可以嗎
    G Gavin2024

    @Capri-Swicord 是的, 因為Lm studio會自動將模型分層分別載入兩卡顯存

    AI硬件 rtx3090 rtx3080 rtx3060

  • 想把主機弄成縫合怪3090+3080+3060可以嗎
    G Gavin2024

    目前系統是
    13600KF Z690 ,32Gb內存,3090 24Gb, 3080FE 10Gb
    用Lm studio加載Qwen 3.6 27b Q4_k_m,121k context。

    我還想增加顯存,最低成本可能是增加3060 12gb, 主板是技嘉Z690 Aorus Master, 有三個pcie插槽。 想用延長線把第三個pcie插槽延伸出來接3060。

    這樣可以湊到46Gb的顯存, 想用來跑Qwen 3.6 27b Q8_0
    這樣可以嗎?

    AI硬件 rtx3090 rtx3080 rtx3060
  • 登录

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组