跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(不使用皮肤)
  • 不使用皮肤
折叠
品牌标识

抡锤者

  1. 主页
  2. AI硬件
  3. 一个7900 xtx 24G 装机单,期望:稳定、高性价比、可拓展,请大神点评

一个7900 xtx 24G 装机单,期望:稳定、高性价比、可拓展,请大神点评

已定时 已固定 已锁定 已移动 AI硬件
7900xtx
16 帖子 8 发布者 286 浏览 1 关注中
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • kop wangK 离线
    kop wangK 离线
    kop wang
    超级版主
    编写于 最后由 kop wang 编辑
    #3

    24GB显存的话,qwen3.6-27B Q4,再加上 256k q8量化的kvcache放不下。这是我能看到的最明显的问题。
    然后就是linux的GUI远程桌面无论哪家效果都不好。最流行的UU远程和parsec甚至就不支持Linux作为server(受控端)

    虚心交流,一起进步

    1 条回复 最后回复
    1
    • williamlouisW 离线
      williamlouisW 离线
      williamlouis
      超级版主
      编写于 最后由 编辑
      #4

      16G 单条内存 运行 难度不小。可能会有 臆想不到的 Bug。你实测下 给个结果。
      远程局域网组合 tailscale + rustdesk 可以实现。

      个人主页:xlkj.org Telegram https://t.me/xlkjorg

      1 条回复 最后回复
      0
      • RexR 离线
        RexR 离线
        Rex
        编写于 最后由 Rex 编辑
        #5

        感谢各位大佬点评,算下来,如果考虑双卡的可能性,需要升级主板、机箱、电源等,现阶段预算要增加3000 - 4000RMB,2年后是否装第二张卡仍不确定。
        考虑后觉得暂时就单卡先跑着,放弃双卡可能性,先用起来,争取跑通业务优先。
        2年后,或许业务有营收了,一切都好办的。
        AI发展飞速,2年后或许有什么更高性价比的技术出来。

        单卡的整机方案如下图,装上Windows 11 + vulkan + zerotier + 向日葵/rustDesk + Ollama + Qwen3.6:27B + 64K Context, 客户端跑:hermes/claude code/codex, 支持一些网站自媒体、开发、信息搜集、整理报告类型的日常重复劳动。
        主要使用场景是推理, 不需要训练。
        6ec1550d-2af8-4851-b386-e7d1b0f43e93-image.jpeg

        定位:一台廉价私人AI助手,不是一台需要维护的AI服务器。

        1 条回复 最后回复
        0
        • terryT 在线
          terryT 在线
          terry
          超级版主
          编写于 最后由 编辑
          #6

          装电脑不要考虑两年后,2年后现在的机器都是垃圾,到时候二手市场买就是了,就考虑你当下是否够用。人家大神说了你内存不够,你给最少弄到32G。

          油管:https://www.youtube.com/@抡锤者

          1 条回复 最后回复
          0
          • fcmeF 离线
            fcmeF 离线
            fcme
            技术大牛 劳动模范
            编写于 最后由 编辑
            #7

            其实你驱动单卡7900xtx的话,建议你把这套服务直接推翻,你在闲鱼收一个二手的服务器,只要是有pcie3.0就行。当然如果是amd的那种双路更好,因为pcie通道更多,将来你插双卡的话,呃比较舒服。只是记得买卡的时候要买薄一点的,厚度不要太厚了,这个影响你双卡。
            收二手服务器的好处是这种东西都太他妈稳定了,这完全不是民用的,自己组装的机器可以比拟的,而且性价比超高。哪怕是以前老的惠普z220240420620这些机器都可以,但是要注意,最好是电源容量充足的,内存不够的话,可以自己加一下,16确实小了点32是比较舒服的。
            我曾经也想自己组的,后来研究来研究去,发现还是老服务器比较爽,我最终选的是7820,双路,6个pcie,两个满速x16。民用级别的CPU,pcie通道数不够,你买了也是白买,基本断绝了你以后组双路的想法。
            关于系统的话,千万别装Windows,就用无头Linux,本来显存就吃紧,你装一套图形系统,只会无畏的拖慢速度占用宝贵的显存资源。

            1 条回复 最后回复
            1
            • fcmeF 离线
              fcmeF 离线
              fcme
              技术大牛 劳动模范
              编写于 最后由 编辑
              #8

              还有一个关于模型的选择,显存直接决定了你可以用的模型。24g的显卡最好的选择是27b,32g的卡最好选择是35bMoE。各个价位肯定都是英伟达的更好,但是本地运行大模型的话速度是一个很重要的坎,27b你别看有了mtp以后速度都能到个五六十,但是agent时代的真正局限是pp速度,也就是预处理,一个系统提示词二十几k,上下文长一点了以后动不动上百k,虽然在同一个对话里面,它是逐渐累加的,跑起来以后还好,但是只要一涉及到大的文件读取或者说压缩对话之类的操作,那几乎都是全量操作,本地模型pp速度不够的话,直接跟卡死差不多。所以本地其实最佳的选择是35b的各种变种,质量不错,速度奇快。哪怕你的卡是5090,最佳的选择也是这两个,当然5090跑27b它计算速度太暴力了,好像pp能到1500往上。所以只要不是五零,九零,其他人的归宿差不多应该都是35b的各种版本。有了deepseek v4flash以后,本地部署的性价比其实挺低的。当然你用那种解禁的各种版本搞一点奇奇怪怪的事情,那是云端搞比不了的😂。

              RexR terryT 2 条回复 最后回复
              1
              • fcmeF fcme

                还有一个关于模型的选择,显存直接决定了你可以用的模型。24g的显卡最好的选择是27b,32g的卡最好选择是35bMoE。各个价位肯定都是英伟达的更好,但是本地运行大模型的话速度是一个很重要的坎,27b你别看有了mtp以后速度都能到个五六十,但是agent时代的真正局限是pp速度,也就是预处理,一个系统提示词二十几k,上下文长一点了以后动不动上百k,虽然在同一个对话里面,它是逐渐累加的,跑起来以后还好,但是只要一涉及到大的文件读取或者说压缩对话之类的操作,那几乎都是全量操作,本地模型pp速度不够的话,直接跟卡死差不多。所以本地其实最佳的选择是35b的各种变种,质量不错,速度奇快。哪怕你的卡是5090,最佳的选择也是这两个,当然5090跑27b它计算速度太暴力了,好像pp能到1500往上。所以只要不是五零,九零,其他人的归宿差不多应该都是35b的各种版本。有了deepseek v4flash以后,本地部署的性价比其实挺低的。当然你用那种解禁的各种版本搞一点奇奇怪怪的事情,那是云端搞比不了的😂。

                RexR 离线
                RexR 离线
                Rex
                编写于 最后由 Rex 编辑
                #9

                @fcme 深刻同意, 35B模型是比较好的生产力甜点区选择,接下来的问题: 32G 显存,最高性价比的显卡选择是什么?

                1 条回复 最后回复
                0
                • fcmeF 离线
                  fcmeF 离线
                  fcme
                  技术大牛 劳动模范
                  编写于 最后由 编辑
                  #10

                  你说是卡吗?那肯定是amd的AI Pro R9700。带宽只有五零,九零的1/3,价格差不多也是1/3,就看你怎么选择了。32g最大的好处就是可以跑高比特的呃35b,27b的模型是我自己实测比较抗量化的,但是35b的话低于Q4,在agent场景下几乎没有办法用,动不动锻炼,然后死循环,但是高比特的就没有这个问题。我在9700上跑的是Q5的版本,但是我是需要开两个通道。
                  不管怎么说,是你的钱提前利用AI也好,自己做点功课也好,才能满足你真正的需求。总的一句话就是本地跑的ai不要期待它能跟云端的相比,哪怕是云端的deepseek flash。速度和知识的瓶颈就在那里了,但是对于日常使用大部分场景又都够用了

                  1 条回复 最后回复
                  1
                  • S 离线
                    S 离线
                    stxpnet
                    技术大牛 劳动模范
                    编写于 最后由 stxpnet 编辑
                    #11

                    我也和楼上差不多意见,直接上32G内存和32G显卡吧,马上QWEN 3.8开源的出来,如果智商继续在线,大家 都会抛弃3.6,你要扩展第二 块显卡的话, 主板其实也不能省,内存带宽往高了去,主板最好内置8X 8X拆分。

                    我就后悔两件事,当初没买32G,而是上了24G的RTX 3090,第二,5月初没有在4万2的时候入手RTX 6000D 84G显卡。那时入了就没有后面这么多折腾事了

                    terryT 1 条回复 最后回复
                    1
                    • fcmeF fcme

                      还有一个关于模型的选择,显存直接决定了你可以用的模型。24g的显卡最好的选择是27b,32g的卡最好选择是35bMoE。各个价位肯定都是英伟达的更好,但是本地运行大模型的话速度是一个很重要的坎,27b你别看有了mtp以后速度都能到个五六十,但是agent时代的真正局限是pp速度,也就是预处理,一个系统提示词二十几k,上下文长一点了以后动不动上百k,虽然在同一个对话里面,它是逐渐累加的,跑起来以后还好,但是只要一涉及到大的文件读取或者说压缩对话之类的操作,那几乎都是全量操作,本地模型pp速度不够的话,直接跟卡死差不多。所以本地其实最佳的选择是35b的各种变种,质量不错,速度奇快。哪怕你的卡是5090,最佳的选择也是这两个,当然5090跑27b它计算速度太暴力了,好像pp能到1500往上。所以只要不是五零,九零,其他人的归宿差不多应该都是35b的各种版本。有了deepseek v4flash以后,本地部署的性价比其实挺低的。当然你用那种解禁的各种版本搞一点奇奇怪怪的事情,那是云端搞比不了的😂。

                      terryT 在线
                      terryT 在线
                      terry
                      超级版主
                      编写于 最后由 编辑
                      #12

                      @fcme 32G也不要用35B,还是27B,最好的Qwen3.6 35b A3B跑久了也不行。

                      油管:https://www.youtube.com/@抡锤者

                      fcmeF 1 条回复 最后回复
                      0
                      • S stxpnet

                        我也和楼上差不多意见,直接上32G内存和32G显卡吧,马上QWEN 3.8开源的出来,如果智商继续在线,大家 都会抛弃3.6,你要扩展第二 块显卡的话, 主板其实也不能省,内存带宽往高了去,主板最好内置8X 8X拆分。

                        我就后悔两件事,当初没买32G,而是上了24G的RTX 3090,第二,5月初没有在4万2的时候入手RTX 6000D 84G显卡。那时入了就没有后面这么多折腾事了

                        terryT 在线
                        terryT 在线
                        terry
                        超级版主
                        编写于 最后由 编辑
                        #13

                        @stxpnet 俺也一样?😂

                        油管:https://www.youtube.com/@抡锤者

                        1 条回复 最后回复
                        0
                        • verilsV 离线
                          verilsV 离线
                          verils
                          编写于 最后由 verils 编辑
                          #14

                          我目前是组了 3970X 平台,等着 7900XTX 到手了。平台板U + 散热 + 电源总共 4k1 拿下的。不过我原本就有 128G 内存,这对大部分人可能是个巨大门槛😂

                          现在线程撕裂者 3000 系列应该算是 DDR4 下面性能不落伍、通道数足够双卡的极致选择了

                          1 条回复 最后回复
                          0
                          • terryT terry

                            @fcme 32G也不要用35B,还是27B,最好的Qwen3.6 35b A3B跑久了也不行。

                            fcmeF 离线
                            fcmeF 离线
                            fcme
                            技术大牛 劳动模范
                            编写于 最后由 编辑
                            #15

                            @terry
                            我也是看到了你的视频以后才了解到amd现在跑本地模型的生态算是比较成熟了才入手的R9700,感谢。
                            你说的这个问题有两个缓解的办法,35b用ornith官方的Q5,Q6效果不错,属于是质量和速度的平衡,日用不做代码不开发的话驱动和维斯非常好用,完全够了,原版的容易死循环。27b我也下载好了,需要绝对的输出质量的时候,我就让另一个运维的赫mes切换一下,切换也做成技能了,一句话的事情很简单。
                            成年人我都要,27b和35b各有所长吧😂😂

                            terryT 1 条回复 最后回复
                            1
                            • fcmeF fcme

                              @terry
                              我也是看到了你的视频以后才了解到amd现在跑本地模型的生态算是比较成熟了才入手的R9700,感谢。
                              你说的这个问题有两个缓解的办法,35b用ornith官方的Q5,Q6效果不错,属于是质量和速度的平衡,日用不做代码不开发的话驱动和维斯非常好用,完全够了,原版的容易死循环。27b我也下载好了,需要绝对的输出质量的时候,我就让另一个运维的赫mes切换一下,切换也做成技能了,一句话的事情很简单。
                              成年人我都要,27b和35b各有所长吧😂😂

                              terryT 在线
                              terryT 在线
                              terry
                              超级版主
                              编写于 最后由 terry 编辑
                              #16

                              @fcme 这是个重要信息,只要能处理指令就好,编程我会选在线的。你最好能发个帖子详细介绍下性能,我看是否值得折腾,35b要能用,还是非常重要的,比27b快太多了。而且它不用折腾SG-Lang。

                              油管:https://www.youtube.com/@抡锤者

                              1 条回复 最后回复
                              0

                              你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

                              厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

                              有了你的建议,这篇帖子会更精彩哦 💗

                              注册 登录
                              回复
                              • 在新帖中回复
                              登录后回复
                              • 从旧到新
                              • 从新到旧
                              • 最多赞同


                              • 登录

                              • 没有帐号? 注册

                              • 登录或注册以进行搜索。
                              • 第一个帖子
                                最后一个帖子
                              0
                              • 版块
                              • 最新
                              • 标签
                              • 热门
                              • 用户
                              • 群组