电源直接买大,万一有双卡需求,到时候又要买大的,我现在就是这样的买了个850W的现在双卡又买了个1200W的
I
iamvirus
@iamvirus
-
請教 CPU 散片 / RAM / SSD 推薦購買店家 -
AMD AI Pro R9700 LLM调教再买一张组tp=2 的vllm体验会很丝滑
-
intel 新顯卡~~480GB480GB lpddr5x 这价格贵到什么时候去了
-
Windows 7900XTX 跑本地模型 极限vllm0.23.0 +lmcache is here PCIE5 +双7900xtx tp=2 体验非常棒
-
本地大模型部署记录:Qwen3.6-27B MTP 在双 7900 XTX 上的推理优化llama.cpp 均速50+(建议用q4,质量不差),就是prefill 单pflash还行,但是和dflash不能一起用。用agent多轮对话主要看pp,tg其实没那么重要
-
选项A:1张RTX 5090或者选项B:2张AI PRO R9700?一张5090~~
-
Lucebox DFlash + PFlash 7900XTX Qwen3.6-27B ~2.8–3.1x加速 测试数据分享@QuincySnow 这个你需要自己改代码
-
Lucebox DFlash + PFlash 7900XTX Qwen3.6-27B ~2.8–3.1x加速 测试数据分享我以为llama.cpp mtp已经稳定在50-60很爽了,但是prefill在上下文时 prefill稳定的下降,agent影响很大
这个prefill 这么稳定,搞得我再想买一个7900xtx了!不知道质量如何 -
Pro 6000都是怎么玩?pro 6000 没有别的缺点,就一个缺点贵!当然这个是我们的缺点。谁不想双卡6000 本地部署DeepSeek v4 flash 10并发爽死。搞好工作流。几乎都可以跑很多个agent了。到时候是你没有这么多任务喂给他
-
今天被豆包上了一课啊 ,你别看她天天吹牛,真到关键时刻居然绝杀另外两个@terry 技术性实时性搜索grok是真的强。
-
7900XTX + llama.cpp Qwen3.6 27B TurboQuant + MTP 测试结果分享这些测试我都复现了,但是上qwen code 或者opencode 慢出翔!还不如9B好,至少能出活
-
选择7900XTX还是3090 24G4080S 32G 我觉得这个性价比高
-
有没有3090或以上,24G显存的兄弟,关于QWEN 27B DFLASH加速nvidia 3090 及其类似的 请看这个作者,优化很多
https://github.com/noonghunna/club-3090