3090双卡【无nvlink pcie 3.0 x8+x8拆分 P2P驱动】测试llama-cpp 跑27B Q6K GGUF
-
,系统 取消固定了此主题
-
@stxpnet 没有买nvlink 没搞微调的话就别搞了 1000元 只换来20% prefill
-
@stxpnet
不要搞双路
除非用nvlink
如果pcie 插不在同cpu 会 导致跨QPI, 速度比较慢
我的x99 就是不能插在同一个cpu通道 导致更慢了 -
@applejuice 嗯,这个我知道的,大概就是让它绑定一个CPU,128G内存专门用来跑MOE模型,想玩一下QWEN 122B A10B或者是LAGUNA S2.1,这样比较省电啊,不用搞两台机,记忆,RAG啥的挂另一颗 CPU上面。
我之前还试过可以用纯CPU跑35B A3B 或者QWEN CODER NEXT,有15-20T/S(当时想法是只用来写程序,写代码) 。 但是现在3.8都出来了,QWEN CODER NEXT有点跟不上时代了。
-
嗯,一是我这主板放不下两个PCIE之间只有一条缝了,没有水冷搞不掂,一换主板我又想上超微X11或X12 双路256G内存,CPU和主板又是大头,所以想想还是算了,目前就还是想试试那个破解P2P,晚上睡觉前让它自己调研写计划看能实现不。 @applejuice
-

pcie 4.0 16X 全速 没有nvlink的基准 -

pcie 4.0 16X 全速 没有nvlink的基准@laihzang619 prefill 呢?
-
此主題已被删除!
-
[[topic:post-is-deleted]]此主題已被删除!
-
@laihzang619 prefill 呢?
@applejuice
是这样测试吗 -

pcie 4.0 16X 全速 没有nvlink的基准

