这么装不改水,温度能压住吗?
S
stormaround
@stormaround
-
让你们看看垃圾魔改卡2080ti 的威力 qwen3.6-27b fp8 精度 速度能到 60tokens/s nvlink 连接 -
两块5070TI 16G 能部署什么样的本地模型,分别提供给2个人使用,相互不影响?我之前问了gemini,两张插消费级主板走pcie带宽不够,ai建议分层跑,一张先跑,另一张等着,能提升吞吐量,速度比单张慢,但是显存会大些,我有一张4070tisuper,本来想再买一张,但是看ai分析跑的速度比我现在的mac要慢,最近看两张3090ti 组nvlink好像不错,就是价格太贵,价格都快赶上mi210了
-
新手小白,求建議。4080s 32g怎么样,我最近也想入手,mac跑本地模型太热了
-
【实测】7900xtx使用Qwen3.6-35B-A3B速度稳定在80+t/s这个模型跑的很快,用m5max 6bit 能跑将近100toks,但是用hermes调用时候经常会死循环,一直重复几句话,干不了大活