-
VLLM英特尔版本跑Qwen3.6 27b,LLama.cpp多卡TP不行,SG-Lang配置地狱难度,对新技术支持也慢,对英特尔非常不友好。只有VLLM折腾下双开TP,虽然它是一张显卡,但是AI识别出来是两张。本地模型现在除非能上DeepSeek V4Flahsh,造假15万起步,否则都是用Qwen3.6 27b,没有比它更强大点,编程和Agent都是如此。
@terry Gemma4这种多模态开源模型呢?大概能用多大规模参数和量化呢?
-
@terry Gemma4这种多模态开源模型呢?大概能用多大规模参数和量化呢?
@seewoscott 黄金尺寸Gemma4 31B,但是不如Qwen3.5 36. 27b
-
@seewoscott 黄金尺寸Gemma4 31B,但是不如Qwen3.5 36. 27b
-
按照这个趋势,后续的模型估计越来越给力,玩本地AI的估计有福了
-
按照这个趋势,后续的模型估计越来越给力,玩本地AI的估计有福了
-
趁它還是新的, 趕緊賣掉換卡吧
-
T terry 于 将此主题从 AI硬件 移至此处