24B左右的模型推荐,其实没必要删帖,本来就是讨论,不讨论怎么分得出对错好坏
-
型 类型 等效 / 真实规模 Q4 体积 核心最强场景 ROCm 速度 tok/s
GLM-4.7-FlashX MoE 27B(24 + 档) 16.5GB 代码、Agent、多并发商用 33~42
Qwen3.6-27B 稠密 27B 纯稠密 17GB 中文数理、图文、论文精读 16~22
DeepSeek-V2-Lite 24B 稠密 标准 24B 16.2GB 数学、算法、编程刷题 22~28
Qwen3.5-35B-A3B MoE 24~26B 21.2GB 超长文档、外文翻译、图文 26~31
Mistral-Small 24B 稠密 标准 24B 14.8GB 英文、创意写作、高速对话 28~36
Yi-34B 稠密 等效 25B 19GB 中英双语、海外文献