求分享liuyue包,我也是从他的博客没找到。秋叶包到处都是
Don Zhu 0
@Don Zhu 0
-
实测刘悦的ltx2.3整合包,我不同意他的思路。 -
3090ti部署qwen3.6-27B-MTP-q4_K-M的疑惑 -
实测Hermes + Qwen3.6 27B 使用Qwen-Fixed-Chat-Templates大幅提高缓存命中率感谢分享,实测有效。我使用的buun这个版本
之前经常出现forcing full prompt re-processing
响应时间15秒左右
现在都是restored context checkpoint
响应时间2-3秒 -
为什么我的256G内存+24G显存无法让LM Studio跑deepseek-v4-flash?@566656661 感谢您的回复帮我解惑
-
为什么我的256G内存+24G显存无法让LM Studio跑deepseek-v4-flash?我看大家都是使用llama.cpp,是不是它比lm studio更好更直接?
-
我今天终于干了个大活。震惊了我的同事。你的预算员同事会感激你的,过不了多久他就下岗了:)