用完Kimi,Deepseek,GPT之后,这模型之间差距还很明显.
-
我发现 现在GPT的模型, 在关键的编程,尤其是复杂算法逻辑,还是很准.
我主力编程模型,就是 GPT 5.2 ,GPT5.4 ,我认为 5.2以上就够用了,大不了多对话几次.
国产这三家, 我用了 deepseek, GLM, Kimi.
如果从智商层次 ,我觉得 GLM 5.2 最强. 不需要 反复的说.
deepseek v4 , 智力一般. 但是赢在性价比目前 白天 双倍价格,性价比不太明显了.
kimi K3, 我也用了, 就是感觉有点卡,推理太慢了. 好多都是浪费token的 链路,明显推错了.
我认为国产的这几个模型,只要保持性价比的优势,还是很有竞争力的.
搞编程,又不是所有的任务都是复杂任务, 90%的都是 增删改查,写文档.
只有10%的高价值,可以使用 gtp或者 opus 模型.
一起和大家共勉, 希望他们不要涨价, 最近每个月大模型都调价, 哭了.
deepseek:


kimi:

-
kimi k3 这个月的额度马上跑完。针对 K3 的 评测不应该集中在 code 上。它的强项主要是在多模态多agent上。在调用17个agent 集群后。K3集群成功的完成了一个在 K2.7 时胡言乱呀的项目。
-

这个模式很重要。低一点都不行。 -
你们到底用大模型在写什么代码,说出来我评估下,详细一点。怎么还搞到集群了,问个简单的,比如就目前我打算找时间给这个网站做一套新的主题。你们在用的编程工具能不能搞定这个问题
,之前我没用Agent的时候,是手动贴代码给Gemini,但是当时做的是Discourse的,我草复杂的很。但是也搞定了。这个NodeBB的没啥耦合,有无可能不需要我本人投入精力,直接调试搞定的?
@mark 用你的K3刷下看看。好用的话我抄作业。 -
@terry 版主级回复。发群里了。
-
很敏感。你就群里看看吧。等我在市场运作一段时间的。目前我不想 开源。