deepseek v4 flash 出正式版0731了, 跑分超 v4pro预览版 和 glm5.2
-
补充:
关于 v4 flash 0731 这个正式版-
后训练威力被广泛认可:很多人感叹“架构不动、参数不变,只靠后训练就能反超自家 1.6T 预览版”,认为这是当前最有价值的信号之一。
-
Agent / Coding 场景提升明显:Terminal、工具调用、长链路任务、代码修复(DeepSWE 从 7.3 → 54.4)进步很大。开发者反馈在 Claude Code、Codex、OpenCode 等框架下使用体验显著变好,成本极低(有人连续跑几个小时只花几毛到一两块钱)。
-
性价比之王定位更牢固:被很多人当作日常 Agent / 编程主力,尤其适合高频、多轮、工具调用场景。
-
-
补充:
关于 v4 flash 0731 这个正式版-
后训练威力被广泛认可:很多人感叹“架构不动、参数不变,只靠后训练就能反超自家 1.6T 预览版”,认为这是当前最有价值的信号之一。
-
Agent / Coding 场景提升明显:Terminal、工具调用、长链路任务、代码修复(DeepSWE 从 7.3 → 54.4)进步很大。开发者反馈在 Claude Code、Codex、OpenCode 等框架下使用体验显著变好,成本极低(有人连续跑几个小时只花几毛到一两块钱)。
-
性价比之王定位更牢固:被很多人当作日常 Agent / 编程主力,尤其适合高频、多轮、工具调用场景。
-
-
-
补充:
亲测, v4flash 模型现在支持 内置搜索了(通过 Responses API, 搜索在 ds的服务端完成) 不需要配第三方搜索mcp 也可以工作.
收费模式不按次, 整合进token消耗了, 官方没有具体数字, 估算每次1,2分人民币
"if the model determines that your question requires a web search, it will invoke the Web Search tool and perform the search through the API provided by DeepSeek. Because invoking the Web Search tool generates additional LLM API requests to summarize the retrieved search content, additional model token costs will be incurred."
ref: https://api-docs.deepseek.com/quick_start/agent_integrations/claude_code , 这段只在 子条目 claude code 集成部分有提, 但是 同理其他的agent 一样的.v4 pro 暂不支持, (因不支持 Responses API, 现在只能用 Chat Completions 不支持内置 web_search, 官方说8月会支持)

