<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[在线调用的最大无奈]]></title><description><![CDATA[<p dir="auto">原计划是要用deepseek-v4 flash验证本地模型写的代码有没有bug，确实发现了隐藏的bug<br />
<img src="https://upload.lcz.me/uploads/17209644-501a-409c-88d7-a765985290a0.jpeg" alt="bb3b5da6-2a60-4ee8-b062-ef46202d10c4-image.jpeg" class=" img-fluid img-markdown" /></p>
<p dir="auto">但是再做下一步任务的时候报错了：<br />
<img src="https://upload.lcz.me/uploads/6b9e49d5-0e7c-4457-acec-ac666f53aa08.jpeg" alt="25632d2a-9ec4-4e0a-91f9-21331f9b0c82-image.jpeg" class=" img-fluid img-markdown" /></p>
<p dir="auto">重试几次都是同样的问题，重启gateway还是错误依旧</p>
<p dir="auto">换成本地模型就好了，哎......</p>
<p dir="auto">晒一下deepseek的调用情况：<br />
<img src="https://upload.lcz.me/uploads/f97cd5b1-1105-4129-a28f-43ccbcf2d878.jpeg" alt="e148f2dd-c36d-4574-9809-d42153c16abd-image.jpeg" class=" img-fluid img-markdown" /></p>
]]></description><link>https://lcz.me/topic/810/在线调用的最大无奈</link><generator>RSS for Node</generator><lastBuildDate>Sun, 26 Jul 2026 22:16:58 GMT</lastBuildDate><atom:link href="https://lcz.me/topic/810.rss" rel="self" type="application/rss+xml"/><pubDate>Thu, 09 Jul 2026 01:04:49 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to 在线调用的最大无奈 on Thu, 09 Jul 2026 02:17:30 GMT]]></title><description><![CDATA[<p dir="auto">这个是典型的Agent工具和API格式不适配的情况，和什么场景无关。需要确认的是你的Agent工具是什么，其格式是否符合deepseek官网提供的两种兼容API其一。</p>
<p dir="auto">本地LLM能正常运行，普遍是因为不管是llama.cpp还是vllm，他们的API都是考虑最大化宽松兼容的，走的是能跑就跑的设计思路，和线上API的效率优先逻辑不同。</p>
]]></description><link>https://lcz.me/post/9517</link><guid isPermaLink="true">https://lcz.me/post/9517</guid><dc:creator><![CDATA[kop wang]]></dc:creator><pubDate>Thu, 09 Jul 2026 02:17:30 GMT</pubDate></item></channel></rss>