Token小偷-告别Astra!实测qwen3.7 27b+Blender一样可以玩
-
Token小偷-告别Astra!实测qwen3.7 27b+Blender一样可以玩。
最近刚玩codex,发现他默认使用computer-use,个人认为这种设定属于token小偷,特别是GPT6-Astra,没玩几下就限额了。今天刷到@白无常C4D 的帖子,非常赞同他的观点——AI本身擅长的是代码而不是“看”,然而codex使用computer-use依然是截图“看”,慢且巨浪费token。
于是我们尝试用本地的qwen3.8 27b+hermes跑blender工作流,因27b知识量少,所以给他配了blender-MCP,当然如果是大参数模型完全可以用cli,要比MCP还要快且省token。
话外:
1️⃣codex尽量禁止computer-use,接入MCP或指定让他用cli,其他hermes、harness同理。
2️⃣创意层astra无法替代,qwen家族全都打不过,国产GLM5.3可以碰一碰,DeepSeek没试过。简单讲有创意直接让qwen执行,没创意需要Astra帮忙。
3️⃣出图和出视频用的PixVerse Cli的gpt image2.5和seedance2.5 -
Token小偷-告别Astra!实测qwen3.7 27b+Blender一样可以玩。
最近刚玩codex,发现他默认使用computer-use,个人认为这种设定属于token小偷,特别是GPT6-Astra,没玩几下就限额了。今天刷到@白无常C4D 的帖子,非常赞同他的观点——AI本身擅长的是代码而不是“看”,然而codex使用computer-use依然是截图“看”,慢且巨浪费token。
于是我们尝试用本地的qwen3.8 27b+hermes跑blender工作流,因27b知识量少,所以给他配了blender-MCP,当然如果是大参数模型完全可以用cli,要比MCP还要快且省token。
话外:
1️⃣codex尽量禁止computer-use,接入MCP或指定让他用cli,其他hermes、harness同理。
2️⃣创意层astra无法替代,qwen家族全都打不过,国产GLM5.3可以碰一碰,DeepSeek没试过。简单讲有创意直接让qwen执行,没创意需要Astra帮忙。
3️⃣出图和出视频用的PixVerse Cli的gpt image2.5和seedance2.5这个账算得对,computer-use 的成本主要不是模型能力,是「截图」这个动作。一张 1080p 截图进视觉编码器大约 1k+ token,一个多步任务几十张图就是几万 token,而且每步都要重新观察,误差还会累积。
几个能省的方向:
- 能走结构化接口就别截图:浏览器用 DOM/Playwright,桌面应用优先 UI Automation / Accessibility API(Windows UIA、macOS AX),拿控件树比拿像素便宜一个量级。
- 必须截图时降分辨率、裁区域(只截当前窗口/控件),并做帧间去重,画面没变就不要重发。
- 工具调用走 MCP 或 CLI 更省,是因为返回的是文本结果,不是图像。
- 反过来,纯 GUI、没有 API 的老软件,computer-use 仍是唯一解,别一刀切禁掉,按任务类型分流。
本地 27B 配 blender-MCP 的思路对:确定性操作用 MCP,创意/规划交给大模型。
-
,
T terry 固定了此主题
-
,系统 取消固定了此主题