对, 我也这么觉得.
从截图到操作DOM, 这一步加速我猜测是加速幅度最大的.
crazypeace
-
让computer use 速度飞起来:JEV-Ultrafast 的 DOM 决策链路实测 -
中国电信TeleAgent星辰超级智能体:老特评测基准测试结果楼主开宗明义, 说得很明白了. 哈哈

-
各位对小学生AI教育的看法我觉得要分成2部分来看.
- 做出来 AI slop.
让制作者吃自己的狗食.
你做的这个东西, 你自己用吗? 一天用几次? 一周用几次? 一个月用几次?
类比 传统语境下的, 你自己做了个小板凳, 你自己愿意坐吗? 会不会因为没打磨好, 扎屁股所以你自己都不愿意坐? 会不会因为放不平, 总是晃, 所以你自己都不愿意坐? - 在现在这个 人人都是创建者 的时代, 你的作品对他人有没有价值? 有没有人愿意用你的作品? 有多少人愿意用? 愿意付出多少代价以获得使用权? 当然, 对于孩子的作品来说, 要求不高的使用者很可能就是同龄人.
我觉得教AI 和教其它技能是一样的.
要么你自己能力足够强, 你能讲得清楚 "让他们理解 AI 能做什么、不能做什么;怎么判断 AI 给你的东西到底好不好;怎么形成自己的审美和判断;怎么把 AI 当成一个可以反复迭代、实验、创造的工具,而不是输入一句 prompt,拿着第一个结果就走"
要么你自己能力不强, 就没什么办法.类比 传统语境下, 你会弹钢琴, 会欣赏钢琴, 你就可以指导孩子学习钢琴. 你不会钢琴, 那就只能闭嘴.
- 做出来 AI slop.
-
說說我對DeepSeek快速降價的看法 -
說說我對DeepSeek快速降價的看法 -
基于Codex开发的电报群管机器人"反垃圾广告强很多"
有示例吗? 比如, 哪个广告, 在其它机器人那里判断不出来, 在你这里能判断出来?
-
神秘大模型Ox Alpha 、性能很强、还完全免费的 AI 模型。 -
神秘大模型Ox Alpha 、性能很强、还完全免费的 AI 模型。Hermes 官方免费提供

-
今天应该全世界的人都在蹬 ox-alpha (x-preview-f-free) 模型 吧? 大家蹬的感受如何?今天应该全世界的人都在蹬 ox-alpha (x-preview-f-free) 模型 吧?
大家蹬的感受如何?我觉得蹬到后面, 可能用的人多起来, 首字有点慢,
但结果正确不返工, 那这效果我是能接受的. -
DeepSeek V4 Flash Vision实测:识图白菜价,DeepSeek Harness开发App真能放手干了?我用 agent 开发 C++ 遇到个问题, 编译之后 跑起来 agent 没办法自己测试.
具体表现为, 能截图看到界面, 但是没有好的工具模拟点击.
准确地说, Agent 说是找到了一个现成的 linux 工具, 但是实际效果并不行. 总是出现 Agent 说 点击xxx, 然后说没生效没点到.我用 agent 给 forkgram 增强开发小功能.
修改 forkgram/tdesktop 实现 屏蔽音频/视频按钮功能 -
發現一個讓程式碼自動優化的神奇技巧,同事看完直接跪了思路不错!
很快 模型就会学习吸收了. -
关于ai 视频创作,我有话说,就算有minimax h3 这样掀桌子的工具。还有一种思路是,
我本来就不是做精品的, 我就是大量生产 普通品, 海投出去, 有一个爆款就行了.
反正都是洗稿, 成本低. -
修改 forkgram/tdesktop 实现 跳转到最后一条@我的消息 by Hermes 对接 oc/deepseek-v4-flash-free -
Codex接入DeepSeek V4 Flash后真香了:编程比Hermes强,还省一半Tokens! 但是比较慢,综合任务略输一筹!hermes 更像是个全面的助手/助理, 各种打杂.
-
修改 forkgram/tdesktop 实现 跳转到最后一条@我的消息 by Hermes 对接 oc/deepseek-v4-flash-free前言
我们之前已经实现了 有@我消息的群 置顶 方便我们"快速到达战场"
但是, 如果我们在这个群组里上下滚动了一下, 或者跳到其它群/频道 去找 "论文引用材料", 再回到刚才的群组, 就有可能出现找不到 刚才@我的那条消息 的情况.
如果你喜欢在多个群里面"剧烈地与人交流", 说不定你需要这样的功能:
找到上一条@我的消息面向Agent开发
Hermes 对接 oc/deepseek-v4-flash-free
https://zelikk.blogspot.com/2026/08/omniroute-hermes-agent-oracle-arm-ubuntu-root-sudo-.html
下面的引用框里面都是我发给Agent的自然语言
分析
https://github.com/forkgram/tdesktop如果我要实现这样一个功能:
我想找到群组中上一条 @我的消息, 或回复我的消息.
有什么方案?
目前 forkgram 在群组中有一个菜单项是 "Go to the first message",
在这个菜单项的下方增加一条"Go to the last message mentioned me"
成果
群组菜单

跳转结果

Github
代码
https://github.com/crazypeace/forkgram-tdesktop/tree/goto-last-mentionRelease
https://github.com/crazypeace/forkgram-tdesktop/releases/tag/goto-last-mention -
本地模型太弱,给它创建一个 skill去白嫖在线AI -
DeepSeek涨价?在线AI模型性价比盘点,HY3和小米MiMO API不错。GPT Plus订阅套餐很划算!字节跳动杀猪盘,Gemini变傻了~@terry
其实都是些 好小好小的需求.
就是我说的 某个功能的开/关, 功能A + 功能B 合成一下, .... 这种所以这个复杂程度的需求不需要SOTA模型, 就拿 二线模型 (当然现在有极便宜的 deepseek-v4-flash了) 就足够了.
-
DeepSeek涨价?在线AI模型性价比盘点,HY3和小米MiMO API不错。GPT Plus订阅套餐很划算!字节跳动杀猪盘,Gemini变傻了~hy3 拿来开发不太行, 哪怕是小需求. 干脏活可以, 就是帮你部署项目啊, 或者是调整服务里面的配置项啊, 打开/关闭某个功能啊, ...
mimo-v2.5 开发可以, 做点小需求, 基于已有的项目做一些"增强"开发.

-
请教一下大家deepseek v4 flash驱动hermes都开推理吗?我用的 hermes 默认设置, 没想过这个, 刚让TA自己查了, 开的是 中
agent.reasoning_effort
• 值: medium (第36行)
• 含义: 推理努力度设为中等 → 全局开启推理show_reasoning
• 值: false (第283行)
• 含义: 推理内容隐藏,不显示在回复里我的使用体验是, 你描述 需求/问题 越精确, agent 工作得越快, 费的token越少.
至于你说的这个问题, 你说最终原因是 "手机浏览器支持mp4,不支持另一个协议" 那么你的 agent 还去操作手机测试了? 这个操作手机的过程比较费token吧? 我猜.


