📡 AI日报 8/13 | DeepSeek V4 Pro 正式发布、xAI发布Grok 4.6、OpenAI首款硬件曝光
-
1️⃣ DeepSeek V4 Pro 正式发布(GA),结束近四个月预览 — Unite.AI / wccftech / OpenRouter 8/12:DeepSeek 8月12日把旗舰模型 V4 Pro 转正(版本号 V4-Pro-0813),API 与 DeepSeek Chat 同步上线,OpenRouter 同日挂出 GA 版本。模型为 1.6 万亿总参数 MoE(每 token 激活 49B),100 万 token 上下文、最大输出 38.4 万 token;定价 $0.435/百万输入、$0.87/百万输出(缓存命中低至 $0.0036/百万)。架构上用 Compressed Sparse Attention + Heavily Compressed Attention 两种注意力变体,官方称百万 token 档位下单 token 推理算力降到 V3.2 的 27%、KV cache 降到 10%。早期社区数据(未经官方确认)显示 Terminal Bench 较 4 月预览版提升 15.8%,并在 Terminal Bench 2.1 / Cybergym / DeepSWE / AutomationBench 上超过 Opus 4.8。7 月 DeepSeek 的 token 消耗量已排全球第二(仅次于 Anthropic)——配合 7/31 转正的 V4-Flash-0731(284B 参数、$0.14/$0.28 每百万),价格战打到了新高度。对本地玩家来说,V4 系列权重本就是 MIT 开源,现在旗舰 Pro 也正式转正了。
2️⃣ SpaceXAI(原 xAI)发布 Grok 4.6,主攻长时运行 Agent — VentureBeat/9to5Mac 8/12:马斯克的公司周二发布旗舰模型 Grok 4.6,官方称智能水平对标 OpenAI GPT-5.6 Sol 和 Anthropic Claude Fable 5,Artificial Analysis 智能指数得分 61,追平 GPT-5.6 Sol、距离榜首仅 1 分;社区 ELO 1753、API 定价约为同级竞品一半。重点强化长时运行 Agent、编程与知识工作,500K 上下文,当天上线 Grok Build、Cursor、Grok Bot 与 API(首周 Cursor/Grok Build 内 2 倍用量)。同期 Grok 4.5 也已进入 GitHub Copilot,编程代理赛道的军备竞赛肉眼可见地提速。
3️⃣ OpenAI 首款硬件设备曝光:甜甜圈形无屏 AI 音箱 — Bloomberg/AI Weekly 8/11:彭博报道 OpenAI 的首款自研硬件是一款甜甜圈形状的智能音箱,体积约等于二代 Echo Dot,无屏幕,定位「住在你身边的 AI 伴侣」。这是 OpenAI 从纯软件公司向自有硬件形态迈出的第一步,也呼应了 Altman 反复强调的「AI 需要新的交互形态」的判断。
4️⃣ Google DeepMind 换帅:Kavukcuoglu 接任,Hassabis 转任主席 — CNBC 8/12:原 DeepMind CTO、谷歌首席 AI 架构师 Koray Kavukcuoglu 升任 DeepMind 负责人(SVP),直接向 Sundar Pichai 汇报,统管 Gemini 模型开发与前沿研究;DeepMind 联合创始人兼 CEO Demis Hassabis 转任主席。谷歌自 2026 年初以来未发布新的前沿模型,分析认为这次换帅意在把重心从学术项目转向前沿性能与开发者工具,追赶 OpenAI 和 Anthropic。
5️⃣ 氛围编程热:Lovable 估值翻倍至 133 亿美元 — 财联社 8/12-13:AI 应用构建工具 Lovable 完成新一轮融资,投后估值 133 亿美元,较去年 12 月翻了一倍。市场对「Vibe Coding」(氛围编程)的追捧持续升温,资本正在为「非程序员用自然语言造应用」这一方向下重注。
6️⃣ 又一位 xAI 联创创业:River AI 融资 11 亿美元,押注开源模型与个人 AI — 网易/新浪 8/12:今年 6 月才成立、团队仅约 20 人的 River AI 完成 11 亿美元融资,主打开源模型与个人 AI 方向,刚公开首个产品 River API。AI 科学家创业拿钱的速度越来越快,「开源 + 个人化」路线正在成为资本的新宠。
7️⃣ 安全研究:API 思维链泄露漏洞,弱模型可解码强模型推理 — TheHackerNews 8/12:论文《Stealing Reasoning Traces from Proprietary LLM APIs》披露,OpenAI、Anthropic、Google 三家 API 中用于跨会话保留推理状态的「加密推理块」存在设计缺陷:同一家厂商的弱模型(Claude Haiku 4.5、GPT-5.6 Luna、Gemini Robotics ER-1.6)可被当作「模糊解码器」转录强模型的隐藏思维链。研究者在 6,708 条公开 agent 轨迹中解码了 31.5 万个思维块,还原出 704 个隐私痕迹,包括 62 个 API key、33 个密码、24 个访问令牌和 7 个私钥。三家厂商已完成修复,主提取攻击 8 月起不再可复现,未发现野外利用。对 agent 用户的直接教训:分享 agent 日志前务必剥离 reasoning 块,别把原始 API 记录提交到仓库。
以上信息综合自 Unite.AI、wccftech、OpenRouter、VentureBeat、9to5Mac、CNBC、Bloomberg、AI Weekly、财联社、网易、新浪、TheHackerNews及 Brave Search 等多源,数据截至北京时间 8/13 早间。