📡 AI日报 8/7 | DeepSeek预告大幅涨价、张一鸣表态不走蒸馏捷径、Nvidia Feynman转向光子互连
-
1️⃣ DeepSeek 8/6 预告大幅上调 API 定价:据观察者网,DeepSeek 发公告称"计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大",具体幅度和时间未公布。目前其已执行峰谷定价(工作日 9-12 时、14-18 时价格为平时 2 倍),业内解读这次预告与 deepseek-v4-pro 正式版即将上线相关。梁文锋 7 月在投资者交流会上的说法:"API 定价大概是在市场上买一批设备回来,十个月收回成本",且该价格区间需求弹性小。彭博 8/4 测算:用 V4-Flash 完成一项复杂任务成本仅 3 美分,而 Claude Fable 5 为 3.15 美元、GPT-5.6 Sol 为 1.86 美元——国产低价补贴模式开始回调,行业价格基准线可能整体上移。
2️⃣ 张一鸣在 Seed 团队全员大会表态:字节不走模型蒸馏捷径:据 The Information 8/6,上个月字节 Seed 团队全员大会上,张一鸣罕见表态字节跳动不会把蒸馏当作提升 AI 模型能力的捷径,即便这意味着现阶段落后于国内竞争对手;有消息称字节内部对开源模型也严禁蒸馏,核心是技术路线判断——蒸馏会干扰真正意义上的长期突破。
3️⃣ Google 把 AI 权力集中回加州总部:据 Bloomberg,Alphabet 正将 AI 领导层集中到 Mountain View 总部,在与 Anthropic、OpenAI 的竞争中提速决策;CNBC 同日报道,谷歌一边扩张 AI 帝国(向对手卖算力、Gemini 商业化)一边流失亲手缔造它的人——Jeff Dean 出走 Discovery Loop 之后,人才流失仍在继续。
4️⃣ Nvidia 下一代 GPU 微架构 Feynman 转向光子互连:据 CNBC,市场下一波 AI 投资热点可能从存储芯片转向光互连——Nvidia 的 Feynman 架构将大幅摆脱铜互连,预计 2028 年发布。同期 Nvidia 技术博客发布 Rubin 架构详解,强调为 Agentic AI 时代做计算/内存/网络/机架级全栈协同设计。
5️⃣ Nvidia 2.1 亿美元押注矿商转型:据 Stocktwits,比特币矿商 IREN 与 Nvidia 达成 2.1 亿美元 AI 投资协议,Nvidia 获五年期最多 3000 万股认股权证(行权价 70 美元/股),IREN 加速从挖矿转向 AI 数据中心——和上周 Volta 的 100 亿美元算力大单是同一个主题:AI 基建的瓶颈正在从芯片转向电力与融资结构。
6️⃣ AI 电力激增"烧坏"自己的数据中心:据 LA Times,AI 算力激增正在冲击电网,连 Nvidia 自家部署也面临节电压力;叠加此前德州叫停新数据中心并要求审计,电力问题已从行业抱怨升级为州级监管动作。
7️⃣ 中国 AI 连续 14 周霸榜调用量:据央视新闻,最新一周全球 AI 大模型调用量榜单前五名中国产品占四席;OpenRouter 7/27-8/2 周榜上,deepseek-v4-flash 单周调用量 7.22 万亿 token 居首——而全平台接入 400 余款模型、日均总量约 6.6 万亿 token,单模型一周就吃掉了平台一天的量。
开源 & 开发工具
- PrimeIntellect 开源「Prime Agent」:自改进 RLM agent,面向编码工作流和长时自主任务(long-running autonomous tasks)。
- AtomicBot 发布「Atomic Agent」:本地优先 AI agent,针对本地模型优化,长上下文窗口 + 工具调用,数据不出设备——本地 LLM 玩家可以关注。
以上信息综合自观察者网、The Information、Bloomberg、CNBC、LA Times、央视新闻、Stocktwits、Brave Search 等多源,数据截至北京时间 8/7 早间。