📡 AI日报 7/17 | Google重写Gemini 3.5 Pro、NVIDIA日本发布Cosmos 3 Edge、腾讯开源1-bit Hy3
-
AI日报 7/17 | Google重写Gemini 3.5 Pro、NVIDIA日本发布Cosmos 3 Edge、腾讯开源1-bit Hy3
AI 业界前沿1️⃣ Google彻底重写Gemini 3.5 Pro基础模型,原有架构被废弃从头构建,性能目标直指缩小与OpenAI GPT-5.6系列的差距
2️⃣ OpenAI代理产品爆发增长:Codex用户达600万(日增100万),GPT-5.6 Sol价格减半、同任务token效率翻倍,使用成本降至原来的四分之一
3️⃣ NVIDIA CEO黄仁勋访日,发布Cosmos 3 Edge世界模型(面向机器人和视觉AI Agent),并与富士通、日立、川崎重工组成实体AI联盟,拓展日本Physical AI市场
4️⃣ Anthropic与Blackstone联手押注AI实施服务,认为下一家万亿美元AI公司不是模型公司,而是帮助企业落地AI的服务商
5️⃣ Microsoft训练销售团队以话术打压OpenAI和Anthropic,同时修补创纪录数量的安全漏洞(归功于AI检测能力)
6️⃣ Apple Intelligence获批在中国上线,与阿里巴巴(Qwen)和百度合作;同时Apple洽谈收购PrismML,其三元量化技术可将54GB模型压缩至4GB运行于iPhone
7️⃣ Moonshot预告Kimi 3即将发布,预计将缩小与Anthropic Opus 4.8的差距
8️⃣ 联合国AI峰会在日内瓦开幕,讨论AI安全治理与"灾难性损害"防范
9️⃣ Thinking Machines(Mira Murati创立)发布首款开源模型Inkling,反对"一刀切"通用AI路线
️ 开源 & 开发工具• 腾讯开源295B Hy3的1-bit量化版,仅88GB可在Macbook Max上运行,SWE-Bench达75.4%(仅降5%),Stable Diffusion创始人称为"今日最大新闻"
• GLM-5.2支持1M上下文,SGLang在8×B300上实现500+ tok/s服务,1M上下文内交互体验几乎平坦
• AMD MI355X现已支持vLLM RL训练,Qwen3-8B达4100 tok/s/gpu,GRPO端到端可用
• vLLM与TileRT实现prefill/decode分离,在GLM-5.1-FP8(8×B200)上解码达618 tok/s
• 商汤发布SenseNova Token计划:首月每5小时刷新1500次免费API调用
行业趋势• 2026年6月美国风投报告:AI初创融资占全美风投的59.8%,Baseten以15亿美元Series F领跑
• SpaceXAI(Grok Build)被曝自动上传完整代码库到xAI云存储,Sam Altman转发表态"令人担忧"
• Suno被曝从YouTube抓取训练数据(逆向工程证据),AI音乐版权争议再升温
• Elorian AI以3亿美元pre-seed估值融5500万美元(产品尚未发布),视觉AI赛道资本热度可见一斑
• AI Engineer World's Fair 2026五大趋势:焦点从Agent转向其周围系统,评估仍是核心挑战
以上信息综合自TechCrunch、Brave Search、Recsys Frontier等多源,数据截至北京时间7/17早间。