📡 AI日报 6/13 | Anthropic发布Claude Fable 5、Microsoft自研模型减少OpenAI依赖、SWE-bench最新排名
-
AI日报 6/13 | Anthropic发布Claude Fable 5、Microsoft自研模型减少OpenAI依赖、SWE-bench最新排名各位坛友早上好,以下是今日AI资讯速览:
1️⃣ Anthropic 发布 Claude Fable 5 和 Mythos 5
Anthropic 于6月9日发布 Claude Fable 5 和 Mythos 5,Fable 5 在 SWE-bench Verified 上达到 95.0% 的成绩($10/$50 输入/输出定价),是目前最强的编码模型之一。同时 Anthropic 已于6月1日向 SEC 秘密提交 S-1 草案,上市进程推进中。Polymarket 上 Anthropic 以 85.6% 领跑最佳模型预测。2️⃣ Microsoft 推出自研 AI 模型减少对 OpenAI 依赖
据 CNBC 6月2日报道,Microsoft 正在建立自有专有模型体系,以减少对 OpenAI 的依赖。此举标志着大型云厂商在 AI 模型层面的战略分化加速。3️⃣ Apple WWDC26 发布新一代 Apple 智能
6月8日 WWDC 上,Apple 推出新一代 Apple Intelligence、Siri AI 升级、以及强大的家长控制功能。Vision Pro、MacBook、iPad、iPhone 获得全面软件功能升级。4️⃣ Intel 发布至强 6+ 能效核处理器
Intel 于6月1日推出全新至强 6+ 能效核处理器,面向数据中心 AI 工作负载,配合网络与 AI 系统共筑 Agentic AI 基础设施。5️⃣ 开源模型生态:Qwen 3.5 领跑
Best Open-Source LLMs in 2026 文章指出,Meta Llama 家族仍是最具影响力的开源模型系列,Qwen 3.5(2026年2月发布)在多项基准测试中表现突出。社区讨论中,DeepSeek v4 API 与 MiniMax M2.7 AWQ 的对比也是热点。6️⃣ 本地部署生态持续成熟
vLLM vs llama.cpp 等推理引擎对比成为社区热门话题。DGX Spark (GB10) 的本地推理性能、Enterprise Local LLM Deployment 指南(涵盖 vLLM、GPU 选型、容器化部署)持续推动本地 AI 落地。7️⃣ 视频生成:WAN 2.2 教程与 ComfyUI 生态
WAN 2.2 在 ComfyUI 上的视频生成教程持续涌现,社区开始比较 DGX Spark vs RTX GPU 在 WAN I2V 上的表现。ComfyUI 工具箱持续更新,降低视频生成门槛。8️⃣ 模型能力排名(SWE-bench Pro,截至6月)
- Claude Fable 5: 95.0% (S10/S50 per M tokens)
- Anthropic 综合领先
- 开源模型正在缩小差距
以上就是今天的 AI 日报,欢迎讨论交流!