神秘开源模型Ox Alpha身份揭晓
-
近期的热点 “牛来” 大模型(在 OpenRouter 上匿名上线时名为 Ox Alpha)已被官方证实就是智谱 AI 发布的 GLM-5.3-Flash。
GLM‑5.3‑Flash vs DeepSeek‑V4‑Flash vs DeepSeek‑V4‑Pro
🧮 1. 规格总览(参数、架构、上下文)
模型 总参数 激活参数 架构 上下文窗口 多模态 GLM‑5.3‑Flash 320B MoE 18B 混合专家 1M 图文多模态 DeepSeek‑V4‑Flash 284B MoE 13B MoE 1M 文本 DeepSeek‑V4‑Pro 1.6T MoE 49B MoE 1M 文本
2. API 价格(输入 / 输出 / 缓存)官方公开价格(每百万 token)
GLM‑5.3‑Flash
- 输入:$0.15 / 1M
- 输出:$0.50 / 1M
限时优惠价格(5折)
- 输入:$0.075 / 1M
- 输出:$0.25/ 1M
DeepSeek‑V4‑Flash
- 输入:$0.14 / 1M
- 输出:$0.28 / 1M
- 缓存读:$0.028 / 1M
DeepSeek‑V4‑Pro
- 输入:价格上调(更贵)
- 输出:显著更贵
3. 性能(速度、吞吐、延迟)模型 输出速度(tok/s) 首 token 延迟 GLM‑5.3‑Flash ~50 tok/s 0.67s(旗舰) DeepSeek‑V4‑Flash 119.4 tok/s(最快) 0.82s DeepSeek‑V4‑Pro ~70 tok/s(DGX Spark) 0.9s(AA)
🧠 4. 智能水平(基准分)
Artificial Analysis(可比数据)
指标 GLM‑5.3‑Flash DeepSeek‑V4‑Flash DeepSeek‑V4‑Pro Intelligence Index 57 52 更高(旗舰) Coding Index 44.2(GLM‑5) 38.7 61.4 GPQA 0.820(GLM‑5) 0.894(更强科学推理) 更强(旗舰)
5. Agent / RAG / 工具调用表现GLM‑5.3‑Flash
- MCP / Tool 调用稳定
- 长任务链不容易断
- 多模态可直接看截图修 bug
DeepSeek‑V4‑Flash
- JSON 输出干净
- 适合轻量 Agent、高并发
- 长任务链容易断,需要 Harness
DeepSeek‑V4‑Pro
- 复杂推理强
- 但长工程上下文追踪弱于 GLM
6. 私有化部署GLM‑5.3‑Flash
- 已开源(MIT)
- 支持国产卡
- 本地部署友好
DeepSeek‑V4‑Flash / Pro
- 权重 MIT 开源
- 生态成熟
维度 GLM‑5.3‑Flash DeepSeek‑V4‑Flash DeepSeek‑V4‑Pro 总参数 320B MoE 284B MoE 1.6T MoE 激活参数 18B 13B 49B 上下文窗口 1M 1M 1M 多模态 图文 文本 文本 输入价格 $0.15/M $0.14/M 更贵 输出价格 $0.50/M $0.28/M 更贵 输出速度 ~50 tok/s 119 tok/s ~70 tok/s 智能指数 57 52 更高 代码能力 强 中等 最强(算法) Agent 稳定性 最稳 中等 中等 私有化 MIT 开源 MIT 开源 MIT 开源 GLM‑5.3‑Flash实际挑战SVG生成的中国传统太极八卦

村里刚通网?