这几天刷屏全球 AI 社区的“牛来”模型 Ox Alpha,终于揭开神秘面纱。智谱于 8 月 26 日正式确认,Ox Alpha 正是其 GLM 系列新一代模型发布前的匿名测试版本,并同步上线开源 GLM-5.3-Flash。
Ox Alpha 此前以匿名身份登陆 OpenRouter 和 OpenCode,凭借强悍的编程、推理和长程 Agent 能力迅速登顶热门模型榜单。公开测试中,它在 DeepSWE 的一组 10 项任务测试中完成约 8 项,通过率达到 80%,一度超过多款主流前沿模型。
正式亮相的 GLM-5.3-Flash 采用 320B-A18B 架构,总参数量达到 3200 亿,但每次仅激活约 180 亿参数。相比上一代 GLM-5.2,它在参数规模更大的同时,通过减少激活参数和层数、优化内存与通信效率,大幅降低推理成本。智谱公布的信息显示,其端到端服务性能相比初始硬件基线提升约 3 倍。
能力方面,GLM-5.3-Flash最大的变化是从单纯的文本大模型进一步走向“多模态 Agent”。它原生支持文本、图片和视频输入,同时强化代码生成、软件工程、复杂推理、工具调用以及长周期自主任务能力,成为 GLM-5 系列首个原生多模态模型。上下文能力达到百万 Token 级别。
性能表现同样亮眼。智谱公布数据显示,GLM-5.3-Flash在 Artificial Analysis Intelligence Index 上达到 57 分。
进入全球前沿模型能力区间,并与 Claude Opus 4.8 得分持平;
更值得关注的是价格。
GLM-5.3-Flash 定价约为 GLM-5.3 的 1/10,限时优惠期间进一步达到 1/20;智谱称其价格约为 Claude Opus 4.8 的 1/40。
作为对比,GLM-5.3 当前 API 价格为输入 8 元、输出 28 元/百万 Token,海外渠道约为 $1.40 / $4.40。
But……
与此同时,Qwen3.8Flsh也刚发布……
心疼阿里[捂脸R]
#ai #人工智能 #OxAlpha #GLM #智谱 #资讯 #热点 #ai模型 #开源 #howto用好AI




