昊梵体育网

智谱最近发布了GLM-5.3,成绩单非常亮眼:Terminal Bench 3.0从4.6分暴涨到28.3分,拿下开源第一;CyberGym以84.5%登顶全球,压过Claude和GPT-5.6;DeepSWE上以66.9分超过了DeepSeek V4 Pro的62.7分。更夸张的是,高难度编程任务中,它只用了不到Claude一半的Token,就拿到了更高的完成率。 按以往的 ​

智谱最近发布了GLM-5.3,成绩单非常亮眼:Terminal Bench 3.0从4.6分暴涨到28.3分,拿下开源第一;CyberGym以84.5%登顶全球,压过Claude和GPT-5.6;DeepSWE上以66.9分超过了DeepSeek V4 Pro的62.7分。更夸张的是,高难度编程任务中,它只用了不到Claude一半的Token,就拿到了更高的完成率。

按以往的逻辑,GLM-5.2发布当天股价暴涨32.8%,一周市值破万亿,这波5.3理应直接起飞。但现实是,发布当天高开低走,收盘跌了3.57%,日内回撤超11%。
跑分屠榜,股价跳水。市场的逻辑彻底变了。
先从技术线看。GLM-5.3和5.2其实用的是同一个7430亿参数基座,所有性能跃升全靠后训练。这和DeepSeek V4 Pro从预览版到正式版的逻辑一模一样,都是同一个1.6T基座,能力靠“调教”出来的。
但两家的“调教”路线,走向了完全不同的方向。
智谱走的是“内循环自进化”。唐杰的思路是让模型自己变聪明。GLM-5.3引入了一套自动出题和判题的流水线,用AI研究员去真实场景抄题目,再让AI判卷员不看答案、只盯解题过程来确认题目有效。只有“题能出、能做、过程干净”三道关卡全过,才允许进入训练集。同时配套升级了训练框架,让误差控制在千万分之一,长程编码任务训练速度翻了2.3倍。
DeepSeek走的是“外挂式插件化”。梁文锋和崔添翼的思路是让模型的身体无限重组。DSH框架的核心就五个字:一切皆插件。模型接入、工具注册、会话日志、甚至驱动Agent运转的主循环本身,全部是可以随时拔插的积木。底层微内核只负责插件的加载和卸载,每个插件的副作用能被追踪和自动回收,不留垃圾。这意味着Agent可以在跑任务时随时换掉搜索引擎,甚至换掉决策策略,类似于热插拔。模型智商不变,但手脚和器官可以无限升级。
如果说唐杰的自进化是生物学意义上的基因迭代,那梁文锋和崔添翼的自进化就是工具意义上的进化——从石器到蒸汽机,工具的重组让能力指数级扩张。DSH开源不到两天,GitHub斩获10万星,开发者社区的态度很说明问题。
除了路线之争,还有更现实的一层:商业化。
DeepSeek一直是价格屠夫,靠极致性价比打穿行业底线。但8月13日发布V4 Pro正式版当天,官宣了API调价,全面引入峰谷分时定价,整体涨幅50%至1100%。开发者圈子里从“梁文锋的恩情还不完”变成了“梁圣变梁子”的调侃。
涨价的不仅是DeepSeek,智谱一季度已经连续上调了三次API价格。全行业都在涨价。本质不是算力贵了,而是公司长大了。AGI研发是个无底洞,唐杰的摸高计划要投百亿级做可解释性和合成数据工厂,梁文锋要养DSH的开源生态。靠融资烧钱终究不是长久之计,从成本加成转向价值定价,告诉资本市场自己准备好挣钱了,是必须迈出的一步。
GLM-5.3虽然八项赢了七项,但市场认为这只是“符合预期”的后训练迭代,没有超出基座不变的框架。而V4 Pro加上DSH的插件化生态组合,被视作长期变量。
股价成了这场AGI路线之争的风向标。市场不再只看跑分,而是在押注哪套技术哲学和商业逻辑更有持续性。智谱、DeepSeek、Kimi三家在AGI赛道的竞速,已经从单纯的模型能力,转向了系统级工程、生态建设和商业闭环的全面较量。
智谱今天的暴跌,恰好说明市场正在重新定价这条赛道的未来。#deepseek##世界模型##效率工具#