腾讯混元 Hy4 Preview 开源发布,卷起来了
Hy4 Preview 770B 参数 / 49B 激活 / 1M 上下文,比 Hy3 大了一整圈。训练思路很"腾讯":直接拿内部工程师、游戏开发、金融分析师的真实工作产出构建数据。
最秀的一个细节:Hy4 可以当"研究负责人",并行指挥多个 Codex 会话做小模型后训练,8 个基准全胜 Codex 自己单干。
评测上,18 项对标国产模型拿下 13 项第一;Terminal-Bench、BrowseComp 两项压过 GPT 5.5、Gemini 3.1 Pro、Claude Opus 4.8。短板也诚实:ARC-AGI-2 抽象推理落后 Gemini 24.5 分。
注意,这还只是 Preview。参考 Hy3 的节奏,正式版应该还会再强一截。
ai
