昊梵体育网

腾讯 Hy4 preview 内测的真实感受。

现在这个模型竞争是真的激烈。完全没想到,腾讯混元 Hy4 preview 这么快就来了,之前很多人还预测说得年底。

我昨天一早拿到了内测名额,干了 2000 多万 Token,还是想和大家说下我的真实感受。

先说模型基本的配置,这现在看模型,就和手机一样,得先看参数。Hy4 preview 的基本面是:

1)总参数 770B、激活参数 49B。
2)1M 上下文。
3)输入缓存命中 0.3 元。

能看出来,确实腾讯也在逐步提升模型的总参数量,这也是意料之中的事情。

目前各个公司都在追求更大规模参数的模型,毕竟大参数和模型之间,还是有直接的对应关系。

Benchmark 等等能在其他地方查到的信息,我就不说了。直接谈谈我的使用感受。

1、Hy4 preview 仍然在快速进步,综合能力基本上已经逼近 GLM-5.3 的水准,超过 DeepSeek V4 系列。

这次之后,我觉得腾讯的模型也正式跨入到国内第一梯队的水准了。至少和之前我们讨论的 Kimi、GLM 等等模型,可以有来有回了。

2、或者这么说,我这两天全天候在 WorkBuddy 中深度使用 Hy4 preview。

在我日常跑的这些 Coding 或者办公任务里,已经很难明显感觉到 Hy4 preview 和其他几个头部模型之间有什么差距。

感受不出来,根本感受不出来。有更复杂 Coding 场景的同学,也可以试试,评论区里交流。价格还是非常便宜。

3、我让它做了一个北京地铁动态交互网站,前前后后大概跑了半个多小时。

大家可以直接看效果。其实它第一次生成出来的版本,完成度就已经非常高了。

这个 Case 我之前也试过 Hy3 正式版,基本做不出来。所以单看前端 Coding,Hy4 preview 相比 Hy3 的提升还是非常明显的。

4、我把自己目前正在跑的一个后端项目交给它,让它帮我检查里面可能存在的漏洞。

其中有一部分涉及订单场景,不同平台的支付逻辑交织在一起,代码本身还是比较复杂的。

Hy4 preview 最后真的找到了一个并发场景下,订单号和支付逻辑之间的 Bug。