昊梵体育网

一晚上过去,大新闻有好有坏。好的是 Kimi K3 大获成功 坏的是,Gemi

一晚上过去,大新闻有好有坏。好的是 Kimi K3 大获成功

坏的是,Gemini 3.5 Pro 不光再次跳票,甚至可能要无了。

根据彭博社等报道,3.5 Pro 的代码生成能力未达内部预期。谷歌 6 月下旬专门更新了一版训练数据以补强代码,成绩还是没起色。据传谷歌推翻了此前的训练方案,从零开始重训,可能是未达预期的因素之一。

【3.5 Pro 内部评测,甚至跑不过 Muse Spark】

半个月前,内部认为 3.5 Pro 至少在 GPT-5.5 水平。但本周的新情况是,3.5 Pro 甚至可能不如 Meta 的 Muse Spark。

Muse Spark 是 MSL 发布的第一款模型,官方定位是个定位旗舰,价格接近 Flash 定位的「起点模型」,在 LiveCodeBench Pro 上落后 GPT-5.4 和 Gemini 3.1 Pro。前几天,Meta 更新了补强 coding 与 agent 能力的 1.1 版。

这些都是公开的信息,至于怎么理解看你:比方说,你可以理解为,3.5 Pro 的编程可能不如 GPT-5.4,跟自己的前代 3.1 Pro 相比可能没有优势,甚至可能不如前代??

但我们可以确定的是,谷歌的当家旗舰,现在沦为要和对手的初代大模型比较的程度。

(之前甚至还有爆料说 3.5 Pro 超越 Fable,不知道是什么梦话……)

【谷歌收回部分员工对 3.5 Pro 的内部使用权限】

根据了解,部分关联业务员工已经 beta 测试 3.5 Pro 一段时间,但测试权限已于近日收回。Gemini 模型团队仍可正常使用该模型,并查看模型与其他模型的基准分数对比。

【内部员工心态崩溃,考虑跳槽】

Gemini 关联业务的员工告诉 APPSO,现在内部士气相对低落。加之内部团队整合可能面临优化,不少人考虑跳槽,目标是大家都知道的那些实验室。

上个月,Gemini 学术明星、Transformer 提出者 Noam Shazeer 转投 OpenAI;诺奖得主 John Jumper 带着多名资深研究员去了 Anthropic 以及其他公司。人员流失以及模型发布跳票间接引发 Alphabet 市值一周蒸发千亿美元。

「现在出新的模型,一定要超过其他家,否则没有意义,」一位员工说道。

Gemini 能否找到意义?
3.5pro Opus5.5 fable5