昊梵体育网

就在刚刚!Codex官方承认Astra真的变傻了!

你最近觉得 Astra 变蠢了,可能真不是错觉。官方

Astra 刚刚发了一篇非常罕见的「事故复盘」。

简单翻译一下:

最近你觉得 Astra 变笨、乱触发 Skill、任务做到一半就停,不一定是提示词的问题。

他们自己查出了三个坑。

1️⃣ Skill 太积极了

部分 Skill 会被疯狂触发,甚至直接影响模型自己检查任务结果。

熟悉吗?

这就是我之前一直吐槽的 Agent “任务假完成”:

不是不会做,而是 Harness 在错误的时机接管了模型。

2️⃣ 上下文管理实验翻车

一个可选的 Context Management 实验,会让模型:

过早停止,或者回复旧消息。

官方估计大概 4-5k 用户受影响,目前已经直接禁用。

这点很有意思。

我们天天想着:

更长 Context → 更强 Agent

但真实工程里恰恰可能相反:

上下文管理越复杂,系统行为越不可预测。

3️⃣ 最离谱的是路由也配错了

一些配置错误的 Engine,让尾部流量出现了可测量的质量下降。

也就是说:

同一个模型、同一个 Prompt,

你拿到的可能根本不是同一种体验。

⸻

这事真正值得看的,不是 Astra 又出了几个 Bug。

而是它再次暴露了现在 Agent 系统最大的坑:

模型能力 ≠ 最终 Agent 能力。

Skill、Context、Router、Harness、Memory……

每多加一层“智能”,

都可能多加一层把聪明模型变傻的机会。

所以我现在越来越相信一个原则:

Agent 架构不是功能越多越牛,而是谁能更少地妨碍模型。

这可能也是 2026 年 Agent 工程最容易被低估的一件事。

不是继续给模型加东西。

而是学会什么时候闭嘴。

#AI #AIAgent #Astra #Agent工程 #VibeCoding #大模型 #codex #ai