你最近觉得 Astra 变蠢了,可能真不是错觉。官方
Astra 刚刚发了一篇非常罕见的「事故复盘」。
简单翻译一下:
最近你觉得 Astra 变笨、乱触发 Skill、任务做到一半就停,不一定是提示词的问题。
他们自己查出了三个坑。
1️⃣ Skill 太积极了
部分 Skill 会被疯狂触发,甚至直接影响模型自己检查任务结果。
熟悉吗?
这就是我之前一直吐槽的 Agent “任务假完成”:
不是不会做,而是 Harness 在错误的时机接管了模型。
2️⃣ 上下文管理实验翻车
一个可选的 Context Management 实验,会让模型:
过早停止,或者回复旧消息。
官方估计大概 4-5k 用户受影响,目前已经直接禁用。
这点很有意思。
我们天天想着:
更长 Context → 更强 Agent
但真实工程里恰恰可能相反:
上下文管理越复杂,系统行为越不可预测。
3️⃣ 最离谱的是路由也配错了
一些配置错误的 Engine,让尾部流量出现了可测量的质量下降。
也就是说:
同一个模型、同一个 Prompt,
你拿到的可能根本不是同一种体验。
⸻
这事真正值得看的,不是 Astra 又出了几个 Bug。
而是它再次暴露了现在 Agent 系统最大的坑:
模型能力 ≠ 最终 Agent 能力。
Skill、Context、Router、Harness、Memory……
每多加一层“智能”,
都可能多加一层把聪明模型变傻的机会。
所以我现在越来越相信一个原则:
Agent 架构不是功能越多越牛,而是谁能更少地妨碍模型。
这可能也是 2026 年 Agent 工程最容易被低估的一件事。
不是继续给模型加东西。
而是学会什么时候闭嘴。
#AI #AIAgent #Astra #Agent工程 #VibeCoding #大模型 #codex #ai

