reasoning(思考内容)在上下文中的可见性问题,其实各个云服务商并不统一。所以有时候会给agent带来一些怪异的错误。
虽然api提供商都提供open ai兼容协议的接口,但是各家的实现是不一致的。经常会出一些bug。比如用opencode,遇到有些模型就会出一些api调用错误,中断了长任务。
reasoning,各个云服务商一般的实现,在llm发起的多轮工具调用中,是可见的。就是llm连续调用,调用到第10次,还能看到自己第一次调用时的reasoning(前提是agent发给它了)。
但是,对于跨轮次的人机对话,reasoning对LLM是不可见的。比如你跟agent聊,第一次让它在思考内容中设置一种水果名称,但回答正文(conteng)中不可以出现,等它回答完之后,到第二轮,你再问它,上次设置的水果名称是什么,它答不出来。即使agent把reasoning发回去了也没用。网关就把它过滤掉了。