昊梵体育网

学会这个知识点,帮你节省海量token。 使用codex时,上下文内容会进入缓存,使得AI能够快速调取之前对话中有用的信息,从而比较省token。如果你在使用过程中,切换推理级别(低中高),或切换模型(sol、terra、tuna),codex将无法加载缓存,导致必须重新读上下文,token消耗会突然大幅增高。短对话不 ​

学会这个知识点,帮你节省海量token。使用codex时,上下文内容会进入缓存,使得AI能够快速调取之前对话中有用的信息,从而比较省token。如果你在使用过程中,切换推理级别(低中高),或切换模型(sol、terra、tuna),codex将无法加载缓存,导致必须重新读上下文,token消耗会突然大幅增高。短对话不明显,长对话影响很大。所以,如果你不想token很快耗光,尽量不要切来切去吧!2026 年 7 月,有人专门测试了 GPT 5.6 Luna:Low 状态下缓存命中约 93%,第一次切换到 Medium 后下降到约 66%;Medium 稳定后又恢复到约 93%。后来第一次切换到 xHigh,又从约 98% 降到约 65%,下一轮则重新恢复到约 98%。更有意思的是,切回此前已经使用过的 reasoning level,并没有再次发生严重 cache miss。