鱼羊 发自 凹非寺
赛博义父Tibo,真有求必应!
现在,3行配置就能让GPT-5.6 Sol封印解除,在Codex里用上1M上下文了。
model = “gpt-5.6-sol”
model_context_window = 1000000
model_auto_compact_token_limit = 900000

非常简单,在Codex的config.toml文件开头输入以上咒语,重启客户端、开启新会话就OK。一直到约90万token时,GPT-5.6 Sol才会开始自动压缩历史内容。
本来是API专属的功能,现在就这么水灵灵地开放给ChatGPT和Codex账号了。

Tibo推文一发,又双叒大爆特爆,看得出长上下文确实是不少朋友的刚需了。
不过,Tibo也友情提醒:长上下文虽好,可不要贪杯。
Codex默认的上下文长度能使其在性能和成本方面达到最佳状态。
祝大家玩得开心,但请知悉默认设置是我们精心调过的!
三行配置解除GPT-5.6 Sol封印
具体来看一下这三行设置。
第一个设置用于选择模型。
第二个设置让Codex使用1M上下文预算。
第三个设置是让模型留出一些安全余量,在大约90万token时启动自动历史记录压缩。
一定得注意的是,这三行设置需要放到config.toml文件开头,在所有[section]标题之前。
另外,Tibo还给出了不改默认设置,对单个CLI会话进行上下文窗口调整的方法:
codex -m gpt-5.6-sol -c model_context_window=1000000 -c model_auto_compact_token_limit=900000

不过其实吧,OpenAI官方文档里,GPT-5.6 Sol原本就支持1M上下文窗口。
只不过Codex默认不给你开满。
原因Tibo在模型刚上线时解释过,虽然更大的上下文窗口可以保留更多代码、工具输出和对话记录,但副作用也很明显:
我们注意到,在Codex里将GPT-5.6 Sol的上下文限制从272k提高到372k后,会导致实际使用量超出预期。
就更别说百万上下文了。
这个问题也在评论区被不少网友cue到了:这个百万上下文,轻易别用。
轻易别用
Tibo本着大家想要就给的态度,解除了Codex的封印。
不过立即有网友警告⚠️:你可千万别用。
理由是:一旦超出默认上下文窗口,Codex里模型消耗token的速度,会直接翻倍……

Tibo本人还给这个说法点赞了。

OpenAI研究员Noam Brown也再次安利了一下Codex的自动压缩。
OpenAI很早就意识到了自动压缩功能的重要性,并投入了大量研究精力,使这一体验近乎无缝。当然如果你有1M上下文的需求,可以选择Tibo给出的方法。

这其实也是Codex默认策略背后的逻辑:
Agent跑得越久,历史记录里真正需要原样保留的信息占比未必越高。与其把几十万甚至上百万token每一轮都重新带进模型,OpenAI更倾向于通过压缩把旧信息浓缩后继续运行。
并且token的超额消耗之外,还有另一个问题:支持1M上下文窗口,不代表模型在100万token下还能保持同样的上下文利用能力。
OpenAI自己公布的长上下文评测里,MRCR v2上,GPT-5.6 Sol处理256K—512K上下文时成绩为91.5%;来到512K—1M区间后,降到73.8%。
但甭管怎么说,至少这一次,OpenAI是把选择权交到了用户自己手里。
希望以后这样的吐槽能少一点吧——
为啥OpenAI总是习惯性隐藏这些每个人都迫切需要的功能啊?

One More Thing
刚发了打开Codex 1M上下文的钥匙,Tibo马不停蹄又来爆料了。
Codex确定会上Astra——
传说中的「GPT-6」,OpenAI下一代模型。






京公网安备 11011402013531号