Sol 的朋友们,大家好!我已为所有 ChatGPT Work 和 Codex 用户重置了用量限额。与此同时,快速更新一下 GPT-5.6 Sol 的用量限额情况。
过去几周,很多人告诉我们 Sol 消耗 Codex 限额的速度比预期更快。需要说明的是,我们并未降低任何订阅套餐的用量。
我们一直在深入排查发生了什么,并落地了多项改进。因此,我们预计在典型使用 Sol 的情况下,你的用量大约能多用 18%。从今天起,部分用户应该已经能看到明显更大的改善。明天,我们还会恢复在调查期间暂时暂停的五小时限额。
我们发现了这些情况:
- GPT-5.6 Sol 更愿意工作更长时间、发起额外的工具调用,并跨工具和子智能体协调复杂工作流。这让它更擅长解决难题,但有些任务消耗的用量远超我们的预期。
- 在相同推理力度下,Sol 也比以往模型更卖力。Sol 上的 High 可能比 GPT-5.5 上的 High 使用更多 token。
- 程序化工具调用(也称为 code mode)让 Sol 能更灵活地并行运行工具调用,或在等待时继续工作。但这也会导致每轮更多回复、更多缓存输入 token,以及高于预期的用量。
- 当 Sol 在等待工具调用完成或执行大量网页搜索时,这一点尤其明显。我们已改进了对这两种情况的处理,并在继续提升 code mode 的效率。
- 影响也很不均匀。中位数用户其实觉得 Sol 相当节省 token,而一些处理更难任务的重度用户则发现用量消耗快得多。上线前我们非常关注平均和中位数用量,却漏掉了长尾可能显著多用用量的一些情况。
Sol 是 Codex 能力的一次显著进步,但能力与效率并不总是同步提升,有些问题只有在人们以真实规模使用模型后才会显现。我们本该更早认识到这一点,并更坦诚地说明。
你们继续推动前沿,我们会持续提升效率,并随时分享更新。