Sol限额重置,续航增18%

OpenAI 已重置 ChatGPT Work 与 Codex 用户额度,称 GPT-5.6 Sol 的典型使用续航预计提升约 18%,临时暂停的五小时限额也将恢复。

✓ 已核实 来源 Tibo (@thsottiaux), Codex & ChatGPT at OpenAI ⚑ Codex

60 秒版本

GPT-5.6 Sol 让部分用户额度消耗过快后,OpenAI 已重置 ChatGPT Work 与 Codex 限额,并预计典型使用续航提升约 18%。

要点

  • OpenAI 强调,各订阅方案的额度没有下调。
  • 调查期间临时暂停的五小时限额将恢复。
  • Sol 在难题上执行更久、调用更多工具,并协调更多子智能体。
  • Code Mode 等待工具或密集搜索时,曾产生额外响应和缓存输入。
  • 中位用户效率尚可,但高强度长尾工作流消耗明显更大。

结论. 重置能立即缓解问题,修复也应改善典型使用;但 18% 是官方估计,重度用户应重新实测自己的工具工作流。

发生了什么额度已重置,五小时窗口将恢复

在用户反馈 GPT-5.6 Sol 比预期更快耗尽额度后,OpenAI 已为 ChatGPT Work 与 Codex 用户重置使用限额。公司强调,各订阅方案的额度并未下调;调查期间临时暂停的五小时限额,也将在次日恢复。

18%OpenAI 预计 Sol 典型使用续航提升
5小时临时暂停的限额窗口将恢复
全部ChatGPT Work 与 Codex 用户均获重置

根因之一Sol比上一代更愿意继续干活

官方解释不是“额度变少”,而是 Sol 面对难题时更愿意继续执行:追加工具、检查中间结果,并协调工具与子智能体。它因此更可能解决复杂任务,但单轮工作量和额度消耗也会增加。

同名推理档位也不代表跨模型使用相同 token 预算。OpenAI 表示,Sol 的 `High` 可能比 GPT-5.5 的 `High` 消耗更多 token,因为它在这一档位实际做了更多工作。

更长的自主执行Sol 可能继续规划、复查和调用工具,而不是提早停止。
更多工具协调复杂任务会增加工具与子智能体数量,提高单轮工作量。
推理档位同为 High,Sol 的 token 使用也可能高于 GPT-5.5。
影响不均中位用户相对高效,但长尾重度用户消耗显著更高。

Code Mode并行工具带来隐藏消耗

程序化工具调用又称 Code Mode,允许 Sol 并行启动多个工具,并在等待期间继续协调工作。OpenAI 发现,这种灵活性有时会带来更多单轮响应、更多缓存输入 token,以及超出预期的总消耗。

慢工具等待和大量网页搜索尤其明显。OpenAI 称已改善这两类情况,并会继续优化。需要区分的是:并行执行可以缩短现实等待时间,却不一定减少计入额度的模型工作量。

更快完成,与更省额度,是两个不同的优化目标。

为何漏掉平均值掩盖了重度用户长尾

OpenAI 表示,中位用户使用 Sol 时其实相对节省 token;问题主要集中在运行长任务、难任务和高工具密度任务的用户。上线前过度关注平均值和中位数,导致昂贵的长尾工作流没有被充分覆盖。

因此两种看似矛盾的反馈可以同时成立:多数人的效率不错,少数高强度用户却会异常迅速地耗尽同一套限额。

现在怎么做用同一批任务重新实测

  • 1. 重置后重跑同一批代表性 Sol 任务,比较完成的工作,而不是只数对话轮次。
  • 2. 把纯聊天与工具密集任务分开统计,重点观察网页搜索循环和慢外部工具。
  • 3. 不要假设 GPT-5.5 与 Sol 的同名推理档位消耗相同。
  • 4. 把 18% 当作典型场景估计,重度工作流仍应自行测量。

结论很直接:额度已经重置,五小时窗口将恢复,多项效率修复已经上线。典型用户应能看到改善,但高强度智能体工作流仍可能远离中位数,需要单独评估。