GPT-5.6-Luna为何返回502

这不是代理进程挂了,而是 Freebuff 账号的免费会话权限不允许打开 Luna,却仍把它列在了模型列表中。

✓ 已核实 来源 Reproduced in the iyu Freebuff2API Workers deployment; the limitation is account-specific upstream free-session policy, not a general statement about GPT-5.6-Luna availability ⚑ AI基础设施

60 秒版本

这次 502 来自上游免费会话权限不匹配,不是代理进程宕机。

要点

  • 已测试账号的受限免费通道只允许 DeepSeek V4 Flash 和 MiMo 2.5。
  • GPT-5.6-Luna 虽在列表中,却在创建上游会话时被拒绝。
  • 静默降级会隐藏路由错误并改变调用结果。
  • 可靠网关应公开经过真实测试的能力,并对不支持模型返回明确错误。

结论. 当前账号应使用 DeepSeek V4 Flash 或 MiMo 2.5;Luna 需要更高权限或其他供应商。

先说结论代理没挂,是会话没权限

HTTP 502 的直接原因,是上游拒绝为 GPT-5.6-Luna 创建免费会话。同一个账号调用 DeepSeek V4 Flash 正常,上游明确列出的受限免费模型是 DeepSeek V4 Flash 和 MiMo 2.5。

2受限免费账号允许的模型
1失败模型:GPT-5.6-Luna
400更准确的“不支持模型”错误码

问题在哪里模型列表不是权限检查

网关的 /v1/models 返回 Luna,只能说明代理认识这个模型名和路由配置,不能证明当前账号可以创建对应的上游会话。真正的拒绝发生在会话创建阶段。

模型发现网关认识这个模型标识。
会话授权上游账号允许为它创建会话。
推理执行会话可以完成聊天请求。
这次失败的位置Luna 能被发现,但会话授权被拒绝。

为什么不能静默降级答案能返回,不代表请求正确

把 Luna 请求悄悄改成 DeepSeek,可能暂时得到回答,却改变了调用方指定的模型,输出特征、延迟和成本记录也可能不同。网关应当服务原模型,或者明确说明它不可用。

实际修复只公开经过验证的能力

  • 1. 用真实会话和聊天路径测试每个公开模型。
  • 2. 从 /v1/models 移除当前账号不支持的模型。
  • 3. 对显式请求的未支持模型返回清晰的 400 错误。
  • 4. 保持 session、agent 和 upstream model 三层映射一致,并清理过期缓存。
能力列表是一份契约:网关公开了模型,调用方就会期待下一步真的能用。