GPT-5.6-Luna为何返回502
这不是代理进程挂了,而是 Freebuff 账号的免费会话权限不允许打开 Luna,却仍把它列在了模型列表中。
✓ 已核实
来源
Reproduced in the iyu Freebuff2API Workers deployment; the limitation is account-specific upstream free-session policy, not a general statement about GPT-5.6-Luna availability
⚑ AI基础设施
60 秒版本
这次 502 来自上游免费会话权限不匹配,不是代理进程宕机。
要点
- 已测试账号的受限免费通道只允许 DeepSeek V4 Flash 和 MiMo 2.5。
- GPT-5.6-Luna 虽在列表中,却在创建上游会话时被拒绝。
- 静默降级会隐藏路由错误并改变调用结果。
- 可靠网关应公开经过真实测试的能力,并对不支持模型返回明确错误。
结论. 当前账号应使用 DeepSeek V4 Flash 或 MiMo 2.5;Luna 需要更高权限或其他供应商。
先说结论代理没挂,是会话没权限
HTTP 502 的直接原因,是上游拒绝为 GPT-5.6-Luna 创建免费会话。同一个账号调用 DeepSeek V4 Flash 正常,上游明确列出的受限免费模型是 DeepSeek V4 Flash 和 MiMo 2.5。
2受限免费账号允许的模型
1失败模型:GPT-5.6-Luna
400更准确的“不支持模型”错误码
问题在哪里模型列表不是权限检查
网关的 /v1/models 返回 Luna,只能说明代理认识这个模型名和路由配置,不能证明当前账号可以创建对应的上游会话。真正的拒绝发生在会话创建阶段。
| 模型发现 | 网关认识这个模型标识。 |
|---|---|
| 会话授权 | 上游账号允许为它创建会话。 |
| 推理执行 | 会话可以完成聊天请求。 |
| 这次失败的位置 | Luna 能被发现,但会话授权被拒绝。 |
为什么不能静默降级答案能返回,不代表请求正确
把 Luna 请求悄悄改成 DeepSeek,可能暂时得到回答,却改变了调用方指定的模型,输出特征、延迟和成本记录也可能不同。网关应当服务原模型,或者明确说明它不可用。
实际修复只公开经过验证的能力
- 1. 用真实会话和聊天路径测试每个公开模型。
- 2. 从 /v1/models 移除当前账号不支持的模型。
- 3. 对显式请求的未支持模型返回清晰的 400 错误。
- 4. 保持 session、agent 和 upstream model 三层映射一致,并清理过期缓存。
能力列表是一份契约:网关公开了模型,调用方就会期待下一步真的能用。