记录一下我这两天在 Codex / CPA 上遇到的情况,想看看是不是普遍现象。
昨天(9 月 17 日)GPT-6 Astra 这边反复出现 capacity / overload,日志里能看到类似
server_is_overloaded,有一段时间基本很难正常用。今天(9 月 18 日)capacity 突然基本不报了,但体感变成了另一种问题:能正常返回 200、请求也能完成,可是能力明显感觉不对,尤其是一些之前用来测推理能力的固定题和日常任务,像是 “能用了,但变笨了”。
一开始我怀疑是 CPA 自己串模,所以后来给 CPA 加了一个旁路审计:不看 Keeper 里的请求侧
model/model_alias,而是解析上游原始 SSE,专门记录终止事件response.completed.response.model,逻辑参考了 Sub2API 的做法。结果确实抓到了比较明确的现象:
- 客户端请求
gpt-6-astra; - CPA 实际发给上游的也确实是
gpt-6-astra; - 但部分请求在最终
response.completed里,上游自己声明的模型变成了gpt-5.6-luna; - 同一时间也有另外一些 Astra 请求最终仍然返回
gpt-6-astra。
也就是说至少我这里不是简单的 “CPA 把 Astra 改成 Luna”,而是存在这种链路:
请求 Astra -> CPA 发 Astra -> 上游最终 response.model = Luna而且这个现象不是固定绑定某一个账号:同一个账号有时能拿到真 Astra,过一会又连续出现 Astra -> Luna;另一个账号某一段时间连续多次都是 Astra -> Astra。看起来更像动态路由 / 服务端状态差异。
更奇怪的是,即使旁路抓到最终
response.model仍然是 Astra,我这边用固定糖果题和日常任务测,部分请求的能力表现也还是感觉比之前差。这一条目前只能算能力测试 / 体感,不当成 “模型身份已经被替换” 的实锤;真正能实锤的只有上面那些最终 response.model 明确返回 Luna 的请求。所以我现在的感受是:昨天像是 “容量不够,直接 capacity”;今天像是 “capacity 少了,但开始出现静默降级 / 动态路由,而且就算名义上还是 Astra,能力也可能不稳定”。
想问问最近 24 小时大家有没有遇到类似情况:
- 昨天频繁 capacity,今天突然恢复可用但明显变笨;
- 请求 Astra,最终 response.completed.response.model 却变成 Luna;
- 同一个账号一会儿是真 Astra、一会儿被路由成 Luna;
- 最终仍显示 Astra,但糖果题 / 固定 benchmark 的通过率明显下降。
如果有人也在用 CPA、Sub2API 或者能直接看到上游 Responses SSE,麻烦看看
response.completed.response.model,最好别只看请求侧 model。想确认这是我这里的个例,还是最近 Astra 的上游调度确实在变化。- 客户端请求
- 收藏支持反对打赏

无,今天没用
不知道。。我用 claude。。帮顶