主 题:昨天 Astra 一直 capacity,今天不报了但疑似降智,还会偶尔路由到 Luna,有人遇到吗?
发 布 者:xushuo
标签分类: 技术
时 间:2026-09-18 12:44:41
内容预览:记录一下我这两天在 Codex / CPA 上遇到的情况,想看看是不是普遍现象。昨天(9 月 17 日)GPT-6 Astra 这边反复出现 capacity / overload,日志里能看到类似 server_is_overloaded,有一段时间基本很难正常用。今天(9 月 18 日)capacity 突然基本不报了,但体感变成了另一种问题:能正常返回 200、请求也能完成,可是能力明显感觉不对,尤其是一些之前用来测推理能力的固定题和日常任务,像是“能用了,但变笨了”。一开始我怀疑是 CPA 自己串模,所以后来给 CPA 加了一个旁路审计:不看 Keeper 里的请求侧 model/model_alias,而是解析上游原始 SSE,专门记录终止事件 response.completed.response.model,逻辑参考了 Sub2API 的做法。结果确实抓到了比较明确的现象:客户端请求 gpt-6-astra;CPA 实际发给上游的也确实是 gpt-6-astra;但部分请求在最终 response.completed 里,上游自己声明的模型变成了 gpt-5.6-luna;同一时间也有另外一些 Astra 请求最终仍然返回 gpt-6-astra。也就是说至少我这里不是简单的“CPA 把 Astra 改成 Luna”,而是存在这种链路:请求 Astra -%26gt%3b CPA 发 Astra -%26gt%3b 上游最终 response.model = Luna而且这个现象不是固定绑定某一个账号:同一个账号有时能拿到真 Astra,过一会又连续出现 Astra -%26gt%3b Luna;另一个账号某一段时间连续多次都是 Astra -%26gt%3b Astra。看起来更像动态路由/服务端状态差异。更奇怪的是,即使旁路抓到最终 response.model 仍然是 Astra,我这边用固定糖果题和日常任务
直达链接: https://www.nodeseek.com/post-935117-1
 
 
Back to Top