主 题:Sol High 明确没被路由到 Luna,为什么还是连续过不了糖果题?
发 布 者:xushuo
标签分类: 技术
时 间:2026-09-18 14:31:49
内容预览:我这边最近在排查 Codex / CPA 的模型路由问题,之前已经抓到过不少 gpt-6-astra -%26gt%3b gpt-5.6-luna 的情况,所以这次专门拿 Sol High 做了对照。我现在不是只看 CPA / Keeper 里的请求模型,而是额外解析上游原始 Responses SSE,读取终止事件里的 response.completed.response.model。这次两笔测试的结果是:请求:gpt-5.6-solreasoning:high最终上游 response.completed.response.model:gpt-5.6-sol两次都没有变成 Luna两次请求都正常成功完成具体两笔:input 约 24,615 tokens,reasoning 约 1,015 tokensinput 约 19,076 tokens,reasoning 约 856 tokens上下文已经比之前 20 万 token 那种情况干净很多,但固定的糖果题两次还是都没过。这个题正确答案是 21。所以现在有点疑惑:请求 Sol High -%26gt%3b CPA 发 Sol -%26gt%3b 上游最终 response.model 仍是 Sol -%26gt%3b 但糖果题连续失败这和之前 Astra 直接被路由到 Luna 不一样,这次模型字段看起来完全正常。想问问大家最近有没有测过 Sol High:正常状态下 Sol High 现在糖果题通过率大概怎么样?有没有出现终态明确是 Sol,但能力明显比之前差的情况?response.completed.response.model 只能证明模型名,是否可能还有服务端的其他质量档位 / 推理策略 / fallback 不会体现在 model 字段里?还是说这个糖果题现在本身就不适合当单次判断依据,Sol High 连错两次也可能只是正常波动?19k~25k input
直达链接: https://www.nodeseek.com/post-935284-1
发 布 者:xushuo
标签分类: 技术
时 间:2026-09-18 14:31:49
内容预览:我这边最近在排查 Codex / CPA 的模型路由问题,之前已经抓到过不少 gpt-6-astra -%26gt%3b gpt-5.6-luna 的情况,所以这次专门拿 Sol High 做了对照。我现在不是只看 CPA / Keeper 里的请求模型,而是额外解析上游原始 Responses SSE,读取终止事件里的 response.completed.response.model。这次两笔测试的结果是:请求:gpt-5.6-solreasoning:high最终上游 response.completed.response.model:gpt-5.6-sol两次都没有变成 Luna两次请求都正常成功完成具体两笔:input 约 24,615 tokens,reasoning 约 1,015 tokensinput 约 19,076 tokens,reasoning 约 856 tokens上下文已经比之前 20 万 token 那种情况干净很多,但固定的糖果题两次还是都没过。这个题正确答案是 21。所以现在有点疑惑:请求 Sol High -%26gt%3b CPA 发 Sol -%26gt%3b 上游最终 response.model 仍是 Sol -%26gt%3b 但糖果题连续失败这和之前 Astra 直接被路由到 Luna 不一样,这次模型字段看起来完全正常。想问问大家最近有没有测过 Sol High:正常状态下 Sol High 现在糖果题通过率大概怎么样?有没有出现终态明确是 Sol,但能力明显比之前差的情况?response.completed.response.model 只能证明模型名,是否可能还有服务端的其他质量档位 / 推理策略 / fallback 不会体现在 model 字段里?还是说这个糖果题现在本身就不适合当单次判断依据,Sol High 连错两次也可能只是正常波动?19k~25k input
直达链接: https://www.nodeseek.com/post-935284-1