主 题:Codex真是差劲,我哪条提示词告诉你用Astra审查三次的?
发 布 者:缓慢前进
标签分类: 日常
时 间:2026-10-11 22:13:17
内容预览:这OpenAI和Tibo是不是脑子里都是屎?AGENT.md明确界定了子智能体“Astra”只能用于界定架构和边界,执行由Luna负责,Sol负责调度/Dev/Test。结果对话的时候,本机Windows测试一次,Linux独立环境\WSL2上测试一次,服务器新开临时目录测试一次,Docker容器内再测试一次。每次测试Luna作为执行端都会向Astra交付大量上下文,然后又给Sol甩给长上下文修改,Sol又给Luna交付,一次循环将近消耗5H限额的百分之三十上下。如果说生产环境确实需要大规模测试,尚且可以理解。那能不能告诉我为什么一个极为简单的后端接口要疯魔一样的分别用业务平均并发、低并发、和瞬时极高并发测试好几轮?最后开始扩展到接口的稳定性又对接口进行了一大通修改,随后再次运行这种恐怖的无限制测试,完全忘记开发原目标只不过是用Py调用一个Rust写的下载器而已。上个厕所回来仅仅十分钟不到,5H限额直接被打穿,连负责部署的Luna都无法使用。别玩你那弱智28天挑战了,重置再多次也无法改变模型本身在实际开发过程中的低能表现,这种夸张到人类完全无法理解的测试我只在OpenAI这里见过。
直达链接: https://www.nodeseek.com/post-977156-1
 
 
Back to Top