主 题:Grok 4.5 流口水,可能真不是马斯克给降智了
发 布 者:Portainer
标签分类: 日常
时 间:2026-07-30 21:33:55
内容预览:先说结论:我感觉 Grok 4.5 在 OpenCode 里表现得很懒,主要问题可能不在模型,而在 Agent 自带的提示词和工具调用逻辑。我的测试环境没变,都是自建 Free 账号池,通过 Grok2API 导出 Grok 4.5,只是分别接到了 OpenCode 和 Hermes 上。先说 OpenCode。刚开始用的时候,我一度以为 Grok 4.5 被严重降智了。不是完全不调用工具,强行要求之后也会动,但整体非常被动。经常是这种回复:你运行一下 XX,看看是否正常。你执行这条命令,同时观察日志。把终端输出复制给我,我再继续分析。问题是,这些事情它明明可以自己做。我已经明确告诉它可以直接操作终端,也要求它自己排查,但它还是习惯把命令发给我,让我执行,再把结果贴回去。整个体验很像在网页端问答,不像一个能自己干活的编程 Agent。后来我把同一个 Grok 4.5 换到了 Hermes。差别非常明显。我只说了一句:Debug,直到项目跑通。然后它就开始自己读代码、跑命令、看日志、改代码、重新测试。报一个错就修一个,修完继续跑,基本不需要我在中间帮它执行命令。实际用下来,主动程度和我之前用已登录 Codex 的 GPT-5.6 差不多。所以我现在比较倾向于认为,所谓 Grok 4.5 “流口水”或者“很懒”,不一定是模型本身的问题。Agent 怎么写系统提示词、怎么描述工具、允不允许模型连续执行任务,影响可能比想象中更大。至少在我的环境里:OpenCode 下的 Grok 4.5 很被动,换到 Hermes 后马上正常。大家如果也是用 Free 号池接 Grok 4.5,遇到流口水了可以换 Hermes 试试。
直达链接: https://www.nodeseek.com/post-849348-1
 
 
Back to Top