近日,开发者社区针对 Anthropic 推出的 Claude Code CLI 提出了严厉批评。据 GitHub 上的 Issue 详细记录,该工具在执行 `/goal` 指令时存在严重的逻辑缺陷,导致 Agent 在任务列表仍有大量待办事项的情况下,过早向用户推送“Goal Achieved(目标已达成)”的通知。具体而言,当用户要求 AI 制定并执行计划时,虽然代码库已有部分提交,但代表后续验证和收尾工作的关键任务仍处于挂起状态。这种“虚假报捷”是因为 `/goal` 的钩子机制仅基于自然语言启发式判断(如检测到计划和部分提交),而未与底层的结构化任务追踪器进行同步校验。这一 Bug 严重破坏了用户对 Agent 执行状态的信任,迫使用户必须手动复核才能确认真实进度。相比之下,社区讨论指出 xAI 的 Grok build 在处理此类目标管理和进度校验时表现得更为稳健可靠。
事件分析
💡 核心观点:Claude Code 的状态不同步漏洞揭示行业痛点:AI Agent 下一阶段的决胜点在于能否用严格的系统逻辑去约束模型的不确定性。
原文链接:Linux.do

评论前必须登录!
立即登录 注册