近期,在开发者社区 Linux.do 上,有用户针对最新版本的 AI 模型(提及 gpt-5.6-sol-max,推测指代 OpenAI 最新发布的 o1 或相关预览模型)在辅助编程中的表现提出了强烈质疑。该开发者表示,在构建特定功能 Pipeline 的两个版本时,尽管在提示词中多次明确强调“不要动旧代码,仅修改新 Pipeline”的约束条件,但随着对话时间的延长和上下文的增加,模型依然频繁出现指令遵循失败的情况,开始错误地修改旧代码。这一现象引发了社区关于 AI 编程工具可靠性的讨论。虽然当前大模型在代码生成能力上进步显著,但在长时间对话和复杂任务处理中,模型似乎存在“指令遗忘”或“上下文漂移”的问题,导致无法忠实执行早期的否定性约束。这暴露了当前 AI 编程工具在实际工程落地中,依然难以完全脱离人工监督,提示词工程的稳定性仍受模型机制制约。
事件分析
核心观点:大模型在复杂开发场景下的长时记忆与指令稳定性仍存短板,AI编程目前仅能作为辅助手段,尚无法脱离人工审查。
原文链接:Linux.do

评论前必须登录!
立即登录 注册