近日,科技社区 Linux.do 上出现了一项关于 OpenAI Codex 模型性能表现的调查,主题围绕“降智”现象展开。部分开发者反映,在使用集成 Codex 的开发环境(非网页版 ChatGPT)时,模型的响应质量似乎出现了下降,表现为拒绝回答简单问题或基础推理能力受限。为了科学验证这一主观感受并探究其背后的原因,社区成员发起了一项具体的测试投票。测试设计了一个包含四个特定问题的 Prompt,要求模型在禁止联网、禁止调用外部工具的情况下,仅凭内部知识回答关于模型自身标识、2025年底特定国家领导人姓名以及 Python 未来版本号的问题。设计逻辑在于,正常模型应在面对无法确认的未来信息时保持不确定性,而“降智”模型则可能在基础知识层面表现异常或过度触发安全审查机制。该调查的核心目的在于统计所谓的“降智”现象是否与账号所在区域有关,即对比美区账号与低价区账号在模型表现上的差异,旨在为开发者在后续充值订阅时提供参考依据。
事件分析
核心观点:所谓“降智”疑云背后,实则是开发者对 API 服务一致性及厂商可能存在的区域性分层策略的焦虑与验证。
原文链接:Linux.do

评论前必须登录!
立即登录 注册