GPT-5.2评测:失望之作,DeepSeek崛起

作者在Linux.do论坛分享了对GPT-5.2的失望评测,认为它是GPT-5系列中最失败的版本。SimpleQA成绩显示其表现极差,甚至不如o3和o1模型。GPT-5.2在回答L站问题时出错,参数未增加但价格上涨40%。相比之下,DeepSeek用2000张H800算力成功构建670B参数模型,被视为行业奇迹。作者还提出了三大厂参数分档:Gemini 3 Pro领先,GPT 4.5次之,Gemini 2.5第三。文章强调AI作为全能助手的重要性,包括Agent能力,反映了当前AI模型的竞争格局和用户需求。

原文链接:Linux.do

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›

抢沙发

评论前必须登录!

立即登录   注册