一位技术爱好者在 Linux.do 社区分享了对当前主流大模型“深度搜索”功能的对比评测。该用户近期订阅了 Gemini Ultra 服务,并针对 OpenAI 的 GPT-4.5 Pro 和 Anthropic 的 Claude Opus 模型进行了横向测评。实测结果显示,谷歌 Gemini Ultra 自带的 DeepResearch 功能表现令人失望,被用户评价为“太拉了”,反而是其 DeepThink 功能的体验优于 DeepResearch。相比之下,Claude 的 DeepResearch 功能虽然全面领先于 Gemini,但在处理某些特定任务时仍存在瑕疵;用户在体感上认为 Claude Opus 4.6 版本的 DeepResearch 表现优于 4.7 版本。鉴于 Gemini Ultra 的实际产出未达预期,该用户正在考虑转而购买 ChatGPT Pro 以满足深度研究需求。这一反馈反映了当前顶级 AI 模型在长链路任务规划和执行能力上的显著差异。
事件分析
💡 核心观点:AI 智能体的竞争焦点已由模型参数转向长任务完成度,谷歌在工程落地上的短板使其在深度搜索赛道暂时落后。
原文链接:Linux.do

评论前必须登录!
立即登录 注册