近日,有开发者在技术社区反馈,DeepSeek 在 2024 年 8 月 13 日发布的 V4 版本中,其名为“Max 思考”的推理模式存在明显的质量下滑和部署异常。根据实际测试对比,在完全相同的 Prompt 输入下,Max 思考模式不仅思考时长显著短于默认的 High 模式,其输出的逻辑质量也被评价为“智商更低”且缺乏拟人化特征。测试者指出,High 模式的表现延续了此前“4f”版本的后训练风格,思考过程长达 600 秒起步,逻辑严密;而 Max 思考模式的表现却极不稳定,甚至被推测可能由于路由配置错误,导致请求被错误导向了更早期的版本(如 V3.2 ),而非最新的 V4 模型。这一现象引发了对于 DeepSeek 推理服务部署稳定性的质疑,特别是针对不同推理等级之间的负载均衡和模型调用链路是否存在管理疏漏的讨论。
事件分析
核心观点:大模型竞争进入下半场,推理链路的稳定性与版本管理的精细化已成为决定用户体验的关键基础设施指标。
原文链接:Linux.do

评论前必须登录!
立即登录 注册