开发者反馈:DeepSeek V4 0813 的 Max 思考模式存在质量问题

近日,有开发者在技术社区反馈,DeepSeek 在 2024 年 8 月 13 日发布的 V4 版本中,其名为“Max 思考”的推理模式存在明显的质量下滑和部署异常。根据实际测试对比,在完全相同的 Prompt 输入下,Max 思考模式不仅思考时长显著短于默认的 High 模式,其输出的逻辑质量也被评价为“智商更低”且缺乏拟人化特征。测试者指出,High 模式的表现延续了此前“4f”版本的后训练风格,思考过程长达 600 秒起步,逻辑严密;而 Max 思考模式的表现却极不稳定,甚至被推测可能由于路由配置错误,导致请求被错误导向了更早期的版本(如 V3.2 ),而非最新的 V4 模型。这一现象引发了对于 DeepSeek 推理服务部署稳定性的质疑,特别是针对不同推理等级之间的负载均衡和模型调用链路是否存在管理疏漏的讨论。

事件分析

技术架构角度看,此次争议的核心在于多模型路由机制与版本管理的稳定性。DeepSeek 提供的 Max 模式旨在提供更强的推理能力,而反馈显示该模式可能在服务端出现了权重版本混乱,导致高优先级的请求被意外调度至旧版模型。这反映了在模型快速迭代(如 V4 推出)的过程中,运维侧的流量治理与负载均衡策略可能存在滞后。对于产业而言,大模型的商业落地不仅依赖基座模型的智商,更高度依赖推理服务的稳定性与一致性。此类回退现象若不解决,将直接影响依赖 API 进行复杂任务开发的用户信任。预计官方需紧急排查推理链路中的配置文件,确认模型加载逻辑是否匹配预期的版本标签。

核心观点:大模型竞争进入下半场,推理链路的稳定性与版本管理的精细化已成为决定用户体验的关键基础设施指标。

原文链接:Linux.do

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›

抢沙发

评论前必须登录!

立即登录   注册