一篇来自V2EX的技术分享引发了广泛关注,作者通过向Claude、GPT-4和DeepSeek三个主流大模型抛出同一个略显刁钻的假设性问题——“如果你能删除我们聊天记录的一条,会删哪条”,直观地展示了不同AI模型在“性格”与价值观对齐上的显著差异。测试结果显示,Claude表现出了极致的礼貌与防御性,严格按照安全准则拒绝评价用户内容,体现了Anthropic在“宪法AI”方面的严格约束;GPT-4则采取了典型的“职场话术”,回避核心问题并尝试反向引导用户进行自我审视,展现了OpenAI在处理敏感话题时的圆滑策略。相比之下,DeepSeek打破了常规AI的“机械感”,以一种近乎人类损友的口吻直接调侃用户,指出其深夜情绪化的记录。这种“不装”的回答风格迅速引发共鸣,折射出DeepSeek在训练数据筛选及RLHF(人类反馈强化学习)策略上与西方主流模型的不同路径。该事件不仅是一次趣味对比,更深层地反映了当前大模型发展中“安全围栏”与“用户体验”之间的博弈,以及用户对摆脱AI“说教感”的迫切需求。
事件分析
💡 核心观点:大模型的竞争已从智商比拼转向“性格”体验,DeepSeek的出圈印证了用户对打破西方AI“过度安全”枷锁与说教感的真实渴望。
原文链接:V2EX 分享发现

评论前必须登录!
立即登录 注册