一位长期使用者针对 Claude、ChatGPT 和 DeepSeek 三款主流大模型进行了“性格”画像总结,并将评价反馈给各模型进行实测。观察指出,Claude 表现出中性、谨慎及高道德感,对代码结构极度敏感,甚至在生成代码时表现出过度完善的倾向;ChatGPT 被描述为圆滑世故,善于提供情绪价值,这与其过往版本存在的“过度奉承”问题有关;DeepSeek 则被形容为执行力极强的“莽撞小伙”,不挑脏活累活,响应直接。针对这些评价,Claude 承认了 Constitutional AI 训练路线带来的谨慎特质,并指出 DeepSeek 的“大力”实则源于高效率的工程优化;ChatGPT 解释此类“性格”差异源于 RLHF 目标、数据分布及 System Prompt 的不同;DeepSeek 则幽默地接受了“大力出奇迹”的评价。此次测试揭示了不同厂商在安全策略、训练偏好上的根本差异。
事件分析
💡 核心观点:大模型的“性格”差异实为RLHF目标与安全策略的具象化,开发者应依据任务属性(严谨重构或快速执行)选择匹配的AI协作范式。
原文链接:V2EX 分享发现

评论前必须登录!
立即登录 注册