随着大模型训练数据的日益紧缺,科技行业正面临从“提示词工程”向“演示工程”的技术范式转变。近期讨论指出,以 Meta 和 Anthropic 为代表的科技巨头,可能正在探索通过录制员工电脑屏幕或直接采集人类操作行为轨迹来训练下一代 AI 智能体。这种被称为“演示工程”的方法,旨在解决互联网文本数据枯竭的问题,转而通过观察人类与计算机的交互过程,让模型学会处理复杂的任务流程。
此前,Anthropic 发布了具备“计算机使用”能力的 Claude 3.5 Sonnet,能够通过观察屏幕界面执行操作,而社区讨论进一步推测,此类技术的极致进化可能涉及更深层的行为模式模仿,甚至引发关于直接利用生物神经元信号(如脑机接口)进行训练的科幻设想。这标志着 AI 训练重点正从单纯的语义理解向基于视觉和操作的具身智能演进。
事件分析
💡 核心观点:当互联网文本被“吃干抹净”,人类的屏幕操作与行为轨迹将成为训练 AI Agent 的最后一块拼图。
原文链接:Linux.do

评论前必须登录!
立即登录 注册