AI 两小时全自动生成 3D 作品,开发者实测:动作生成仍是硬伤

随着近期大模型能力升级,AI 在 3D 图形领域的应用出现显著进展。据 V2EX 开发者社区分享,一位名为 @to6iDEV 的开发者使用 Opus 5.5 模型,在两个小时内全自动生成了一个可交互的 3D 网页作品,全程无需人工干预,作品已部署上线可公开访问。另一位具备 3D 建模背景的创作者则借助 AI 编程能力产出了视觉效果更精细的作品,其建模依托自身专业能力,AI 主要承担编程工作。发帖者本人正在开发一款数字人玩具项目,其实测经验揭示了当前 AI 3D 生成能力的边界:大模型只能生成较为简单的 3D 场景,不具备建模能力的用户需要依赖开源资源库搭建 3D 世界。其中难度最高的环节是人偶动作生成,AI 目前完全无法胜任,即便是腾讯推出的 HY-Motion-1.0 模型,生成的动作效果也达不到可用标准。在数字人项目的实现路径上,发帖者使用 Opus 5.5 创建了数字人 Jev,计划接入 GPT 实时语音能力驱动数字人实现实时交互与反馈;考虑到成本因素,当前测试阶段采用价格更低的 DeepSeek 模型作为驱动引擎。这一案例反映了个人开发者在 AI 辅助 3D 创作与数字人方向的最新探索,也直观呈现了大模型在场景代码生成与动作动画生成之间的能力落差。

事件分析

从技术层面看,这批案例表明前沿大模型的代码生成能力已能覆盖 Three.js 等 WebGL 3D 开发框架,前端 3D 场景搭建门槛被大幅拉低,独立开发者数小时内即可完成过去需要团队协作的项目。但生成链条存在明显断层:几何与场景组装可交给 AI,骨骼绑定、蒙皮与动画等传统美术管线环节仍是盲区,腾讯 HY-Motion-1.0 等动作生成模型的输出质量距生产可用尚有距离。产业层面,3D 内容生产或将分化为’AI 负责编程与场景拼接、人类负责美术资产与动画’的混合协作管线。后续值得关注的方向包括动作生成模型的实用性突破,以及低成本实时语音驱动的交互式数字人能否成为新应用形态,以 DeepSeek 替代高价模型的做法也体现了成本敏感型产品路径的典型取舍。

核心观点:大模型让 3D 开发门槛骤降,但动作生成暴露了 AIGC 从’能写代码’到’能做内容’的关键鸿沟。

原文链接:V2EX 分享发现

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›

抢沙发

评论前必须登录!

立即登录   注册