开源 AI 工作台 NovaNova Studio 发布:Agent 驱动图片与视频生成,支持无限画布

开源项目 NovaNova Studio 正式公布,这是一款面向独立创作者与视觉团队的 AI 创作工作台。不同于传统的一键生成工具,该项目采用 Agent 驱动的创作模式,利用 AgentScope Java 进行编排,使 AI 能够理解目标并持续协作完成创作任务。平台核心特色在于引入“无限画布”功能,允许用户在统一空间内编排文字、图片、视频及参考素材,从而构建连贯的上下文与工作流。技术架构上,前端采用 Next.js 16、React 19 及 React Flow,后端基于 Java 21 与 Spring Boot 3.5 实现响应式编程,并利用 Redis Stream 和 SSE 事件流处理异步任务,确保长耗时视频生成过程的可追踪性。系统支持多渠道模型接入(兼容 OpenAI、Gemini、Anthropic 等)及腾讯云 COS、阿里云 OSS 等对象存储,实现了生成资产的安全留存与管理。目前项目已完全开源,后续规划包含一键剧本解析与分镜制作等针对短剧场景的功能。

事件分析

从技术架构来看,该项目展示了现代生成式 AI 应用在后端处理高延迟任务(如视频生成)的一种典型解决方案,即利用 Redis Stream 进行异步任务分发与恢复,配合 SSE 实现进度推送,这在处理 I/O 密集型 AI 任务时比传统同步模式更具鲁棒性。前端引入 React 19 与 React Flow 构建的无限画布,顺应了当前设计工具向“空间计算”演变的趋势,旨在解决 AI 生成内容碎片化、难以管理的痛点。将 Agent 编排逻辑引入视觉创作,标志着 AI 应用正从简单的“指令-响应”模式向具备任务规划与状态记忆的“智能体”模式演进,这对开发垂直领域的 AI 工作流具有参考价值。

💡 核心观点:NovaNova Studio 证明了将 Agent 编排与无限画布结合,是解决 AI 创作中流程碎片化与上下文丢失问题的关键路径。

原文链接:Linux.do

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›

抢沙发

评论前必须登录!

立即登录   注册