商汤科技近日更新了其SenseNova U系列视觉模型至U1.5版本,并已在GitHub平台开放相关模型权重。此次更新标志着国产大模型在图像生成与编辑领域的进一步突破。新版本最大的亮点在于实现了原生4K高分辨率图像的生成能力,不同于传统依赖拼接或放大的方式,U1.5在原生架构下直接输出高画质图像,确保了细节的丰富性与整体的连贯性。针对此前AI生图普遍存在的“弱项”,该模型重点优化了复杂信息排版与文字还原度,显著提升了在信息图表等场景下的表现。此外,SenseNova U1.5将图像编辑能力升级为原生特性,支持全局风格迁移和局部排版重构,无需依赖复杂的提示词工程或额外的ControlNet插件即可实现精准修改。根据官方公布的Benchmark数据,该模型在图像编辑任务上的得分为4.37,已达到与NanoBanana2相同的水平线。这一发布为开发者提供了强大的开源工具,有望推动AIGC在设计、办公等对高精度图像编辑有强需求的场景中加速落地。
事件分析
💡 核心观点:商汤U1.5通过原生架构整合生成与编辑能力,以开源策略打破高分辨率生图壁垒,加速AI设计工具的落地。
原文链接:Linux.do

评论前必须登录!
立即登录 注册