Flux 3实测遇挫:昔日AI绘图战神退守开源求生

Linux.do论坛用户实测Black Forest Labs的图像生成模型Flux 3,发现其在绘制Grok机器人图标时表现不佳。测试者使用韩语极简版提示词进行生成,虽大致能执行指令但效果欠佳,推测可能是提示词过于简单,或模型对不同语言的理解存在差异。此外,该用户此前分享的优化版中文提示词被平台以含敏感词为由拦截,提示词审核机制的误判问题引发讨论。Flux曾是Stable Diffusion陷入发展瓶颈后图像生成领域的救星,一度被视为新星战神。但随着OpenAI等巨头凭借资本与技术优势快速推进多模态图像生成能力,Flux的市场地位受到明显冲击,目前只能与国产模型共同争夺开源战场。文中还分享了Flux官方精确编辑工具(flux-tools.bfl.ai/precise-editing)的使用方法:上传任意一张图片后,指示模型忽略当前图片内容并绘制新图像,还可指定生成比例,模型将直接生成全新图片,原图内容不影响结果。不过该工具生成速度极慢,单张图片约需2分钟才能完成,实用性受到一定限制。

事件分析

此次实测暴露出图像生成模型的两个现实问题:一是多语言提示词理解能力不均衡,小语种与中文的指令遵循效果仍有明显差距;二是内容审核过度拦截,正常的中文创作提示词被误判为敏感内容,直接影响创作体验。产业层面,Black Forest Labs的处境折射出图像生成赛道的格局剧变,OpenAI等巨头凭借原生多模态能力实现碾压,专业图像模型的先发优势快速消退,转向开源生态、与国产模型同场竞技,正成为其维系影响力的现实路径。后续值得关注Flux 3正式版在提示词遵循与多语言支持上的改进,以及官方编辑工具的生成速度能否优化至可用水准。

核心观点:闭源巨头的资本碾压之下,专业图像模型唯有退守开源生态,才能在AI绘图竞赛中保留生存空间。

原文链接:Linux.do

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›

抢沙发

评论前必须登录!

立即登录   注册