Linux.do论坛用户实测Black Forest Labs的图像生成模型Flux 3,发现其在绘制Grok机器人图标时表现不佳。测试者使用韩语极简版提示词进行生成,虽大致能执行指令但效果欠佳,推测可能是提示词过于简单,或模型对不同语言的理解存在差异。此外,该用户此前分享的优化版中文提示词被平台以含敏感词为由拦截,提示词审核机制的误判问题引发讨论。Flux曾是Stable Diffusion陷入发展瓶颈后图像生成领域的救星,一度被视为新星战神。但随着OpenAI等巨头凭借资本与技术优势快速推进多模态图像生成能力,Flux的市场地位受到明显冲击,目前只能与国产模型共同争夺开源战场。文中还分享了Flux官方精确编辑工具(flux-tools.bfl.ai/precise-editing)的使用方法:上传任意一张图片后,指示模型忽略当前图片内容并绘制新图像,还可指定生成比例,模型将直接生成全新图片,原图内容不影响结果。不过该工具生成速度极慢,单张图片约需2分钟才能完成,实用性受到一定限制。
事件分析
核心观点:闭源巨头的资本碾压之下,专业图像模型唯有退守开源生态,才能在AI绘图竞赛中保留生存空间。
原文链接:Linux.do

评论前必须登录!
立即登录 注册