独立开发者推出InkDoo:LLM当美术指导,整篇文章配图同一个角色

一位独立开发者在V2EX分享了自研工具InkDoo,用于为文章自动生成风格统一的手绘配图,解决AI生图“一张一个画风”导致图文割裂的痛点。该工具支持中英文文章(约12000字以内),可粘贴公众号或博客链接,或上传Markdown、Word文档。工作流程分两步:先由大语言模型担任“美术指导”,从文中挑选值得配图的观点,为每个观点选择呈现结构(流程、前后对比、隐喻等),设计物理隐喻并标注插图位置;再用GPT Image 2.5生成图片,风格固定为白底黑线手绘加红橙蓝手写批注,图片自动托管,复制Markdown即可使用。该工具坚持一条规则:角色必须处于“干活”状态(摇筛子、搬箱子等),若去掉角色画面仍成立,规划器将重写描述。目前提供阿嘟、墨墨、铅头儿等6个可选角色。收费采用买断制:注册送2张额度,之后按4.99美元20张至29.99美元150张的额度包付费,不订阅、不过期,规划环节免费,生成失败自动退款。技术栈采用TanStack Start(React)部署在Cloudflare Workers与D1上,邮箱魔法链接登录,规划使用快速GPT模型输出结构化JSON。

事件分析

该工具的技术思路在于将生图流程拆解为“规划”与“执行”两个阶段:LLM先完成视觉内容的结构化决策(选观点、定结构、写画面描述),图像模型仅负责渲染,这种分工显著降低了生成试错成本。强制角色“参与劳动”的约束规则,本质是通过提示词工程保证插画的叙事功能性,避免生成装饰性但无信息量的图片。从产业角度看,这类产品体现了AI应用层的一个明确方向:不追求更强的生成能力,而是封装完整工作流、解决垂直场景的具体痛点,“想画什么、插在哪”这类决策环节恰恰是大模型擅长且被忽视的价值点。买断制定价反映了独立开发者对小众专业用户的务实策略。后续关键在于画风与角色库的扩展、规划准确性的持续调优,以及能否开放自定义角色。

核心观点:AI生图工具的竞争正从画质转向工作流封装,规划“画什么、放哪”比生成本身更具稀缺价值。

原文链接:V2EX 分享发现

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›

抢沙发

评论前必须登录!

立即登录   注册