设计作图是 AI 应用里「看着惊艳、上手落差大」的典型:演示里一句话出海报,实际用起来要会写提示词、要抽卡、要后期。这篇不劝退,按「你要办的事」把场景分三档,各给工具与工作流——你大概率不需要学全套,只需要其中一档。
场景分档:你要的是哪种图
| 你的需求 | 工具档位 | 说明 |
|---|---|---|
| 偶尔配图、示意图、PPT 插图 | 商用文生图(网页/App 即开即用) | 一句话出图 + 少量关键词微调即可 |
| 做运营素材、改图、抠图换背景 | 图生图/编辑类 + 在线编辑器 | 上传参考图改风格、局部重绘、抠图 |
| 批量、可控、要自部署 | 开源本地(ComfyUI + Stable Diffusion/Flux 系) | 工作流可编程、可批量、数据可控,代价是折腾 |
选型心法:先回答「这图是给谁看的」。 内部草稿、示意(对美观要求低)→ 免费档够用;对外交付物(对美观与版权要求高)→ 认真挑工具并做后期;反复产出同类素材(要做一套)→ 才值得上 ComfyUI 这类「可编程」的方案,一次搭工作流,之后批量出。
三类场景的工作流
场景一:技术人/内容创作者配示意图
- 画架构图/流程图:别用文生图——结构图要准确,用绘图工具(draw.io/Excalidraw 等),AI 文生图画结构图会「画得很美但节点全错」。
- 封面图、示意图插画:文生图生成后再简单处理;用「描述主体 + 风格 + 画面内容」三要素写提示词,比堆砌形容词有效。
场景二:运营做素材(海报、配图、改图)
- 先找参考图:把「想要的感觉」翻译成参考图,图生图比文生图可控得多。
- 改图类需求(抠图、换背景、扩图)用在线编辑器的 AI 功能,比从头生成快且稳定。
- 出多版让同事选:生成是廉价的,多抽几张再挑,别追求一次到位。
场景三:批量、自部署(给「要长期做图」的人)
- 本地 ComfyUI 搭工作流:文生图、图生图、放大、批量处理串成图——一次搭好,之后只是换输入。
- 开源模型注意硬件要求:本地跑图对显卡有要求,先确认你的设备再动手(端侧/本地路线的判断同样适用)。
- 数据敏感场景(内部素材、未发布产品图)本地生成,别喂公共服务。
三个绕不开的坑
- 版权不明确:AI 生成图的商用权利因工具而异,对外交付前查清所用工具的商用条款——做海外市场时尤其要看(版权与合规的谨慎,见出海清单的态度)。
- 文字是重灾区:AI 出图里的中文/文字经常乱码——需要带字的图,用「生成画面 + 后期加字」,别指望一次出对。
- 审美是瓶颈:AI 能生成,不能判断「这张能不能用」——判断力是你自己的,多看图、建立自己的审美参考集,比学更多提示词有用。
落地清单
- 按「图给谁看」定档位:内部/对外/批量
- 结构图用绘图工具,别用文生图
- 改图走图生图/编辑,出多版再选
- 对外交付前查商用条款,带字图后期加字
- 长期批量才上 ComfyUI,先确认硬件