先说明一下:DALL-E 2在本文写作时(2022年3月)尚未正式发布(预计2022年4月开放)。本文基于DALL-E 1和其他AI绘画模型的使用经验,分享AI绘画工具的常见坑和解决方法。这些经验也适用于未来的DALL-E 2,帮你少走弯路,少熬夜。

这两年AI绘画发展很快,从DALL-E到Midjourney,再到Stable Diffusion,生成的图片质量越来越高。很多人开始用AI绘画做设计、做插画、做素材。

但AI绘画不是输入一句话就能出好图的。我用了几个月,踩了不少坑,经常为了一张图熬到半夜。今天分享这些踩坑经历,包括提示词怎么写、常见问题怎么解决、有哪些技巧,帮你少走弯路。

一、为什么会踩坑

刚开始用AI绘画的时候,我以为很简单:输入一句话,AI就给你一张图。

但实际用起来,完全不是那么回事。

我输入"一只猫在草地上",出来的猫可能有六条腿,或者脸是歪的。我输入"一个人站在海边",出来的人可能手指有六根,或者脸糊了。

为了得到一张满意的图,我经常要试几十次,改提示词、调参数、换模型,熬到半夜。

后来慢慢摸索,总结了一些经验。今天分享给大家。

二、提示词的坑

提示词(Prompt)是AI绘画最核心的部分。提示词写得好,出图质量就高;写得不好,再怎么调也没用。

坑一:提示词太简单

刚开始我写提示词很简单,比如"一只猫""一个女孩""风景"。出来的图很普通,没有细节,质量也不高。

后来才知道,AI绘画的提示词越详细越好。你要描述清楚:

  • 主体是什么
  • 在做什么
  • 在哪里
  • 什么风格
  • 什么光线
  • 什么视角
  • 什么画质

比如,不要只写"一只猫",要写"一只橘猫坐在窗台上,午后阳光洒进来,温暖的光线,写实风格,高清细节,8K"。

提示词越详细,AI越能理解你的意图,出图质量越高。

坑二:提示词太复杂

但提示词也不是越长越好。有时候写得太复杂,AI反而理解不了,出来的图乱七八糟。

比如我写过一个超长的提示词,描述了场景、人物、服装、动作、光线、风格、画质,还有一堆细节。结果AI只抓住了其中几个点,其他的都忽略了。

经验是:提示词要重点突出,把最重要的描述放在前面,次要的放在后面。AI对前面的词更敏感。

一般来说,提示词控制在50-100个词比较合适。

坑三:否定词没用对

很多AI绘画工具支持负面提示词(Negative Prompt),就是你不想要什么。

刚开始我不会用否定词,出来的图经常有多余的东西。比如我想画一个人,结果背景里多了几个人。

后来学会了用否定词,比如"多余的人,模糊,低质量,变形",就能过滤掉很多不好的结果。

但否定词也不能乱用。否定太多,AI会困惑,出来的图反而更差。一般否定词写5-10个就够了。

坑四:语言的问题

大部分AI绘画模型是用英文训练的,英文提示词的效果比中文好。

刚开始我用中文写提示词,出来的图经常不对。后来改成英文,效果好了很多。

比如"一个穿红裙子的女孩在花园里",英文写成"a girl in a red dress in a garden",效果更好。

所以,如果你用的模型主要是英文训练的,建议用英文写提示词。

坑五:风格词的选择

提示词里加风格词,能显著改变出图的风格。比如:

  • 写实风格:photorealistic, realistic, photo
  • 油画风格:oil painting, canvas
  • 水彩风格:watercolor
  • 动漫风格:anime, manga
  • 赛博朋克:cyberpunk
  • 极简风格:minimalist

但风格词不是加得越多越好。加太多风格词,AI会混乱,出来的图四不像。

一般加1-2个风格词就够了。

三、人物的坑

画人物是AI绘画最容易出问题的地方。

坑一:脸和手变形

这是最常见的问题。AI画的人物,经常脸歪、眼睛不对称、手指多根或少根。

尤其是手,AI对手的理解很差,经常画出六根手指,或者手指粘连。

解决方法:

  • 提示词里加"detailed face, detailed hands, perfect hands"
  • 用更高的步数和更好的采样器
  • 后期用修图软件修一下
  • 或者用专门的人脸修复模型(比如GFPGAN)

坑二:多人场景混乱

画多个人的时候,AI经常搞混。两个人的脸长一样,或者衣服穿错了,或者肢体纠缠在一起。

解决方法:

  • 尽量少画多人,先从单人开始
  • 如果必须画多人,详细描述每个人的特征
  • 用更高的分辨率和步数
  • 后期合成,先画单人,再拼到一起

坑三:文字乱码

如果提示词里要求图片中有文字,AI经常画出乱码,根本看不懂。

因为AI对文字的理解很差,它只是在模仿文字的形状,不知道意思。

解决方法:

  • 尽量不要让AI画文字
  • 如果需要文字,后期用设计软件加上去
  • 或者用专门的文字生成模型

坑四:年龄和性别不对

有时候你想画一个年轻女孩,结果出来的是中年妇女;你想画一个男人,结果出来的是女人。

解决方法:

  • 提示词里明确写年龄和性别,比如"a 20-year-old woman"
  • 加更多描述性的词,比如"young, beautiful girl"
  • 多试几次,AI有随机性

四、构图和细节的坑

坑一:构图不好

AI画的图,构图经常很奇怪。主体太小或太大,位置偏,或者画面太空/太满。

解决方法:

  • 提示词里加构图描述,比如"center composition, rule of thirds, close-up, wide shot"
  • 指定视角,比如"bird's eye view, low angle, front view"
  • 多试几次,选构图好的

坑二:细节不够

有时候出来的图很模糊,细节不够,放大看全是噪点。

解决方法:

  • 提示词里加画质词,比如"highly detailed, sharp focus, 8K, HD, masterpiece"
  • 用更高的分辨率生成
  • 用超分辨率模型放大,比如Real-ESRGAN
  • 增加采样步数

坑三:颜色不对

你想要暖色调,结果出来的是冷色调;你想要红色,结果出来的是橙色。

解决方法:

  • 提示词里明确写颜色,比如"warm colors, red dress, blue sky"
  • 加色调描述,比如"golden hour, sunset lighting, neon lights"
  • 后期调色

坑四:背景杂乱

主体很清楚,但背景乱七八糟,有很多多余的元素。

解决方法:

  • 提示词里描述背景,比如"simple background, white background, blurred background"
  • 用否定词排除多余元素,比如"extra objects, clutter"
  • 后期抠图,换背景

五、技术参数的坑

坑一:采样步数太少

采样步数太少,图会很模糊,细节不够。但步数太多,速度慢,而且可能过曝。

一般来说,20-50步比较合适。预览用10-20步,最终出图用30-50步。

坑二:采样器选错

不同的采样器,效果和速度不一样。选错了,出图质量差。

常用的采样器:

  • Euler a:速度快,效果好,适合大多数场景
  • DPM++ 2M Karras:质量高,速度稍慢
  • DDIM:稳定,适合图生图

建议先用Euler a,效果不好再换其他的。

坑三:CFG Scale太高或太低

CFG Scale控制AI对提示词的遵循程度。太高,图会过曝、僵硬;太低,AI会自由发挥,偏离提示词。

一般7-12比较合适。默认是7,可以根据效果调整。

坑四:分辨率不对

分辨率太低,细节不够;太高,速度慢,而且可能出现重复元素(比如两个头)。

一般512x512或768x768比较合适。如果需要大图,先生成小图,再用超分辨率放大。

坑五:种子(Seed)没用好

种子控制随机性。同样的提示词和参数,不同的种子,出来的图不一样。

找到一个好的种子后,可以固定种子,微调提示词,得到相似但更好的图。

很多人不知道用种子,每次都随机,结果好图再也找不回来了。

六、我的工作流

总结一下我现在的AI绘画工作流,供大家参考。

第一步:构思

先想清楚要画什么:主体、场景、风格、光线、构图。在脑子里有个大概的画面。

第二步:写提示词

用英文写提示词,结构大概是: 主体 + 动作 + 场景 + 风格 + 光线 + 构图 + 画质

比如:"a young woman reading a book in a coffee shop, warm afternoon light, cozy atmosphere, photorealistic, shallow depth of field, highly detailed, 8K"

同时写负面提示词:"blurry, low quality, deformed, extra fingers, ugly, bad anatomy"

第三步:快速预览

用低步数(10-15步)、低分辨率(512x512)快速生成几张,看看大概效果。这一步主要是看构图和整体感觉,不追求细节。

第四步:调整提示词

根据预览结果,调整提示词。如果主体不对,改主体描述;如果风格不对,改风格词;如果颜色不对,加颜色描述。

反复调整,直到预览效果满意。

第五步:高清出图

满意后,用高步数(30-50步)、合适的分辨率生成最终图。固定种子,保证和预览一致。

第六步:后期处理

生成后,做一些后期处理:

  • 超分辨率放大(如果需要大图)
  • 人脸修复(如果人物脸变形)
  • 调色(如果颜色不满意)
  • 裁剪和修图(去掉多余元素)

后期处理很重要,能显著提升最终效果。

七、给新手的建议

如果你刚开始用AI绘画,给你几个建议。

1. 多练

AI绘画是个手艺活,需要多练。刚开始出图差很正常,练多了就有感觉了。

2. 多看

多看别人的好图和提示词,学习他们怎么写的。很多平台(比如PromptHero)有大量的提示词可以参考。

3. 多记

把好的提示词和参数记下来,建立自己的提示词库。以后遇到类似的需求,直接用。

4. 不要追求一次成功

AI绘画有随机性,不要指望一次就出好图。多试几次,选最好的。

5. 结合后期

AI生成的图不是最终产品,后期处理很重要。学会用修图软件,能让效果提升一个档次。

6. 注意版权

AI绘画的版权问题还不明确。商用的时候要注意,不要用有版权争议的风格或素材。

八、写在最后

AI绘画是一个很有潜力的工具,它能让不会画画的人也能创造出精美的图片。但它不是魔法,不是输入一句话就能出好图的。

想要用好AI绘画,需要学习提示词技巧,理解模型的特点,掌握后期处理方法。这个过程需要时间和耐心,也会踩很多坑。

但只要你愿意学习和尝试,就能用AI绘画创造出很棒的作品。

2022年了,AI绘画还在快速发展。DALL-E 2即将发布,听说质量会有大的提升。未来,AI绘画会越来越普及,越来越好用。

但不管工具怎么变,核心的技巧是相通的:好的提示词、合理的参数、适当的后期。掌握了这些,什么工具都能用好。

最后,用一句话总结:"AI绘画不是替代艺术家,而是让每个人都能成为艺术家。"

祝大家都能画出满意的作品,少踩坑,少熬夜。