先说明一下:DALL-E 2在本文写作时(2022年3月)尚未正式发布(预计2022年4月开放)。本文基于DALL-E 1和其他AI绘画模型的使用经验,分享AI绘画工具的常见坑和解决方法。这些经验也适用于未来的DALL-E 2,帮你少走弯路,少熬夜。
这两年AI绘画发展很快,从DALL-E到Midjourney,再到Stable Diffusion,生成的图片质量越来越高。很多人开始用AI绘画做设计、做插画、做素材。
但AI绘画不是输入一句话就能出好图的。我用了几个月,踩了不少坑,经常为了一张图熬到半夜。今天分享这些踩坑经历,包括提示词怎么写、常见问题怎么解决、有哪些技巧,帮你少走弯路。
一、为什么会踩坑
刚开始用AI绘画的时候,我以为很简单:输入一句话,AI就给你一张图。
但实际用起来,完全不是那么回事。
我输入"一只猫在草地上",出来的猫可能有六条腿,或者脸是歪的。我输入"一个人站在海边",出来的人可能手指有六根,或者脸糊了。
为了得到一张满意的图,我经常要试几十次,改提示词、调参数、换模型,熬到半夜。
后来慢慢摸索,总结了一些经验。今天分享给大家。
二、提示词的坑
提示词(Prompt)是AI绘画最核心的部分。提示词写得好,出图质量就高;写得不好,再怎么调也没用。
坑一:提示词太简单
刚开始我写提示词很简单,比如"一只猫""一个女孩""风景"。出来的图很普通,没有细节,质量也不高。
后来才知道,AI绘画的提示词越详细越好。你要描述清楚:
- 主体是什么
- 在做什么
- 在哪里
- 什么风格
- 什么光线
- 什么视角
- 什么画质
比如,不要只写"一只猫",要写"一只橘猫坐在窗台上,午后阳光洒进来,温暖的光线,写实风格,高清细节,8K"。
提示词越详细,AI越能理解你的意图,出图质量越高。
坑二:提示词太复杂
但提示词也不是越长越好。有时候写得太复杂,AI反而理解不了,出来的图乱七八糟。
比如我写过一个超长的提示词,描述了场景、人物、服装、动作、光线、风格、画质,还有一堆细节。结果AI只抓住了其中几个点,其他的都忽略了。
经验是:提示词要重点突出,把最重要的描述放在前面,次要的放在后面。AI对前面的词更敏感。
一般来说,提示词控制在50-100个词比较合适。
坑三:否定词没用对
很多AI绘画工具支持负面提示词(Negative Prompt),就是你不想要什么。
刚开始我不会用否定词,出来的图经常有多余的东西。比如我想画一个人,结果背景里多了几个人。
后来学会了用否定词,比如"多余的人,模糊,低质量,变形",就能过滤掉很多不好的结果。
但否定词也不能乱用。否定太多,AI会困惑,出来的图反而更差。一般否定词写5-10个就够了。
坑四:语言的问题
大部分AI绘画模型是用英文训练的,英文提示词的效果比中文好。
刚开始我用中文写提示词,出来的图经常不对。后来改成英文,效果好了很多。
比如"一个穿红裙子的女孩在花园里",英文写成"a girl in a red dress in a garden",效果更好。
所以,如果你用的模型主要是英文训练的,建议用英文写提示词。
坑五:风格词的选择
提示词里加风格词,能显著改变出图的风格。比如:
- 写实风格:photorealistic, realistic, photo
- 油画风格:oil painting, canvas
- 水彩风格:watercolor
- 动漫风格:anime, manga
- 赛博朋克:cyberpunk
- 极简风格:minimalist
但风格词不是加得越多越好。加太多风格词,AI会混乱,出来的图四不像。
一般加1-2个风格词就够了。
三、人物的坑
画人物是AI绘画最容易出问题的地方。
坑一:脸和手变形
这是最常见的问题。AI画的人物,经常脸歪、眼睛不对称、手指多根或少根。
尤其是手,AI对手的理解很差,经常画出六根手指,或者手指粘连。
解决方法:
- 提示词里加"detailed face, detailed hands, perfect hands"
- 用更高的步数和更好的采样器
- 后期用修图软件修一下
- 或者用专门的人脸修复模型(比如GFPGAN)
坑二:多人场景混乱
画多个人的时候,AI经常搞混。两个人的脸长一样,或者衣服穿错了,或者肢体纠缠在一起。
解决方法:
- 尽量少画多人,先从单人开始
- 如果必须画多人,详细描述每个人的特征
- 用更高的分辨率和步数
- 后期合成,先画单人,再拼到一起
坑三:文字乱码
如果提示词里要求图片中有文字,AI经常画出乱码,根本看不懂。
因为AI对文字的理解很差,它只是在模仿文字的形状,不知道意思。
解决方法:
- 尽量不要让AI画文字
- 如果需要文字,后期用设计软件加上去
- 或者用专门的文字生成模型
坑四:年龄和性别不对
有时候你想画一个年轻女孩,结果出来的是中年妇女;你想画一个男人,结果出来的是女人。
解决方法:
- 提示词里明确写年龄和性别,比如"a 20-year-old woman"
- 加更多描述性的词,比如"young, beautiful girl"
- 多试几次,AI有随机性
四、构图和细节的坑
坑一:构图不好
AI画的图,构图经常很奇怪。主体太小或太大,位置偏,或者画面太空/太满。
解决方法:
- 提示词里加构图描述,比如"center composition, rule of thirds, close-up, wide shot"
- 指定视角,比如"bird's eye view, low angle, front view"
- 多试几次,选构图好的
坑二:细节不够
有时候出来的图很模糊,细节不够,放大看全是噪点。
解决方法:
- 提示词里加画质词,比如"highly detailed, sharp focus, 8K, HD, masterpiece"
- 用更高的分辨率生成
- 用超分辨率模型放大,比如Real-ESRGAN
- 增加采样步数
坑三:颜色不对
你想要暖色调,结果出来的是冷色调;你想要红色,结果出来的是橙色。
解决方法:
- 提示词里明确写颜色,比如"warm colors, red dress, blue sky"
- 加色调描述,比如"golden hour, sunset lighting, neon lights"
- 后期调色
坑四:背景杂乱
主体很清楚,但背景乱七八糟,有很多多余的元素。
解决方法:
- 提示词里描述背景,比如"simple background, white background, blurred background"
- 用否定词排除多余元素,比如"extra objects, clutter"
- 后期抠图,换背景
五、技术参数的坑
坑一:采样步数太少
采样步数太少,图会很模糊,细节不够。但步数太多,速度慢,而且可能过曝。
一般来说,20-50步比较合适。预览用10-20步,最终出图用30-50步。
坑二:采样器选错
不同的采样器,效果和速度不一样。选错了,出图质量差。
常用的采样器:
- Euler a:速度快,效果好,适合大多数场景
- DPM++ 2M Karras:质量高,速度稍慢
- DDIM:稳定,适合图生图
建议先用Euler a,效果不好再换其他的。
坑三:CFG Scale太高或太低
CFG Scale控制AI对提示词的遵循程度。太高,图会过曝、僵硬;太低,AI会自由发挥,偏离提示词。
一般7-12比较合适。默认是7,可以根据效果调整。
坑四:分辨率不对
分辨率太低,细节不够;太高,速度慢,而且可能出现重复元素(比如两个头)。
一般512x512或768x768比较合适。如果需要大图,先生成小图,再用超分辨率放大。
坑五:种子(Seed)没用好
种子控制随机性。同样的提示词和参数,不同的种子,出来的图不一样。
找到一个好的种子后,可以固定种子,微调提示词,得到相似但更好的图。
很多人不知道用种子,每次都随机,结果好图再也找不回来了。
六、我的工作流
总结一下我现在的AI绘画工作流,供大家参考。
第一步:构思
先想清楚要画什么:主体、场景、风格、光线、构图。在脑子里有个大概的画面。
第二步:写提示词
用英文写提示词,结构大概是: 主体 + 动作 + 场景 + 风格 + 光线 + 构图 + 画质
比如:"a young woman reading a book in a coffee shop, warm afternoon light, cozy atmosphere, photorealistic, shallow depth of field, highly detailed, 8K"
同时写负面提示词:"blurry, low quality, deformed, extra fingers, ugly, bad anatomy"
第三步:快速预览
用低步数(10-15步)、低分辨率(512x512)快速生成几张,看看大概效果。这一步主要是看构图和整体感觉,不追求细节。
第四步:调整提示词
根据预览结果,调整提示词。如果主体不对,改主体描述;如果风格不对,改风格词;如果颜色不对,加颜色描述。
反复调整,直到预览效果满意。
第五步:高清出图
满意后,用高步数(30-50步)、合适的分辨率生成最终图。固定种子,保证和预览一致。
第六步:后期处理
生成后,做一些后期处理:
- 超分辨率放大(如果需要大图)
- 人脸修复(如果人物脸变形)
- 调色(如果颜色不满意)
- 裁剪和修图(去掉多余元素)
后期处理很重要,能显著提升最终效果。
七、给新手的建议
如果你刚开始用AI绘画,给你几个建议。
1. 多练
AI绘画是个手艺活,需要多练。刚开始出图差很正常,练多了就有感觉了。
2. 多看
多看别人的好图和提示词,学习他们怎么写的。很多平台(比如PromptHero)有大量的提示词可以参考。
3. 多记
把好的提示词和参数记下来,建立自己的提示词库。以后遇到类似的需求,直接用。
4. 不要追求一次成功
AI绘画有随机性,不要指望一次就出好图。多试几次,选最好的。
5. 结合后期
AI生成的图不是最终产品,后期处理很重要。学会用修图软件,能让效果提升一个档次。
6. 注意版权
AI绘画的版权问题还不明确。商用的时候要注意,不要用有版权争议的风格或素材。
八、写在最后
AI绘画是一个很有潜力的工具,它能让不会画画的人也能创造出精美的图片。但它不是魔法,不是输入一句话就能出好图的。
想要用好AI绘画,需要学习提示词技巧,理解模型的特点,掌握后期处理方法。这个过程需要时间和耐心,也会踩很多坑。
但只要你愿意学习和尝试,就能用AI绘画创造出很棒的作品。
2022年了,AI绘画还在快速发展。DALL-E 2即将发布,听说质量会有大的提升。未来,AI绘画会越来越普及,越来越好用。
但不管工具怎么变,核心的技巧是相通的:好的提示词、合理的参数、适当的后期。掌握了这些,什么工具都能用好。
最后,用一句话总结:"AI绘画不是替代艺术家,而是让每个人都能成为艺术家。"
祝大家都能画出满意的作品,少踩坑,少熬夜。
评论(0)
暂无评论,快来抢沙发~
评论功能仅对会员开放,请先登录
登录