你是不是也有这种感觉:打开Midjourney或者Stable Diffusion,输入几个词,点一下生成,然后……看着那一堆虽然技术很完美、光影很华丽,但怎么看都像是“标准答案”一样的图,心里有点失望?
别急着怪自己没艺术细胞,也别急着觉得AI就是换个模板的机器。其实,“只出图不出创意”是90%的新手都会经历的阵痛期。今天咱们不聊那些晦涩难懂的代码,就坐在电脑前,像老朋友聊天一样,把这块拼图一块块拼起来。我要告诉你的是,AI不是你的竞争对手,它是你手里那支最听话、但需要你指挥得最精准的画笔。
第一关:为什么你的图看起来“很假”?—— 读懂咒语的逻辑
很多人以为写提示词(Prompt)就是堆砌形容词。你写“美丽的少女,高清,4k,大师作品”,出来的图确实美,但美得千篇一律,像淘宝模特图,没有灵魂。
真正的创意,来自于对画面的控制力。
1. 结构化你的提示词
想象你在给一个摄影师下指令。你不会只说“拍个好点的照片”,你会说:“在黄昏的旧书店里,一束侧逆光打在书架上,空气中要有漂浮的尘埃感,使用85mm镜头,浅景深,营造一种怀旧且静谧的氛围。”
这就是AI绘画的黄金公式:
主体描述 + 环境背景 + 光照与氛围 + 艺术风格/媒介 + 技术参数/相机参数
让我们拆解一下:
- 主体描述:谁?在做什么?穿什么?表情如何?
- 例子:一个穿着蒸汽朋克风格铜制义肢的小女孩,手里拿着一盏发光的玻璃灯。
- 环境背景:在哪里?周围有什么?
- 例子:暴雨中的维多利亚式街道,湿漉漉的石板路反射着霓虹灯,远处有模糊的马车轮廓。
- 光照与氛围:这是注入“创意”的关键!光从哪来?什么颜色?心情是忧郁的还是充满希望的?
- 例子:丁达尔效应(Tyndall effect),冷色调的蓝光与暖色调的灯光对比,神秘,孤寂,电影感。
- 艺术风格/媒介:你想让它看起来像油画、水彩、还是照片?
- 例子:赛博朋克插画,吉卜力工作室风格,或者是亨利·卢梭(Henri Rousseau)的原始主义风格。
- 技术参数:这决定了画面的质感。
- 例子:8k分辨率,超详细,景深,光线追踪渲染。
实战对比:
- ❌ 新手版:
一个女孩,海边,好看,高清- 结果:一个标准的网红摆拍图,脸很网感,背景很通用。
- ✅ 进阶版:
一位年迈的渔民祖母,脸庞布满皱纹如海藻纹路,站在暴风雨来临前的悬崖边,手中紧握着破旧的渔网,低角度仰拍,乌云密布的天空压得很低,画面充满史诗感和孤独感,由格里高利·克鲁德逊(Gregory Crewdson)摄影风格,高对比度, cinematic lighting- 结果:这张图会有故事。你会忍不住去想:她经历了什么?为什么在暴风雨前?这才是创意。
2. 善用“负面提示词”(Negative Prompt)
如果你用的是Stable Diffusion,负面提示词就是你的“过滤器”。告诉AI你不想要什么。
常用的负面词包括:
low quality, worst quality, bad anatomy, bad hands, missing fingers, extra digit, fewer digits, cropped, jpeg artifacts, blurry, watermark, text
这句话的意思大致是:低质量、最差质量、人体结构错误、糟糕的手(AI最容易画烂手的地方)、缺失手指、多手指、裁切、压缩噪点、模糊、水印、文字。
把这些写进去,至少能保证你的图在“技术层面”不崩坏。
第二关:参数调优—— 从“随机抽奖”到“精确制导”
很多时候,你生成了一张满意的图,但下次再想生成类似的,或者想改进它,却发现根本找不到感觉。这时候,参数的威力就出来了。
以Midjourney为例,那些跟在命令后面的--ar、--stylize、--chaos不是废话,它们是创意的方向盘。
1. 宽高比(–ar):构图即叙事
--ar 16:9 是电影宽屏,适合宏大的场景、风景、叙事性强的画面。
--ar 1:1 是正方形,经典构图,适合肖像、静物,有一种稳重感。
--ar 9:16 是手机全屏,适合强调主体的垂直构图,比如人物特写、高楼大厦。
创意技巧:试试极端的比例。比如--ar 3:1的超宽幅,适合表现连绵的山脉或城市天际线,那种广阔感是正方形给不了的。或者--ar 4:5,更接近Instagram的竖屏,让人物更有压迫感和冲击力。
2. 风格化(–s):掌控AI的“艺术洁癖”
--s 的值从0到1000。
- 低值(0-100):AI会严格遵循你的提示词,不太会自作主张加戏。适合需要精准控制的作品,比如产品设计图、Logo设计。
- 高值(750-1000):AI会发挥它的“想象力”,把画面变得非常美观、艺术化,但可能会偏离你原本想表达的核心意思。
避坑指南:如果你想要一种特定的、非主流的风格(比如“废弃工厂里的芭蕾舞者”),把s调低,让AI乖乖听话,而不是让它用那种油腻的“美感”去覆盖你的创意。
3. 混乱度(–c):让意外发生
--c 控制的是结果的多样性。
- 低值:四张图会很像,像是在微调同一个画面。
- 高值(0.5-1):四张图会截然不同。
创意技巧:当你卡壳的时候,把--c调高。有时候,创意就藏在那些“跑偏”的图里。你可能想要一个红色的苹果,但高混乱度可能生成了一个紫色的、融化的、或者长在树上的苹果雕塑——这正是突破常规的开始。
4. 种子值(–seed):复刻与变异
这是进阶玩家的秘密武器。每张AI生成的图都有一个唯一的“种子号”(Seed)。
- 怎么用? 你可以右键点击你喜欢的某张图,复制它的Seed值。
- 然后呢? 在Prompt后面加上
--seed [数字],配合相同的提示词,你会发现生成的图结构几乎一样。 - 进阶玩法:保持Seed不变,只修改提示词中的一个词(比如把“女孩”改成“男孩”,或者把“晴天”改成“雨天”)。你会惊讶地发现,AI如何在保持画面构图和光影一致的前提下,微调内容。这是制作系列作品的最佳方法!
第三关:注入灵魂—— 如何从“出图”变成“创作”
参数调好了,提示词写美了,图也很清晰了,但为什么还是觉得少点什么?
因为缺“意图”。
AI不会主动思考“我想表达什么”,它只会执行“你怎么说”。所以,创意不来自AI,而来自你。
1. 建立你的“创意素材库”
不要等到打开软件才开始想。平时多积累:
- 看展、看电影:截下图中的光影、配色方案。比如《银翼杀手2049》的橙色迷雾,《布达佩斯大饭店》的粉色对称构图。把这些视觉元素转化成词汇加入提示词。
- 阅读诗歌和文学:好的文学描写能提供AI无法提供的隐喻。比如“她的悲伤像一座沉没的城市”,这比“sad girl”要有创意得多。
- 收集色彩搭配:使用Adobe Color或Coolors,找出你喜欢的配色,然后把色值或色彩名称(如“莫兰迪色系”、“赛博霓虹”)写入提示词。
2. 尝试“风格混搭”
创意的本质往往是旧元素的新组合。
- 让《蒙娜丽莎》穿着宇航服在火星上行走(古典油画 + 科幻)。
- 用中国水墨画的风格去画一只机械恐龙(传统 + 未来)。
- 用皮克斯的3D动画风格去还原《红楼梦》里的贾府(现代动画 + 古典文学)。
这种反差感,就是创意的火花。试着在提示词里加入两个看似不相关的艺术家名字,看看会发生什么化学反应。
3. 后期处理:AI的终点,创作的起点
永远不要认为生成立即完成。Midjourney和Stable Diffusion生成的图,只是“半成品”。
- Photoshop/Lightroom:调整色彩、对比度,去除瑕疵。
- Upscaling工具:如Topaz Gigapixel,把图放大而不损失细节,甚至加入原图没有的纹理(比如布料的织纹、皮肤的毛孔)。
- 手绘叠加:在AI生成的基础上,用手绘补充细节,或者添加一些AI不擅长的手写字、涂鸦。这能让画面更有“人味”。
第四关:版权避坑—— 别让你的心血变成别人的财产
这部分很重要,很多新手因为不懂,要么侵权被抓,要么自己的图被白嫖还维权无门。
1. 你的AI图有版权吗?
这是一个法律灰色地带,但目前的主流观点(尤其是美国版权局)是:纯AI生成的作品,不受版权保护。
为什么?因为版权保护的是“人类的智力创作”。如果图完全是AI生成的,没有人类的实质性贡献,那么它就属于“公共领域”,任何人都可以拿去用,你拦不住。
如何获得版权? 你需要证明你在创作过程中投入了“人类的智力劳动”。
- 简单提示词 + 生成 = 无版权风险(但也无保护)。
- 复杂的多次迭代、精心的提示词工程、在AI生成基础上进行大量PS修改、手绘添加 = 可能享有版权(具体看各国法律,建议咨询律师)。
建议:如果你想靠AI绘画吃饭,一定要对成品进行深度二次创作,不要只发原图。
2. 商用之前,看清平台协议
不同的AI工具,版权政策完全不同:
- Midjourney:
- 免费用户:无权商用,图片版权归MJ所有,你可以个人使用,但不能卖。
- 付费用户(基础版及以上):拥有生成图片的商业使用权,但MJ保留非独占的许可权。简单说,你可以拿去卖,但不能把图说成是你“画”的,且MJ可以授权使用。
- DALL-E 3 (ChatGPT Plus):
- 用户对生成内容拥有所有权,但OpenAI保留用于改善服务的权利。可以商用,但需注意输出内容不能侵犯他人的商标或肖像权。
- Stable Diffusion (本地部署):
- 最自由。你在自己电脑上跑,生成的图完全归你,没有平台干涉。但前提是你得懂技术,能折腾环境。
- Adobe Firefly:
- 主打“商业安全”。它训练数据来自Adobe库存图片,声称不会侵犯版权。更适合企业级用户,可以直接用在商业项目中,风险较低。
3. 侵权雷区:肖像权、商标权、艺术家风格
- 不要生成真实名人的脸:尤其是用于商业广告。用Midjourney的
--cref(角色参考)功能时,如果用的是明星照片,可能会有肖像权风险。 - 不要生成带有明显商标的产品:比如画一个背着LV包的女孩,然后拿去卖T恤。LV可能会找你麻烦。
- “风格”一般不受版权保护,但要小心“模仿”:你可以说“在宫崎骏风格下”,这通常没问题。但如果你生成了“一个看起来完全像米老鼠的形象”,那就侵权了。区别在于:风格是抽象的,形象是具体的。
4. 给小朋友的一个简单比喻
想象一下,你让机器人帮你画了一隻恐龙。
- 如果你只是按了一下按钮,这隻恐龙就是“野生恐龙”,谁都可以抓走养在家里,你不能说“这是我养的吗?”
- 但如果你不仅按了按钮,还亲自给恐龙涂颜色、加伤疤、给它做了一套小衣服,那这只恐龙就是你的“宠物”,别人不能随便抢走。
- 另外,如果你画的恐龙背上印了“耐克”的勾勾,耐克公司可能会说:“嘿,那是我家的标志,你不能随便用!”
第五关:避坑实战—— 那些让你崩溃的细节
最后,分享几个新手最容易踩的坑,以及怎么解决:
坑1:手总是画崩
- 原因:AI对复杂的人体结构,尤其是手指,理解依然很弱。
- 解决:
- 提示词里加
perfect hands, detailed fingers。 - 使用Stable Diffusion的ControlNet工具,先用一张真实的手部照片作为骨架参考,让AI照着画。
- 多抽卡,别怕浪费,通常10张里会有1-2张手的。
- 后期用PS修补,或者干脆让角色背手、拿东西挡住手。
- 提示词里加
坑2:文字乱码
- 原因:早期AI不擅长生成文字。
- 解决:
- Midjourney v6之后,生成文字的能力大大增强。提示词里明确写出
text saying "Hello"。 - 如果需要精准文字(比如海报标题),还是建议用PS后期添加。AI负责背景和设计,你负责最后的关键信息。
- Midjourney v6之后,生成文字的能力大大增强。提示词里明确写出
坑3:画面太“脏”或太“糊”
- 原因:提示词堆砌了太多不相关的细节,或者分辨率设置过低。
- 解决:
- 做减法。每次只强调1-2个核心元素。
- 使用Upscale(放大)功能。Midjourney生成后点击U1-U4,或者使用第三方放大工具。
坑4:所有图都长得一样
- 原因:提示词太泛,或者Seed值重复。
- 解决:
- 尝试更具体的艺术风格词,如
watercolor wash,oil painting impasto,charcoal sketch。 - 改变构图词:
low angle,bird's eye view,macro shot,wide angle lens。
- 尝试更具体的艺术风格词,如
结语:AI是副驾驶,你才是机长
回到最初的问题:新手用AI绘画,为什么只出图不出创意?
因为你在把AI当成“生成器”,而你应该把它当成“执行者”。
创意来源于你的阅历、你的审美、你的愤怒、你的温柔。AI只是把你脑子里那些模糊的念头,快速具象化。如果你脑子里没有画面,AI变不出花样;但如果你脑子里有火焰,AI能帮你点燃整片草原。
别怕犯错,别怕生成一堆垃圾图。那是你在学习与这位新伙伴对话。每一次调整参数,每一次修改提示词,都是你在训练它,也是在训练你自己的审美。
现在,关掉这篇文章,打开你的AI绘图工具。试着写下一个连你自己都觉得有点奇怪的组合,比如“一只穿着西装的企鹅在月球上跳芭蕾”,然后看看,会发生什么。
祝你玩得开心,画出真正属于你自己的作品。
