嘿,朋友!看到你在这个AI绘画的世界里摸索,我特别理解那种既兴奋又有点懵的感觉。毕竟这玩意儿变化太快了,昨天还流行的用法今天可能就有新姿势。别担心,咱们一步一步来,我会把那些让人抓狂的报错也给你讲清楚。
先聊聊这俩软件到底是干啥的
Midjourney 就像是那个住在Discord服务器里的高冷艺术大师。你不需要装任何软件,打开浏览器就能用,但你要先加入它的Discord社区。好处是简单粗暴——输入文字,它就能给你画出来,效果通常很惊艳,特别是那种梦幻、艺术感强的风格。坏处是它要钱,而且你在别人的服务器里干活,隐私性差点意思。
Stable Diffusion 则更像是你自家车库里的万能工具厂。它可以部署在自己的电脑或服务器上,完全免费开源,控制权100%在你手里。坏处是配置麻烦,对电脑配置有要求(特别是显卡),新手折腾半天可能连环境都装不起来。
选哪个?简单的说:如果你想快速出图、不太在乎隐私、愿意付费省心,选Midjourney;如果你想完全掌控、有折腾精神、电脑配置还行,选Stable Diffusion。
Midjourney新手入门完全指南
第一步:注册和加入Discord
Midjourney的一切都在Discord里进行。你需要:
- 注册Discord账号(discrod.com)
- 加入Midjourney的官方服务器(midjourney.com 网站有链接)
- 在服务器里创建一个私人的”新房间”,这样你的实验不会被别人看到
说实话,我第一次在Discord里喊”Hello”的时候,感觉像在跟一群机器人对话。别紧张,Midjourney的bot叫”Midjourney Bot”,你直接在聊天框输入 /imagine 就能开始。
第二步:理解基本命令格式
Midjourney的核心命令格式是这样的:
/imagine: prompt [选项]
比如你想画一只”赛博朋克风格的猫”,输入:
/imagine: a cyberpunk style cat, neon lights, futuristic city background
回车后,bot会在几十秒到几分钟内给你生成4张图。然后你可以:
- 点击 U1、U2、U3、U4 来放大某一张图
- 点击旁边的重绘按钮(🔄)让bot重新画这张图
- 点击”变体”(V1、V2等)让bot基于这张图生成新的变体
第三步:掌握常用的参数
这些参数能帮你精准控制结果:
--ar 16:9设置宽高比(比如横图用16:9,竖图用9:16)--style raw使用原始风格,更忠实于你的描述--style s或--style a使用不同的预设风格--chaos 50增加随机性,50是最大值--quality 2用双倍时间生成更高质量的图--no birds排除某些元素(比如不想出现鸟)
举个例子:
/imagine: a magical forest with glowing mushrooms, fantasy style --ar 16:9 --style raw --no humans
第四步:学习提示词工程
提示词就是你和Midjourney之间的语言。好的提示词包括:
- 主体描述:画什么(a cute kitten, an ancient castle, a futuristic car)
- 风格:什么风格(oil painting, watercolor, cyberpunk, photorealistic)
- 环境:在哪里(in a magical forest, on a rainy street at night, in space)
- 光线:什么光线(golden hour, neon lights, soft diffuse lighting)
- 细节:什么细节(highly detailed, 8k, ultra realistic)
我见过最牛的提示词是:”A grandfather telling stories to his grandchildren by fireplace, warm lighting, storybook illustration style, soft pastel colors”。生成的图温馨得像童话书里走出来的。
第五步:处理常见报错
这里是要害!新手最容易在这些地方卡住:
报错1:Rate limit exceeded
意思是你的请求太快了。Midjourney每月有积分限制,用完就等下个月。解决方法:等一等,或者升级套餐。
报错2:Image failed to generate
可能是提示词触发了安全过滤器(比如涉及暴力、成人内容)。解决方法:修改提示词,去掉敏感词汇,或者用 --no 排除。
报错3:Invalid parameter
参数拼错了。比如你把 --ar 写成了 --as。解决方法:检查参数拼写,参考官方文档。
报错4:网络超时
Discord服务器在国外,有时候连不上。解决方法:使用稳定的网络,或者挂VPN(注意安全)。
报错5:生成的图质量低
可能没开高质量模式。解决方法:在提示词末尾加 --quality 2,或者用 Upscale 功能放大。
Stable Diffusion新手入门完全指南
第一步:了解系统要求
Stable Diffusion对硬件有要求:
- 最低配置:NVIDIA显卡,8GB显存(比如RTX 3060)
- 推荐配置:12GB显存以上(比如RTX 3080、4090)
- 内存:16GB以上
- 硬盘:至少50GB空间(模型文件很大)
如果你用的是Mac,可能需要用专门优化的版本(比如Diffusers库)。Windows用户相对简单。
第二步:选择部署方式
有三种主流方式:
- WebUI(Automatic1111):最流行,功能最全,社区支持好。适合大多数用户。
- ComfyUI:节点式工作流,灵活强大,适合高级用户。学习曲线陡。
- Diffusers:Python库,适合开发者集成到自己的项目。
我强烈推荐新手从WebUI开始。它在GitHub上有详细的安装说明。
第三步:安装WebUI
以Windows为例(假设你已经装了Python 3.10):
# 1. 克隆仓库
git clone https://github.com/AUTOMATIC1111/stable-diffusion-webui.git
cd stable-diffusion-webui
# 2. 运行安装脚本
./webui-user.bat
# 3. 首次运行会自动下载模型和依赖
# 4. 打开浏览器访问 http://127.0.0.1:7860
说实话,我第一次安装时卡在Python版本上——WebUI需要3.10,但我装了3.11,折腾了一晚上。后来发现用官方提供的webui-user.bat脚本会自己处理。
第四步:下载模型
模型是SD的”灵魂”。默认模型是sd-v1-5.ckpt,但社区有无数精选模型:
- Realistic Stock Photo:写实风格
- DreamShaper:平衡现实与幻想
- Counterfeit:艺术感强
- MeinaMix:动漫风格
模型存放在 models/Stable-diffusion 文件夹。你可以从Civitai.com下载(记得看许可证)。
第五步:掌握基本界面
WebUI的界面分几个区域:
- Prompt:输入提示词
- Negative prompt:输入不想要的元素
- Sampling method:采样方法(Euler a, DPM++ 2M Karras等)
- Sampling steps:步数(20-50步通常足够)
- Resolution:分辨率(512x512是最小,768x1024适合竖图)
- Seed:种子值(相同种子+相同提示词=相同图)
第六步:学习高级功能
WebUI有很多黑科技:
- ControlNet:用草图、pose、深度图控制构图
- LoRA:微调模型,学特定风格或人物
- Upscale:放大图片而不损失细节
- ** inpainting**:局部重绘(比如换脸、加东西)
- Outpainting:扩展图片边界
我最近用ControlNet + LoRA画了一组”水墨风格的城市风景”,效果惊艳。ControlNet让我控制构图,LoRA赋予水墨质感。
第七步:处理常见报错
报错1:CUDA out of memory
显存不够。解决方法:
- 降低分辨率(512x512)
- 减少batch size
- 用
--medvram或--lowvram参数启动WebUI - 关闭其他占用显存的程序
报错2:Model not found
模型路径不对。解决方法:检查 models/Stable-diffusion 文件夹,确保模型文件在那里。
报错3:ImportError: No module named xxx
Python依赖没装好。解决方法:
# 重新运行安装脚本
./webui-user.bat
# 或者手动安装
pip install -r requirements.txt
报错4:生成的图全是黑的
可能是学习率太高或采样步数太少。解决方法:
- 增加采样步数到30-50
- 降低学习率(如果用训练功能)
- 检查模型是否损坏,重新下载
报错5:UI卡顿或崩溃
显卡驱动太旧。解决方法:更新NVIDIA驱动到最新版本。
俩软件的对比和选择建议
| 特性 | Midjourney | Stable Diffusion |
|---|---|---|
| 上手难度 | 简单,网页操作 | 中等,需配置环境 |
| 费用 | 订阅制(约$10/月) | 免费(除非自己买显卡) |
| 隐私 | 图在Discord服务器 | 完全本地,隐私性好 |
| 风格 | 艺术感强,梦幻 | 灵活,可微调风格 |
| 控制力 | 有限,靠提示词 | 极强,ControlNet、LoRA等 |
| 硬件要求 | 无 | 需要好显卡 |
| 更新速度 | 快,官方持续优化 | 社区驱动,更新依赖开发者 |
如果你只是想快速出点好看的图发社交媒体,Midjourney更合适。如果你想深入创作、控制每一个细节、甚至训练自己的模型,Stable Diffusion是王道。
实战案例:用俩软件画同一个主题
让我们画”一只穿着宇航服的柴犬在月球上”:
Midjourney提示词:
a corgi dog wearing a futuristic astronaut suit, standing on the moon surface, earth in the background, photorealistic, cinematic lighting, 8k --ar 16:9 --style raw
Stable Diffusion提示词:
masterpiece, best quality, a cute corgi dog wearing detailed astronaut suit, standing on moon surface, crater details, earth rising in sky, photorealistic, cinematic lighting, soft ambient occlusion, 8k, raw photo
Stable Diffusion负面提示词:
low quality, blurry, distorted face, extra limbs, bad anatomy, watermark, text
同样的主题,Midjourney出来的图更梦幻、更有艺术感;Stable Diffusion出来的图更写实、细节更可控(特别是用ControlNet控制柴犬的pose)。
给新手的几个贴心建议
- 别急着买硬件:先用Midjourney免费版或Stable Diffusion在线服务(比如Tensor.art)感受一下。
- 社区是最好的老师:Midjourney的Discord服务器、Stable Diffusion的Civitai社区,多看多学。
- 提示词是门艺术:花时间和AI对话,了解它喜欢什么风格、讨厌什么元素。
- 报错不可怕:每个报错都是一次学习机会。记录下来,以后就不会再踩坑。
- 别贪多:先精通一个工具,再扩展。Midjourney和SD都用的人很多,但建议先选一个深入。
AI绘画这个世界变化太快了,我写这篇文章的时候,Midjourney已经出v6了,Stable Diffusion也有了XL版本。但核心逻辑不变:理解工具,练习提示词,享受创作的乐趣。
记住,最好的AI绘画不是最贵的工具,而是你最懂它、它最能表达你的想法。慢慢来,你会找到属于自己的风格。
有问题随时问,咱们一起进步!🎨
