先想清楚:你画来做什么
选工具之前先明确需求,因为两个工具的定位完全不同:
- 想要「好看就完事了」:做头像、配图、海报、灵感图 → 选 Midjourney
- 想要「完全可控」:固定角色形象、精确控制构图、批量出图、本地部署 → 选 Stable Diffusion
- 预算为零且不想折腾:可以考虑即梦、通义万相、可图等国产工具,日常配图够用
下面详细对比。
核心差异一图看懂
| 维度 | Midjourney | Stable Diffusion |
|---|---|---|
| 使用方式 | 网页/Discord 输入文字 | 本地部署或云端服务 |
| 上手难度 | ★☆☆ 5 分钟出图 | ★★★ 需要折腾半天 |
| 费用 | 订阅制,约 $10/月起 | 免费(但要好显卡) |
| 出图美感 | 极高,「艺术感」是强项 | 取决于模型和参数 |
| 可控性 | 一般,靠提示词抽卡 | 极强,可控到每个细节 |
| 硬件要求 | 无 | 建议 8G 显存以上 |
| 商用授权 | 付费版可商用 | 模型协议各异,需自查 |
Midjourney 上手实操
注册与使用:打开 midjourney.com 注册,新界面已经非常友好,不用像以前那样在 Discord 里输命令。
提示词公式:
主体 + 细节 + 环境 + 风格 + 参数
套用示例——画一张「猫咪宇航员」:
a cute orange cat astronaut, wearing a detailed space suit,
floating in colorful nebula, digital art, trending on artstation,
soft lighting --ar 16:9 --v 6
逐项拆解:
a cute orange cat astronaut:主体,越具体越好wearing a detailed space suit:服装细节floating in colorful nebula:环境氛围digital art, trending on artstation:艺术风格--ar 16:9:宽高比(横版配图用 16:9,头像用 1:1)--v 6:模型版本,目前最新效果最好的
实用参数速查:
| 参数 | 作用 | 示例 |
|---|---|---|
--ar |
宽高比 | --ar 3:4(竖版海报) |
--s |
风格化程度(0-1000) | --s 250 更贴提示词,--s 750 更有艺术感 |
--no |
排除元素 | --no text, watermark(不要文字水印) |
--chaos |
出图多样性(0-100) | 灵感枯竭时拉到 50 以上 |
出图后的操作:每次生成 4 张图,U1-U4 放大选中的图,V1-V4 基于选中的图再生成 4 个变体。出好图的标准流程是:先抽 2-3 轮找感觉 → 选中接近的图按 V 微调 → 最后 U 放大。
Stable Diffusion 上手实操
部署方式:推荐整合包「秋叶启动器」(中文社区最成熟),下载解压双击即用,省去配置 Python 环境的麻烦。显卡建议 RTX 3060 12G 起步,4G 显存也能跑但很慢。
界面核心概念(以 WebUI 为例):
- 大模型(Checkpoint):决定画风的根本,一个模型文件 2-7G。写实风选 majicMIX realistic,二次元选 anything,2.5D 插画选 Counterfeit
- 正向提示词:你想要什么
- 反向提示词:你不想要什么(低质量、模糊、多余的手指等)
- 采样步数:一般 20-30 步,步数高不等于好
- CFG Scale:提示词服从度,7-8 是甜点区间
提示词示例:
正向:masterpiece, best quality, 1girl, white dress,
standing in sunflower field, golden hour lighting,
detailed face, cinematic composition
反向:lowres, bad anatomy, bad hands, missing fingers,
extra fingers, blurry, watermark, text
注意 SD 的提示词是关键词堆叠而不是自然语言,词序越靠前权重越高。
SD 的杀手锏——ControlNet:这是 MJ 做不到的。上传一张草图/姿势图/线稿,SD 会严格按图的结构出图。电商换背景、给线稿上色、固定人物姿势,全靠它。
10 组实测对比
同一个主题两个工具各出一张,帮你建立直观感受(以下为实测结论描述):
- 写实人像:MJ 胜在皮肤质感和光影氛围;SD 配合写实模型能打成平手,但要调参
- 二次元插画:平手,SD 的二次元模型生态更全
- 产品概念图:MJ 构图更有设计感;SD 配合 ControlNet 能精确控制产品角度
- 国风山水:MJ 的「意境」更好;SD 需要专门的国风 LoRA
- Logo/图标:两家都不擅长文字,但 MJ 的图形设计感更强
- 固定角色连续性:SD 完胜(用 LoRA 训练固定角色),MJ 的角色一致性功能仍在追赶
- 复杂指定构图(如「左边山右边海中间桥」):SD + ControlNet 完胜,MJ 基本靠运气
- 表情包/梗图:MJ 更快,SD 更精准
- 批量出 100 张商品图:SD 完胜,本地跑不花钱
- 完全不想学参数:MJ 完胜
商用授权与版权提醒
- Midjourney:付费订阅期间生成的图可商用;年收入超 100 万美元的公司需买 Pro 版
- Stable Diffusion:代码开源,但模型的协议各不相同——有的模型明确禁止商用,下载前看模型页面的 License
- 共性风险:AI 图不能直接描绘名人肖像、知名 IP 形象(米老鼠、奥特曼)用于商业用途,侵权风险自负
选择建议
- 自媒体配图、PPT 插图、灵感收集 → Midjourney,省下来的时间值回订阅费
- 电商作图、固定 IP 形象、批量生产、隐私敏感 → Stable Diffusion,一次部署终身免费
- 两个都想要 → 先用 MJ 找感觉和构图,再用 SD 精细化复刻和量产
新手最常见的错误是囤了一堆教程不动手。今天就选一个工具,把「一只猫宇航员」的提示词复制过去,发出你的第一张图——手感只能在实操中建立。

评论 (0)
还没有评论,快来抢沙发吧~