AI 绘画入门:Midjourney 与 Stable Diffusion 对比实测

站长 2026-09-29 1 约 2 分钟 392 字
#Stable Diffusion#AI绘画#Midjourney#AIGC

先想清楚:你画来做什么

选工具之前先明确需求,因为两个工具的定位完全不同:

  • 想要「好看就完事了」:做头像、配图、海报、灵感图 → 选 Midjourney
  • 想要「完全可控」:固定角色形象、精确控制构图、批量出图、本地部署 → 选 Stable Diffusion
  • 预算为零且不想折腾:可以考虑即梦、通义万相、可图等国产工具,日常配图够用

下面详细对比。

核心差异一图看懂

维度 Midjourney Stable Diffusion
使用方式 网页/Discord 输入文字 本地部署或云端服务
上手难度 ★☆☆ 5 分钟出图 ★★★ 需要折腾半天
费用 订阅制,约 $10/月起 免费(但要好显卡)
出图美感 极高,「艺术感」是强项 取决于模型和参数
可控性 一般,靠提示词抽卡 极强,可控到每个细节
硬件要求 无 建议 8G 显存以上
商用授权 付费版可商用 模型协议各异,需自查

Midjourney 上手实操

注册与使用:打开 midjourney.com 注册,新界面已经非常友好,不用像以前那样在 Discord 里输命令。

提示词公式:

主体 + 细节 + 环境 + 风格 + 参数

套用示例——画一张「猫咪宇航员」:

a cute orange cat astronaut, wearing a detailed space suit,
floating in colorful nebula, digital art, trending on artstation,
soft lighting --ar 16:9 --v 6

逐项拆解:

  • a cute orange cat astronaut:主体,越具体越好
  • wearing a detailed space suit:服装细节
  • floating in colorful nebula:环境氛围
  • digital art, trending on artstation:艺术风格
  • --ar 16:9:宽高比(横版配图用 16:9,头像用 1:1)
  • --v 6:模型版本,目前最新效果最好的

实用参数速查:

参数 作用 示例
--ar 宽高比 --ar 3:4(竖版海报)
--s 风格化程度(0-1000) --s 250 更贴提示词,--s 750 更有艺术感
--no 排除元素 --no text, watermark(不要文字水印)
--chaos 出图多样性(0-100) 灵感枯竭时拉到 50 以上

出图后的操作:每次生成 4 张图,U1-U4 放大选中的图,V1-V4 基于选中的图再生成 4 个变体。出好图的标准流程是:先抽 2-3 轮找感觉 → 选中接近的图按 V 微调 → 最后 U 放大。

Stable Diffusion 上手实操

部署方式:推荐整合包「秋叶启动器」(中文社区最成熟),下载解压双击即用,省去配置 Python 环境的麻烦。显卡建议 RTX 3060 12G 起步,4G 显存也能跑但很慢。

界面核心概念(以 WebUI 为例):

  • 大模型(Checkpoint):决定画风的根本,一个模型文件 2-7G。写实风选 majicMIX realistic,二次元选 anything,2.5D 插画选 Counterfeit
  • 正向提示词:你想要什么
  • 反向提示词:你不想要什么(低质量、模糊、多余的手指等)
  • 采样步数:一般 20-30 步,步数高不等于好
  • CFG Scale:提示词服从度,7-8 是甜点区间

提示词示例:

正向:masterpiece, best quality, 1girl, white dress,
standing in sunflower field, golden hour lighting,
detailed face, cinematic composition

反向:lowres, bad anatomy, bad hands, missing fingers,
extra fingers, blurry, watermark, text

注意 SD 的提示词是关键词堆叠而不是自然语言,词序越靠前权重越高。

SD 的杀手锏——ControlNet:这是 MJ 做不到的。上传一张草图/姿势图/线稿,SD 会严格按图的结构出图。电商换背景、给线稿上色、固定人物姿势,全靠它。

10 组实测对比

同一个主题两个工具各出一张,帮你建立直观感受(以下为实测结论描述):

  1. 写实人像:MJ 胜在皮肤质感和光影氛围;SD 配合写实模型能打成平手,但要调参
  2. 二次元插画:平手,SD 的二次元模型生态更全
  3. 产品概念图:MJ 构图更有设计感;SD 配合 ControlNet 能精确控制产品角度
  4. 国风山水:MJ 的「意境」更好;SD 需要专门的国风 LoRA
  5. Logo/图标:两家都不擅长文字,但 MJ 的图形设计感更强
  6. 固定角色连续性:SD 完胜(用 LoRA 训练固定角色),MJ 的角色一致性功能仍在追赶
  7. 复杂指定构图(如「左边山右边海中间桥」):SD + ControlNet 完胜,MJ 基本靠运气
  8. 表情包/梗图:MJ 更快,SD 更精准
  9. 批量出 100 张商品图:SD 完胜,本地跑不花钱
  10. 完全不想学参数:MJ 完胜

商用授权与版权提醒

  • Midjourney:付费订阅期间生成的图可商用;年收入超 100 万美元的公司需买 Pro 版
  • Stable Diffusion:代码开源,但模型的协议各不相同——有的模型明确禁止商用,下载前看模型页面的 License
  • 共性风险:AI 图不能直接描绘名人肖像、知名 IP 形象(米老鼠、奥特曼)用于商业用途,侵权风险自负

选择建议

  • 自媒体配图、PPT 插图、灵感收集 → Midjourney,省下来的时间值回订阅费
  • 电商作图、固定 IP 形象、批量生产、隐私敏感 → Stable Diffusion,一次部署终身免费
  • 两个都想要 → 先用 MJ 找感觉和构图,再用 SD 精细化复刻和量产

新手最常见的错误是囤了一堆教程不动手。今天就选一个工具,把「一只猫宇航员」的提示词复制过去,发出你的第一张图——手感只能在实操中建立。

评论 (0)

我的头像

还没有评论,快来抢沙发吧~