Midjourney从入门到精通:提示词、参数与实战技巧全解
2026/9/17 16:41:33 网站建设 项目流程

简介:面向零基础用户的Midjourney AI绘图入门教程,以docx文档形式系统讲解从注册Discord账号到正式使用Midjourney绘图的完整操作流程。教程先从Discord与Midjourney的关系入手,解释Midjourney没有独立客户端、需要搭载在Discord中使用的基本逻辑,再逐步演示账号注册时的出生日期选择、邮箱验证、人机验证、个人服务器创建等细节,并提示共享账号官方认可、可放心使用。随后详细介绍如何查找并加入Midjourney官方服务器,包括再次人机验证等易出错环节,同时补充说明Midjourney服务器的主要功能与AI绘图技术基础。内容紧扣实际操作中的常见问题,适合希望快速上手AI绘画、对海外平台不熟悉的读者。资源为单个Word文档,8.3MB,格式清晰,便于阅读、打印或对照操作。已有721人学习下载,教程步骤完整且配有说明,零基础用户也能顺利搭建绘图环境,开启AI绘图之旅。

1. 从一句描述到一张可用图,Midjourney 到底帮你省了什么

你大概已经见过那些让“甲方看了沉默、同行看了流泪”的 AI 绘图作品,也听人说过 Midjourney 只要输入几个英文单词就能生成海报级画面。但真到自己上手时,大概率会遇到这些情况:出图风格完全不受控、人脸崩坏、想要“赛博朋克城市”却得到一堆霓虹灯废土、想用自家产品图做底图却怎么都融合不进去。这些问题的根源往往不是工具不行,而是你对 Midjourney 的工作方式和提示词语法缺一套系统认知。

Midjourney 的本质不是“AI 画师”,而是一台运行在 Discord 上的多模态生成引擎。它以文本提示词为输入,通过扩散模型在潜空间迭代去噪,最终输出 1024x1024 像素(默认)的位图。这个“输入一段文本 → 选择迭代方向 → 细化得到成品”的流程,才是它和其他 AI 绘图工具最大的区别。本教程会从账户准备开始,带你走完从注册、写提示词、控制参数到产出可用素材的全流程,直接对着操作即可。

2. Midjourney 运行环境与账户准备:从零开始的第一条生成命令

2.1 为什么 Midjourney 必须跑在 Discord 里

Midjourney 没有独立客户端,它所有的交互都在 Discord 服务器内完成,通过斜杠命令(Slash Command)与机器人交互。这意味着你首先要有一个 Discord 账号,然后把 Midjourney 机器人拉进你自己的服务器,这样才能在私人频道里不受打扰地生成图片。

这样做的好处在于:Discord 的频道结构天然适合做团队协作。你可以建一个“设计评审”频道,把 Midjourney 机器人拉进去,所有人共享同一个生成记录;也可以建多个频道分别跑“人物设定”“场景概念”“材质测试”,每个频道拥有独立的生成历史。这种工作流对个人创作者和设计团队都适用。

2.2 注册与订阅:没有付费版基本没法用

Midjourney 提供免费试用额度,但额度非常少(大约 25 次生成),而且生成速度极慢,排队现象严重。因此实际使用时通常需要订阅。订阅入口在https://www.midjourney.com/account,或直接在 Discord 里输入:

/subscribe

这个命令会返回一个带链接的消息,点击进入订阅页面。Midjourney 提供三档 Plan:Basic(10 美元/月,约 200 张图/月)、Standard(30 美元/月,无限慢速生成 + 15 小时快速生成)、Pro(60 美元/月,更高并发与隐私模式)。对于重度使用者,Standard 是性价比最高的选择。

提示:常有用户问“Midjourney 促销码怎么获得”。官方会不定期在社交媒体和邮件推送优惠,但第三方渠道发布的促销码来源不明,不建议使用——轻则订阅失败,重则账号被标记风险。直接在官网订阅最稳妥。

2.3 最小可用命令:imagine 与 U/V 操作

完成订阅后,在 Discord 中输入:

/imagine prompt: a red apple on a wooden table, soft lighting

回车后机器人会返回 4 张网格图。这 4 张图下方有两行按钮:

  • U1~U4:Upscale,放大对应编号的图
  • V1~V4:Variation,以对应图为基础生成变体

第一次跑通这个流程,你的 Midjourney 使用就算入门了。接下来我们要做的是把你从“能出图”提升到“能稳定出想要的图”。

提示:如果提示Invalid parameter,检查/imagine是否被识别为命令而非普通文本。在 Discord 里输入斜杠/后会自动弹出命令列表,选择imagine再输入prompt:即可。

3. 提示词结构拆解:写出一段能稳定出图的 prompt

3.1 提示词的五个基础要素

Midjourney 的提示词不是自然语言作文,而是“要素的排列组合”。经过大量测试,业内形成了一个相对稳定的结构:

要素作用示例
主体画面核心对象a red fox
环境场景与背景in a snowy forest
光照光影氛围golden hour lighting
材质/风格渲染质感octane render, cinematic
构图视角与镜头close-up shot, shallow depth of field

实践中最容易犯的错误是“一句话场景式描述”,把提示词写成一整段散文。正确做法是把要素用逗号分隔,每个词组独立可替换,这样便于后续做 A/B 测试。

以“一只穿着宇航服的柴犬”为例,拆分写法如下:

/imagine prompt: a shiba inu wearing a spacesuit, standing on the moon, earth in the background, cinematic lighting, volumetric fog, ultra detailed --ar 16:9

这里--ar 16:9是比例参数,指定输出横屏宽幅。逐项来看:主体是shiba inu wearing a spacesuit,环境是moonearth in background,光照是cinematic lightingvolumetric fog,风格强调是ultra detailed。这种写法比“一只狗在月球上穿着宇航服”清晰得多,出图的可控性也随之提升。

3.2 风格修饰词与权重控制

在 Midjourney v6 中,提示词末尾的艺术风格词对结果的影响非常大。常见的有效风格词包括:

  • cinematic:电影感,强调光影对比
  • editorial photography:杂志摄影感,构图精致
  • isometric:等距视角,适合 UI 图标和建筑示意
  • 3d render, pixar style:三维渲染,圆润可爱
  • watercolor:水彩质感
  • cyberpunk:赛博朋克,霓虹色调

权重控制的核心语法是双冒号::。例如:

/imagine prompt: a futuristic city::2 cyberpunk style::1 blue tone::0.5 --ar 21:9

这个提示词表示“未来城市”的权重为 2,“赛博朋克风格”为 1,“蓝色调”为 0.5。权重越高,该要素对最终图像的影响越大。注意权重不能为负值(v6 已移除.5以内的负权重功能),通常 0.5 到 3 这个区间最有效。

3.3 常见失败案例与修正策略

第一类:主体偏了。你写a cat and a dog,结果画面里只有猫或比例失调。解决办法是把其中一个要素的权重调高:a cat::2 and a dog::1,或者直接拆分生成再合成。

第二类:风格模板化。如果你在提示词末尾加了一堆trending on artstation, 8k, hyperrealistic,结果图反而显得油腻、像廉价壁纸。建议只保留 1~2 个风格词,并且优先选择“可描述性”强的词,如golden hourlong exposure,而不是空泛的beautiful

第三类:文字乱码。想让图中出现标语或品牌名时,Midjourney 经常拼错。这不是你的问题——Midjourney 本身对文字生成的支持较弱。如果必须出带文字的图,建议用--style raw(v6 可用)降低风格化干预,或先生成无文字背景图,再用 Photoshop 或 Figma 叠加文字。

提示:v6 版本默认对提示词有更强的理解力,但仍建议把主体放置在提示词前 5 个词内——越靠前的词,模型对其的权重越高。

4. 进阶场景实战:从 niji 模式到垫图与迭代参数

4.1 niji 模式:日本动漫与二次元风格

如果你画的是日漫风、轻小说插画或者二次元角色,通用的 v6 模型表现并不理想。此时需要切换到 niji 模式,这是 Midjourney 专门针对动漫风格训练的子模型:

/settings

在弹出的面板里选择Niji Mode,或者直接在/imagine命令中添加--niji 6参数:

/imagine prompt: anime girl with silver hair, blue eyes, school uniform, cherry blossoms in background, soft pastel colors, detailed eyes --niji 6

niji 模式在“眼睛细节”“头发层次”“线条干净度”上明显优于默认模型。它同样支持风格化参数,例如--stylize 200表示更强的风格化表现,适合让画面更华丽;--stylize 50则更忠实于提示词本身的描述。

4.2 垫图(Image Prompt):把参考图融入生成流程

Midjourney 最强悍的能力之一是基于参考图生成新图。在提示词中图片链接必须放在最前面:

/imagine prompt: https://example.com/ref_image.jpg a cyberpunk character, similar composition, different outfit and hair color --ar 2:3

图片链接的来源可以是网络图片,也可以是之前生成的 Midjourney 结果。操作方式是在 Discord 中右键目标图片,选择“复制链接”,粘贴进 prompt。注意链接后必须紧跟文本描述,不要留多余空行或符号。

还有一种常见需求是“我想让 A 图的脸型搭配 B 图的服装”。这时可以传入两张图,用权重区分:

/imagine prompt: imgA.jpg imgB.jpg a character, face from first image, clothing from second image, full body shot

这里系统会自动融合两张图的信息,文本提示词负责告诉模型“取谁的特征”。

4.3 融合与变化:Blend 命令

如果不想写任何文字,只想把两张图揉在一起,可以用:

/blend

这个命令会弹出两个图片上传框,上传后直接输出混合结果。它适合快速尝试颜色、构图的融合,但可控性比“垫图+文本描述”弱很多。做正式项目时建议优先使用完整 prompt 方式。

4.4 科研绘图场景中的 Midjourney 使用技巧

“科研绘图 ai”这个词最近热度很高,但很多科研工作者把 Midjourney 用错了方向。论文配图(如示意图、流程图、机理图)需要的是精确和可编辑,而 Midjourney 生成的是位图,难以直接用于论文出版的矢量图中。

正确做法是:用 Midjourney 生成概念参考图,即你想要的画面构图、配色和氛围,然后交给 PPT 或 Illustrator 手动绘制。提示词可以这么写:

/imagine prompt: schematic diagram of lithium battery charging process, isometric view, clean white background, blue and orange color scheme, minimalist 3d render style --no text --style raw

关键参数是--no text消除图中文字干扰,--style raw降低“艺术滤镜感”。这样出的图可以作为架构参考,而不是直接投稿的最终图片。

5. 常用参数全表与迭代策略:让每一版都比上一版好

5.1 参数速查表

参数取值范围作用最佳实践
--ar任意宽高比,如16:92:3控制画面比例头像用1:1,封面用16:9,竖版海报用2:39:16
--stylize0~1000(v6)控制艺术化程度默认 100;要精确实体用 50,要艺术氛围用 250+
--chaos0~100控制结果的多样性探索灵感用 50~80,交付合规图用 0
--seed随机整数固定初始噪声,保证可复现同一 seed + 同 prompt 出图结果趋同
--no负向词排除特定元素--no text, watermark, people
--tile无参数生成无缝纹理用于背景图、布料纹理、游戏素材
--iw0.5~2.0(v6)控制参考图影响程度数值越高,越忠于参考图;无参考图时该参数失效

5.2 seed 值的妙用:稳定迭代的工作流

你花了半小时调出一个 90% 满意的构图,只是需要换个配色。此时随机碰运气效率太低,正确做法是锁定 seed 后只修改关键词。

/imagine prompt: a futuristic city skyline at sunset --ar 21:9 --seed 12345

得到结果后,记录满意的一张图的 seed 值,接着微调:

/imagine prompt: a futuristic city skyline at night, neon lights --ar 21:9 --seed 12345

同样的 seed 保证了初始噪声一致,画面主体结构、构图基本相同,只有你修改的“晚上+霓虹灯”发生变化。这个流程在 icon 设计、分镜脚本、游戏场景迭代时极其好用。

提示:获取一张已生成图片的 seed 有几种方式。最简单的是在 Discord 消息上点击添加反应,选择信封表情(✉️),机器人会私信你完整生成信息,包括 seed 值、提示词和所有参数。

5.3 Remix 模式:变体不再是小修小补

默认模式下点击 V1~V4 会在原图基础上做“同质化微调”,比如改个表情、换个光影角度,但很难大幅度改变内容。打开 Remix 模式后,点击 V 按钮会允许你修改提示词,从而实现真正的“换衣不换人、换景不换人”。

打开 Remix 的方法:

/settings

在弹出面板中找到Remix Mode并点击启用。之后每点一次 V1,系统会弹出一个 prompt 编辑框,你可以保留或重写提示词。比如原图是“穿红色裙子的女孩在咖啡厅”,你可以把提示词改成“穿黑色皮衣的女孩在酒吧”,构图和人物姿态会被保留,但服装和环境完全更换。

5.4 角色一致性方案:固定人物脸型

Midjourney 官方在 v6 中推出的角色一致性参数是--cref(Character Reference):

/imagine prompt: a woman walking on the street, cinematic lighting --cref https://example.com/face_ref.jpg --cw 100

--cw的范围是 0~100,控制角色特征(脸、发型、服装)的保持程度。数值越低,越只保留脸部特征;数值高则连服装风格也想保持。

不过要清醒认识它的边界:--cref能保持“同一张脸”去做不同场景和动作,但不能保证服装、细节高度一致。如果你需要严格的商品图级别一致性(如同一模特穿三套衣服),更可靠的是先生成一张干净的人像图,再用 PS 换装,或搭配--iw 2提高参考图权重。

6. 从生成到落地:放大、精修与常见问题的快速排查清单

6.1 高清放大不是直接 U 就完了

很多用户把 U 按钮理解为“高清化”,实际上 U 只是增加了原始分辨率下的细节重绘。如果你想要海报级大图,需要用 Midjourney 的外链到其他放大工具,或利用/describe功能反推提示词后到其他平台去重绘。

Midjourney 自带的放大命令是/upsample(部分版本为/zoom/custom_zoom),其中:

/upsample 2x

表示放大两倍并重构细节。注意:放大后画面可能会丢失部分细节,如果放大后脸部出现变形,优先检查原图是否已足够清晰,而不是反复放大同一张图。

6.2 图生图的最佳接棒姿势

Midjourney 生成的图默认有极高的“审美下限”,但如果你要对细节做精确修改(例如产品去logo、背景替换),Midjourney 并不是这类任务的最优解。常见做法是你先用 Midjourney 出“创意底盘”,然后在 SD(Stable Diffusion)或 Photoshop(配合 AI 填充)里完成局部修图。对于大部分设计需求,Midjourney 占 70% 的创意工作流,剩下 30% 交给传统工具处理,效率远高于在 Midjourney 里死磕局部修改。

6.3 常用排错命令速查

症状原因处理方法
生成结果全是模糊艺术照提示词没有明确主体,或风格词过多删掉至少一半风格词,突出主体和构图词
文字乱码或拼写错误Midjourney 对文字支持弱使用--no text排除文字,后期用设计工具补字
人脸结构崩坏、眼距异常可能是图片经过多次上采样检查 seed 是否丢失、图片是否被压缩,回到干净的原始图重连
生成速度极慢免费额度耗尽或处于慢速模式查看账户 Plan;排队高峰时段(国内 20:00~24:00)慢速概率最高
想要“类似这张图”的效果你没有描述参考图/describe上传参考图,让系统反推提示词后微调使用

6.4 给常用工作流的一点点自动化建议

如果你的使用频率很高,建议把高频提示词片段存成“提示词模板块”,例如:

环境模板:golden hour, backlit, atmospheric haze 材质模板:octane render, subsurface scattering, 8k texture 构图模板:wide-angle shot, rule of thirds, negative space

每次写提示词时直接拼接主体词+环境模板+材质模板+比例参数。这种方式比每次从头写更稳定,也更便于团队内统一视觉风格。Midjourney 支持的/describe命令也可以让你反向拆解喜欢的图,快速搭建模板库。

本文还有配套的精品资源,点击获取

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询