Midjourney V7 零基础入门:10 个提示词画出专业级 AI 图像
什么是 Midjourney?为什么值得关注?
Midjourney 是当前最强大的 AI 图像生成工具之一,能够通过简单的文字描述生成照片级真实图像、精美插画、概念艺术和产品模型图。自 2022 年首次发布以来,Midjourney 经历了多个大版本的迭代升级,而 2026 年年中发布的 Midjourney V7 更是在逼真度、提示词理解和创意灵活性方面实现了质的飞跃。
与其他需要专业技术背景的 AI 图像生成器不同,Midjourney 的核心优势在于其易用性——完全通过 Discord 和专属网页应用操作——配合其独特的审美倾向,能在开箱即用的情况下生成视觉上极具吸引力的作品。它已成为设计师、营销人员、游戏开发者、建筑师和内容创作者的首选工具,帮助他们快速产出高质量视觉内容,而无需掌握复杂的专业软件。
Midjourney 的独特之处不仅在于原始图像质量,更在于它提供的创意掌控力。从精细的参数调节到风格参考和角色一致性功能,Midjourney 赋予你将创意构思精准转化为视觉作品的能力。本指南假设你从未使用过 Midjourney,将带你从账号注册开始,一步步构建专业级工作流。
Midjourney 上手设置
第一步:选择使用平台
Midjourney 提供两种主要访问渠道,各自适合不同类型的用户。了解二者的差异能帮助你选择最佳起点。
| 平台 | 最适合 | 上手难度 | 核心优势 |
|---|---|---|---|
| Discord | 高级用户、社区互动、批量生成 | 中等 | 完整功能访问、实时社区灵感 |
| Midjourney 网页版(alpha.midjourney.com) | 初学者、可视化浏览、作品库管理 | 简单 | 界面简洁、直观提示词输入、有序图库视图 |
强烈建议初学者使用网页版。它提供清晰直观的界面,在文本框中输入提示词即可立即在图库视图中查看结果,无需记忆 Discord 命令。Discord 界面虽然功能更强大,支持批量操作和社区互动等高级功能,但学习曲线较陡,可能会让新手感到不知所措。随着技能提升,你可以随时切换到 Discord。
第二步:选择订阅方案
Midjourney 是订阅制服务。截至 2026 年,其定价层级覆盖了从偶尔体验的用户到专业制作工作室的各类需求:
| 方案 | 月费 | 快速 GPU 时长 | 放松模式 | 隐身模式 | 最适合 |
|---|---|---|---|---|---|
| Basic(基础) | $10 | 3.3 小时 | 无 | 无 | 试用体验、偶尔使用 |
| Standard(标准) | $30 | 15 小时 | 无限 | 无 | 常规创作者、自由职业者 |
| Pro(专业) | $60 | 30 小时 | 无限 | 有 | 专业人士、设计机构 |
| Mega(旗舰) | $120 | 60 小时 | 无限 | 有 | 高产能制作工作室 |
建议从 Basic 方案 开始熟悉操作。如果发现自己频繁触碰 GPU 时长上限,再升级到 Standard。Standard 及以上方案提供的放松模式本质上是无限生成(仅队列优先级较低),非常适合实验和迭代,无需担心耗尽快速时长。隐身模式(Pro 和 Mega 专属)可让你的生成图片保持私密,对于签有保密协议的商业项目至关重要。
你的前 10 个提示词:掌握基础
Midjourney 提示词的构成
每一个 Midjourney 提示词都可以拆解为三个核心组成部分。理解这一结构将是你需要培养的最重要技能:
[主体与场景] [风格与媒介] [参数]
以下面这个提示词为例:
清晨宁静的山间湖泊,水雾从水面升起,照片级真实,8K,索尼 A7R V 拍摄 --ar 16:9 --v 7
- 主体与场景:"清晨宁静的山间湖泊,水雾从水面升起"——这是核心视觉描述,即图像的内容。
- 风格与媒介:"照片级真实,8K,索尼 A7R V 拍摄"——这定义了呈现方式,即审美品质和艺术手法。
- 参数:
--ar 16:9(宽高比 16:9),--v 7(使用 Midjourney 第七版)——这些是精细调控输出效果的技术开关。
立即尝试的 10 个提示词
按顺序逐一练习这些提示词,每个都引入一个新概念,循序渐进地构建你的技能:
- 简单主体:
一只红狐狸坐在林间空地上,柔和的晨光 - 添加风格:
一只红狐狸坐在林间空地上,柔和的晨光,水彩画风格,细腻笔触 - 添加媒介:
一只红狐狸坐在林间空地上,柔和的晨光,布面油画,厚涂肌理 - 照片级真实:
一位老渔夫在木码头上的肖像,黄金时刻,照片级真实,85mm 镜头,f/1.4,自然光 - 添加宽高比:
赛博朋克城市夜景街道,霓虹灯倒映在湿润路面,电影感灯光 --ar 21:9 - 使用风格参考:
摆放在大理石桌上的甜点拼盘,高级餐厅菜单风格,戏剧性顶光 --ar 1:1 - 产品模型图:
极简香水瓶置于石质展台上,柔和影棚灯光,产品摄影,白色背景 --ar 4:5 - 角色设计:
蒸汽朋克发明家的角色设计图,正面视图、侧面视图、背面视图,精细服装,概念艺术 --ar 16:9 - 建筑可视化:
融入巨型橡树的现代树屋,玻璃幕墙,旋转楼梯,建筑可视化,日光 --ar 16:9 - 抽象艺术:
时间的流动以液态金属形象呈现,抽象艺术,虹彩光泽,8K --ar 3:2
解读生成结果
每次提交提示词后,Midjourney 会以 2x2 网格生成四种不同变体。图像网格下方有一组交互按钮,它们是创作工作流的核心:
- U1、U2、U3、U4:放大(Upscale)——生成该图像的高分辨率版本。这是将一张有潜力的缩略图变为精致成品的关键步骤。
- V1、V2、V3、V4:创建变体(Variations)——基于该图像的风格和构图生成四张新图。这是探索创意方向的主要方式。
- Remix(混音):编辑提示词后重新生成,同时保持原有构图结构。非常适合在不推翻重来的情况下进行迭代优化。
- Pan 和 Zoom(平移与缩放):将图像扩展到原始画框之外,在边缘添加新内容。适用于扩展风景图或调整构图。
最佳实践是:先放大你最喜欢的图像,然后以该放大版本为起点进一步创建变体。这个两步流程——选择,然后精炼——是高效使用 Midjourney 的核心节奏。
掌握 Midjourney 参数
参数是将新手作品与专业级图像区分开来的"秘密武器"。它们以双破折号(--)附加在提示词末尾,让你能精确控制 Midjourney 如何解读你的描述。
核心参数一览
| 参数 | 用途 | 示例 | 效果 |
|---|---|---|---|
--ar | 宽高比 | --ar 16:9 | 设置输出图像的宽高比例 |
--v | 模型版本 | --v 7 | 使用最新、能力最强的 Midjourney V7 模型 |
--q | 质量 | --q 2 | 更高的细节水平,代价是生成速度较慢 |
--s | 风格化 | --s 750 | 控制 Midjourney 艺术风格的应用强度(范围:0-1000) |
--c | 混沌度 | --c 50 | 控制四张输出之间的差异程度(范围:0-100) |
--no | 负面提示词 | --no text, watermark | 从生成图像中排除指定元素 |
--iw | 图像权重 | --iw 2 | 控制参考图像的影响强度(范围:0-3) |
各参数的使用时机
- 高风格化(
--s 750-1000):最适合艺术性、插画风或奇幻类图像,让 Midjourney 尽情发挥创意。模型会以更大的自由度来诠释你的描述。 - 低风格化(
--s 50-250):最适合照片级真实图像、产品模型图,或任何准确性重于艺术性的场景。模型会更贴近你的字面描述。 - 高混沌度(
--c 70-100):用于头脑风暴阶段,希望从一个提示词中获得截然不同的解读。非常适合发现意想不到的创意方向。 - 低混沌度(
--c 0-20):当你已有明确构想,希望多次生成的结果保持稳定一致时使用。 - 高图像权重(
--iw 2-3):在使用参考图且希望输出与其构图、色彩和主题高度匹配时使用。
进阶技巧:风格参考与图像提示
风格参考(--sref)
风格参考功能在 V6 中引入并在 V7 中得到显著优化,让你可以上传一张图片,指示 Midjourney 采纳其精确的美学风格。这是在项目全过程中保持视觉一致性的最强大功能之一。
如何使用风格参考:
- 将图片上传到 Discord 或网页版。
- 复制图片链接。
- 在提示词中添加
--sref [链接]。
示例:黄昏时分的未来城市天际线 --sref https://example.com/style-reference.jpg --v 7
Midjourney 会从参考图中提取色彩方案、光影风格、纹理质感和构图倾向,并将它们应用到你的提示词中。这一功能对于跨系列营销图像保持品牌一致性,或为创意项目建立统一的视觉语言极为有效。
角色参考(--cref)
与风格参考类似,但专为在多个图像中保持角色一致性而设计。上传一张角色参考图,Midjourney 会在后续提示词中匹配面部特征、身体比例和服装风格。
示例:一位巫师在黑暗森林中释放闪电魔法 --cref https://example.com/character-sheet.jpg --v 7
这一功能对于漫画艺术家、故事板创作者、游戏设计师以及任何需要在多个场景中保持角色一致的视觉叙事创作来说不可或缺。
图像提示(混合模式)
你可以直接使用图像作为提示词的一部分。Midjourney 会将其作为构图起点,将图像中的视觉信息与你的文字描述进行融合:
[图片链接1] [图片链接2] 两种风格的融合,照片级真实 --ar 16:9
图片链接放在最前面,随后是文字描述。这一技巧特别适用于组合多张参考图的元素,或使用粗略草图作为精致渲染的基础。
常见新手错误及修正方法
| 错误 | 原因 | 修正方法 |
|---|---|---|
| 提示词过长 | 试图详尽列举每个细节 | 将提示词控制在 60 词以内。Midjourney 更擅长处理聚焦而富有感染力的描述,而非面面俱到的清单。让模型自行补全合理的细节。 |
| 忽视宽高比 | 对所有图像使用默认的 1:1 | 思考图像的最终用途。社交媒体:1:1 或 4:5。桌面壁纸:16:9。手机壁纸:9:16。印刷品:4:5 或 3:2。始终使用 --ar 参数。 |
| 风格词汇冲突 | 在同一提示词中混合"照片级真实"和"动漫风格" | 每个提示词坚持一个主要风格方向。如需风格融合,使用图像参考(--sref)而非在文字层面相互矛盾,后者会让模型困惑。 |
| 忘记使用负面提示词 | 结果中出现不需要的文字、水印或伪影 | 始终扫描生成结果中的常见瑕疵并加入 --no。一个可靠的默认设置:--no text, watermark, signature, low quality。 |
| 不进行迭代 | 将第一轮生成结果视为最终图像 | 优秀的 Midjourney 作品几乎都经过 3-5 轮变体迭代和精炼。将第一轮生成视为草图,而非成品。 |
构建专业级 Midjourney 工作流
掌握基础后,采用以下可重复的六步工作流来持续产出专业级结果。这一流程已被众多依赖 Midjourney 交付客户作品的设计师和创意总监广泛采用:
- 明确需求简报:在打开 Midjourney 之前,先写下目标、目标受众、所需尺寸,以及三个描述理想美学的形容词。清晰的定位能避免漫无目的地试错。
- 生成 3-5 个提示词变体:对同一核心主题尝试不同的风格描述词、艺术家参考和参数组合。系统化的变量测试能揭示真正有效的方向。
- 选定最佳方向:从初始批次中选出最接近你构想的那张图。相信自己的直觉——最能打动你的那张通常就是正确的起点。
- 迭代三轮:使用变体按钮(
V按钮)进行精炼。每轮之后根据哪些有效哪些无效来微调提示词。小而精准的改动胜过全盘重写。 - 放大与增强:满意后放大最终图像。对于关键项目,将放大后的图像导入外部 AI 放大工具(如 Topaz Gigapixel)进行 4 倍分辨率增强,且不损失画质。
- 最小化后期处理:在 Photoshop 等传统编辑器中裁剪、调整对比度或添加文字叠加。对 AI 生成图像进行过度编辑往往会削弱其独特的美学魅力。目标是锦上添花,而非推倒重来。
结语
Midjourney 是一门技能,而非一个魔法按钮。新手作品与专业作品之间的差距归结为三点:提示词的精准度、参数的控制力,以及持续迭代的意愿。用一周时间练习本指南中的 10 个提示词,逐个测试每个参数的效果。坚持练习 30 天,你就能创作出三年前需要专业摄影或插画委托才能实现的图像作品。
工具已在手中。从第一个提示词开始——林间空地上的那只红狐狸——看看 Midjourney 会带你走向何方。