Sat Jun 27 2026 20:00:00 GMT-0400 (北美东部夏令时间)
2026 年 Midjourney v7 深度指南:掌握提示词、关键参数与使用限制
在 2026 年,Midjourney v7 大幅提升了图像的连贯性、文本识别和手部细节。本教程将指导您如何使用 --ar, --style, --stylize, 和 --v 7 等高级指令进行提示词编写,高效运行 moodboards,并安全地完成客户项目交付。

Last updated: June 28, 2026
你在 Midjourney v7 中输入了一个提示词,网格图回过来了,而且四个图像中的四个都看起来可以在第一轮使用。这就是改变的地方。v7 是 2026 年中期的当前模型,与 v6 的飞跃更多地体现在连贯性上:物体摆放正确,手上的手指数量更准确,并且如果引用短文本,它也能清晰地渲染出来。
快速答案:什么是 Midjourney v7 以及如何开始?
Midjourney v7 是来自 Midjourney, Inc. 的当前图像模型,可通过 Midjourney web app 和 Discord bot 使用。你通过在提示词后附加 --v 7 来选择它(或将其设置为设置中的默认值)。它为每个任务生成四个候选图像,并保留了你可能已经知道的参数语法:--ar、--stylize、--style raw,以及像 --sref 和 --cref 这样的基于图像的参考。
要从今天下午开始使用,做三件事。打开 web app 或 Discord bot 通道,将 --v 7 设置为你的默认模型,然后运行一个你可以与旧 v6 结果进行比较的提示词。这单一的并排对比比任何规格表都更有说服力。官方 Midjourney documentation 列出了当前的参数集和任何最近的更改。
v7 实际改进了哪些地方?
主要的提升是实用的,而非神奇的。v7 改进了 v6 明显薄弱的地方,而这正是让早期输出感觉不适合客户工作的差距所在。
| Area | v6 behavior | v7 change |
|---|---|---|
| Coherence | Occasional warped or fused objects(偶尔扭曲或融合的物体) | Tighter spatial logic, fewer merged limbs(更紧密的空间逻辑,更少的肢体融合) |
| Text | Mostly garbled letters(大部分是乱码字母) | Short legible words when quoted(引用短词时可读性更高) |
| Hands and anatomy | Frequent extra fingers(经常多余的手指) | Better proportions, still verify(更好的比例,仍需验证) |
| Style control | Strong fixed defaults(强大的固定默认值) | Moodboards, personas, --sref(情绪板、人设、--sref) |
| Speed | One generation path(单一生成路径) | Drafts mode and Omni mode options(草稿模式和 Omni 模式选项) |
在我撰写本文的过程中,我使用 v7 生成了一批大约 60 个提示词——包括肖像、产品模型图和文字密集的海报。保持一致的模式是:连贯性和解剖学需要的重试次数比 v6 少得多,但文本仍然很容易超过两个或三个单词,而长段落依然不可靠。将可读文本视为奖励,而非保证。

如何构建 v7 提示词?
像撰写一份小型简报一样编写提示词:主体,然后是风格,然后是构图,最后是约束条件。v7 对简洁、具体的语言的奖励远高于关键词堆砌。一个清晰的提示词能给模型提供明确的锚点,而将形状和风格的处理留给参数。
当第一次生成至关重要时,请使用以下顺序:
- 用通俗的语言命名主体。
- 添加媒介或风格:电影照片、编辑版水彩画、墨水画。
- 设置构图:特写、俯视、广阔风景。
- 仅在光线和情绪改变结果时添加它们。
- 说明约束条件:无标志,无可读文本,白色背景。
- 最后加上参数:
--ar 16:9 --stylize 250 --v 7。
一个具体的例子是:editorial product photo of a ceramic coffee cup on wet stone, soft morning light, three-quarter view, no text --ar 4:5 --stylize 200 --v 7。这个提示词命名了物体、表面、光线和裁剪,然后将剩下的交给参数处理。关于结构化提示词更广泛的逻辑,我们的 text-to-image AI 指南涵盖了模型间的相同纪律性。
哪些参数很重要:--ar, --style, --stylize, --v 7?
参数是实际引导 v7 的地方。学习四五个,你很少需要更多。
| Parameter | What it does | Example |
|---|---|---|
--v 7 |
Selects the v7 model(选择 v7 模型) | portrait, --v 7 |
--ar |
Sets the aspect ratio(设置宽高比) | --ar 16:9 |
--stylize |
How strongly the model applies its aesthetic(模型应用其美学风格的强度) | --stylize 250 |
--style raw |
Reduces Midjourney's default beautification(减少 Midjourney 的默认美化效果) | --style raw |
--sref |
Pulls style from a reference image URL(从参考图像 URL 拉取风格) | --sref [url] |
--cref |
Keeps a character consistent across jobs(保持角色在不同任务中的一致性) | --cref [url] |
--stylize 是大多数人容易弄错的参数。较低的值(大约 50)会更接近你的字面提示词,看起来更朴素;较高的值(600 到 1000)会推向标志性的 Midjourney 外观,但可能会偏离你的意图。从 100 到 250 开始,并有意识地调整。当 v7 的默认效果对于纪录片或产品框架来说过于精致时,--style raw 非常有用。
为了保持系列的一致性,--sref 和 --cref 比改写提示词更重要。如果你是从现有照片而不是文本开始的,AI Art Generator From Photo 中控制的过程解释了如何在改变风格的同时保持主体可识别。
情绪板和人设(Moodboards and personas)
v7 侧重于情绪板和人设,这对艺术总监和品牌工作来说是真正的流程升级。你不再需要每次都从文字中重建一种外观,而是将参考图像组装成一个情绪板,让模型借鉴它们的调色板、光线和纹理。正是这个功能使得 v7 能够用于连贯的活动系列,而不仅仅是单次拍摄。
- 从 3 到 8 张具有共同情绪的参考图像构建情绪板。
- 为重复的角色或品牌声音保存人设(persona)。
- 将情绪板与
--cref结合使用,以确保场景中的面部一致性。 - 重用同一个情绪板来保持 10 张图像集的视觉统一性。
- 当外观接近完美时,迭代情绪板,而不是提示词。
这也是为什么对于严肃的工作来说,web app 比 Discord 更胜一筹,这一点将在下文介绍。一旦你同时处理的任务超过了几个,组织层级就变得很重要。
Web app 还是 Discord:你在哪里工作?
两者都运行相同的 v7 模型,但它们适合不同的节奏。Web app 是进行组织、情绪板和人设的地方。Discord 是机器人生态系统、移动速度和自动化钩子(hooks)所在的地方。
| Need | Best surface |
|---|---|
| Organizing many jobs and boards(组织大量任务和情绪板) | Web app |
| Mobile prompting on the go(随时随地进行移动提示词输入) | Discord |
| Moodboards, personas, organ view(情绪板、人设、整体视图) | Web app |
| Bots, webhooks, automation(机器人、Webhooks、自动化) | Discord |
对于单个可交付成果,web app 更胜一筹,因为你可以并排比较候选结果,固定一个情绪板,并重试其中一个象限。对于将生成嵌入到工作流程中,Discord 机器人和第三方工具仍然占据优势。如果你想在投入使用前了解 Midjourney 在竞争对手中的位置,AI image tools comparison 和 Adobe Firefly 的分解图描绘了权衡取舍。

限制:文本、手部和许可
要诚实地了解 v7 仍然无法做什么。文本渲染有所改善,但尚未解决:短语引用的词通常可行,句子经常不行,并且你应该在布局工具中添加任何真实的标题或标签。手部和面部虽然有所改进,但在交付之前仍需要进行 100% 的放大检查。
许可(Licensing)是让自由职业者感到困惑的部分。Midjourney 根据其《通用商业条款》,允许付费计划生成的图像用于商业用途,而 Privacy Mode(隐身生成)则要求 Pro 或 Mega 计划。这些条款会变化,所以在向客户收取费用之前,请务必在 Midjourney Help 上确认当前的规则。
- 在全放大倍率下验证手部、眼睛、牙齿和耳朵。
- 在编辑器中添加真实文本,而不是在提示词中。
- 检查是否有虚构的标志或品牌标记。
- 确认你的计划涵盖了商业用途。
- 对于未发布的客户工作,保持 Privacy Mode 开启。
图像完成的机械部分根本不需要生成器。使用专用的 background remover 来裁剪主体,使用 image upscaler 来放大小渲染图,或者使用 AI image editing tools 进行有针对性的修复。将枯燥的编辑交给普通工具,将 v7 保留用于创造新的像素。我们更广泛的 AI art generator 概述框架了这种劳动分工。
可重复的 v7 工作流程
对于一张完成的图像,请遵循以下顺序,并在结果解决了任务后停止重试。
- 写一个包含一句话的简报:主体、情绪、目的地。
- 将该简报转化为带有参数的结构化提示词。
- 生成一个包含四个候选图像的网格图。
- 选择最接近目标,而不是最漂亮的无关图像。
- 在 100% 的放大倍率下检查伪影(artifacts)。
- 进行一次集中的编辑或使用更窄范围的指令进行重试。
- 导出,如果需要添加真实文本,并记录提示词。

这使得 v7 成为一个生产工具,而不是一台老虎机。模型快速提供选项;你的工作是决定哪张图像符合简报、在法律上可用,并且在全分辨率下是正确的。
总结版(The short version)
Midjourney v7 是当前的模型,它在连贯性、解剖学和短文本方面确实优于 v6。使用具体的语言进行提示词输入,用 --ar、--stylize、--style raw 和 --v 7 进行引导,并利用情绪板加上 --sref 和 --cref 来保持系列的一致性。诚实的注意事项是:文本仍然在几个单词后就会失败,手部仍需要放大检查,而商业用途和隐私取决于你的付费计划,因此应在客户交付前确认条款,而不是之后。
图像鸣谢(Image credits)
- Bold colorful abstract expressionist painting with textured brushstrokes — photo by Steve A Johnson on Pexels
- Vibrant abstract artwork with flowing colorful patterns — photo by Steve A Johnson on Pexels
- An art studio desk with brushes and supplies in a creative workspace — photo by Skylar Kang on Pexels
- A designer working at a desk under warm lamp light — photo by Tima Miroshnichenko on Pexels
继续阅读

Tue Mar 24 2026 20:00:00 GMT-0400 (北美东部夏令时间)
如何给照片添加水印以实现版权保护与防盗用
本文将指导您如何为照片添加水印以保护版权。我们将详细介绍各种放置策略,包括角落、平铺和中心淡化等多种选择。同时,我们还会教您高效的batch watermark方法,并探讨如何在实现最佳防盗用效果与保持原始图像高质量之间找到完美的平衡点。

Thu Mar 19 2026 20:00:00 GMT-0400 (北美东部夏令时间)
照片双色调效果创建指南:学习如何为您的图片添加专业级的二色渐变滤镜(Design Guide)
本文将详细指导您如何为照片创建专业的双色调(Duotone)效果。我们将深入探讨双色滤镜的工作原理、推荐的最佳配色方案,并提供在主流工具如Canva、Photoshop和ImageMagick中的具体操作步骤。了解其广泛的应用场景,让您的作品更具艺术感和视觉冲击力。

Thu Mar 12 2026 20:00:00 GMT-0400 (北美东部夏令时间)
图像SEO指南2026:爬取、排名和获得引用
这是一份实用的2026年图像SEO工作流程,涵盖可爬取文件、alt text、文件名、schema、CDN delivery、Core Web Vitals以及GEO visibility。掌握这些关键技术点,确保您的图片内容在搜索引擎中达到最佳可见性。