如何使用 Midjourney?
使用 Midjourney 的基本流程是:在网页版 Create 页面或 Discord 输入提示词,比较生成的候选图,用 Vary、Remix 或 Editor 调整,最后在构图确定后生成 HD 或执行放大并下载。以 V8.1 为例,1:1 的 SD 图片为 1024 × 1024,HD 图片为 2048 × 2048。
资料核对:2026-08-15 · 适用版本:Midjourney V8.1Midjourney V8.1 快速事实
| 项目 | 说明 |
|---|---|
| 当前默认图像版本 | V8.1 |
| 开始生成 | 网页版使用 Create 页的 Imagine 输入栏;Discord 使用 /imagine |
| V8.1 正方形尺寸 | SD:1024 × 1024;HD:2048 × 2048 |
| 典型 GPU 时间 | 四张 SD 约 0.8 分钟;HD 约 1.3 分钟 |
| 常用精修工具 | Vary、Remix、Editor、Pan 与 Zoom Out |
完成这篇教程后,你将能够
- 在 Midjourney 官网或 Discord 中完成第一次生成
- 从候选图中选出方向,并使用变体与编辑工具继续优化
- 合理搭配 SD 与 HD,节省 GPU 时间并导出高质量成图
01 · 输入提示词并生成图像
使用 Midjourney 的第一步是输入提示词,也就是用简短文字描述希望生成的画面。在 midjourney.com 打开 Create 页面,在 Imagine 输入栏中写下描述并按 Enter。一次标准任务会返回四张对同一创意的不同演绎。
在 Discord 中,输入 /imagine 命令,在 prompt 输入项中填写描述后发送。比起很长的指令,清楚的视觉信息更重要。优先写明主体、环境、光线、情绪和构图。
- 网页版——在 Create 页面的 Imagine 输入栏中生成
- Discord——使用 /imagine,并在 prompt 输入项中填写画面描述
- 提示词结构——主体、场景、构图、光线、风格和关键细节
futuristic Tokyo skyline at sunset, cinematic lighting, ultra-realistic, glowing windows, atmospheric haze, wide-angle cityscape
小提示英文视觉短语通常更便于稳定复用,但清晰比长度更重要。先从精简版本开始,只添加真正影响画面的细节。
02 · 选择候选图并继续调整
比较四张候选图,选择最接近目标的一张。网页版打开图片后,可以继续使用 Vary、Remix、Edit 等工具;在 Discord 中,V 按钮会基于所选图片的整体构图与风格,再生成四张细节不同的变体。
在最新版 Discord 流程中,U1~U4 主要用于从四宫格中选出单张图片并显示更多工具,不再等同于旧版的一键放大。小幅调整可使用 Vary (Subtle),希望变化更明显则使用 Vary (Strong);如果整体方向不对,直接修改提示词或重新生成。
- 方向正确时,保留主体与构图,只微调细节
- 每轮只改变一个变量,方便判断是哪项修改改善了结果
- 四张候选图都不合适时,修改提示词或重新运行原任务
小提示把每轮生成当作一次受控对照,而不是要求第一轮就完美,会更容易得到稳定结果。
03 · 编辑、提高分辨率并导出
使用网页版 Editor 可以重绘选中区域、移除不需要的物体、替换背景,也可以通过 Pan 和 Zoom Out 扩展画布。当前编辑器可以组合使用 Remix、局部重绘、平移扩图和向外扩展。编辑完成后要再次检查,因为重新生成的区域可能带来新的细节。
在 V8.1 中,正方形 SD 图片通常为 1024 × 1024 像素,HD 则可直接生成原生 2048 × 2048 图片。Midjourney 当前文档给出的典型消耗是:一组四张 SD 图片约 0.8 GPU 分钟,HD 约 1.3 分钟。对 HD 图进行局部编辑或扩图后可能会回到 SD,因此需要 2K 成图时,应在编辑结束后再次放大。
- 构思和构图阶段先用 SD 快速探索多个方向
- 完成局部修改后,再为最终分辨率消耗额外 GPU 时间
- 海报、印刷等高分辨率用途使用 HD 或放大功能
- 下载前检查人物五官、手部、文字、重复纹理和画面边缘
小提示高效做法是两阶段工作流:先用 SD 筛选多个方案,只对最终候选图切换到 HD。Midjourney 更新后,GPU 消耗和界面名称可能变化。
如何使用 Midjourney:常见问题
下面回答新手从登录、生成到导出时最容易遇到的五个问题。
Midjourney 现在必须使用 Discord 吗?
不必须。你可以登录 midjourney.com,在 Create 页面的 Imagine 输入栏直接生成;也可以继续在 Discord 中使用 /imagine。两种入口使用同一个 Midjourney 账号与订阅。
Midjourney 可以直接使用中文提示词吗?
可以直接输入中文。为了让结果更稳定,建议按“主体、场景、构图、光线、风格、关键细节”的顺序描述,并在每轮只修改一个变量;必要时再保留少量英文摄影或材质术语。
U1~U4 和 V1~V4 有什么区别?
在当前 Discord 流程中,U1~U4 用于从四宫格中选出对应单图并显示后续工具,不会自动提高尺寸;V1~V4 则基于对应候选图再生成一组变体。按钮编号按左上、右上、左下、右下排列。
什么时候用 SD,什么时候用 HD?
构思、试提示词和比较构图时先用 SD,可以更快筛选方向;完成局部编辑并确定最终候选图后再使用 HD 或放大。编辑 HD 图片后可能回到 SD,需要最终 2K 文件时应再检查并放大。
为什么相同提示词每次生成的图片不一样?
生成过程带有随机性,相同文字也可能得到不同构图和细节。需要做对照时,应固定提示词、模型版本和主要参数,并一次只改变一个变量;仍不满意时再调整主体或构图描述。
不要追求一次完美,先建立可重复的过程。
把这篇教程的结构换成你自己的主题,完成一次生成、观察和单变量修改,你就已经在形成个人方法。
现在去实践