Midjourney V8 评测,以及真正值得用的替代方案
一份不偏不倚的 Midjourney V8 评测:它的美学优势在哪、订阅要花多少钱,以及当你需要精确编辑控制时,OmniArt 上有哪些 Midjourney 替代模型。

任何一份诚实的 Midjourney V8 评测,都得先说清 Midjourney 多年来一直做得很好的那件事:它出的图看起来像是有人做过决定的。喂给它一句简短、含糊的提示词,它依然会返回一张有讲究的配色、有意图的光线,以及连贯风格感的画面。这不是小成就,也解释了为什么概念设计、情绪板和编辑插画这些领域里,相当一部分人还是先打开 Midjourney。
这同时也解释了为什么这么多团队最后都在 Midjourney 旁边再放一个工具。那个“很有主张”的引擎能一次就给你一张漂亮的画面,但当你需要的只是一处具体改动时,它就很难被指挥——换一个标签颜色、把标题里的一个词改对、把某件产品换进一个已有的场景。这篇评测会看看当前 V8 时代的 Midjourney 做得好的地方、它的限制在哪里真的会咬人,以及 OmniArt 里有哪些模型能补上这些缺口。视角是刻意选定的:这些是不同的取舍,不是一张排行榜。
说明
Midjourney 更新很频繁,版本行为、套餐结构和功能名称都会在不同版本之间变化。请把下面的具体数字当成方向性参考,在投入预算之前,去 Midjourney 自己的价格页和文档确认最新细节。
Midjourney 依然做得好的地方
一套能救回弱提示词的固有美学
Midjourney 最鲜明的特征是它的默认输出本身就已经被艺术指导过了。光线偏电影感,构图偏平衡,调色偏和谐。对于正在探索、而不是在执行一份定死的需求的创作者,这种偏向是优点。你可以只打出一个想法的碎片,就得到四张值得反应的画面。
对比那些为严格遵循指令而调优的模型:你给一段平淡无趣的描述,它就忠实地渲染出平淡无趣的结果,因为那就是你要的。Midjourney 会用品味来填补空白。当你还不知道自己想要什么的时候,品味比听话更有用。
整组图的风格连贯
参考系统是很多工作室留下来的现实理由。风格参考、角色与主体参考、情绪板和个性化配置,让你把一种质感确定一次,然后产出一整组彼此协调的图。对一套卡牌游戏、一份提案演示、一本书的章节插图或一块品牌情绪板来说,整组层面的一致性比任何单张画面都重要。
快速、低摩擦的探索
在 Midjourney 里迭代的心智成本很低。变体网格、轻微与强烈两档变体、放大、平移和缩放构成了一个不需要重写提示词就能持续转动的循环。V7 及之后的草稿模式和对话模式在这个方向上走得更远,在你还在找方向的阶段用成图精度换速度。Midjourney 也已经延伸到图生视频,所以你喜欢的一张静图可以不离开工具就动起来。
Midjourney 的限制在哪里显现
编辑精度才是真正的天花板
Midjourney 的编辑器覆盖了局部重绘、扩图、区域变体和重新贴图,这些工具能处理相当大比例的日常修改。它们给不了你的,是确定性的、可精确定位的编辑。你没有可靠的办法说“只改这个坐标位置上的物体”,也没法把一个精确的十六进制色值交给模型并要求它原值返回,或者画一个形状、让它在那个确切位置变成你描述的物体。
实际上这意味着 Midjourney 的编辑是一场谈判。你遮住一个区域、描述改动,然后评估返回的结果——常常会发现周边像素飘了、某处纹理被重新生成了,或者颜色落在你的品牌值附近而不是正中。对探索性的美术工作,这没问题。对包装效果图、服装配色方案、界面效果图,或者任何会被品牌合规人员逐项检查的东西,这就变成了成本。
图片里的文字
整个领域的文字排版能力都在进步,Midjourney 渲染短词的水平也远好于从前。但当图片必须承载一句标题、一组示意图标注、一份菜单,或者几个位置固定的独立文字元素时,它仍然不是该拿起的那个工具。长字符串、小字号和非拉丁文字依旧是弱项。
只有订阅,没有真正的免费档
Midjourney 是一个付费订阅产品。免费试用几年前就消失了,之后也没有以任何稳定的形式回来。它的套餐历来分四档,从入门档每月约 10 美元到最高档每月约 120 美元,按年付款有折扣。各档之间的差别主要落在三条轴上:
- 快速 GPU 时长 —— 每月一定额度的优先生成时间,越贵的档位给得越多。
- Relax 排队模式 —— 不计量但要排队的生成,只从中间档位起才有。
- 隐私与授权条款 —— 隐身生成和适配较大公司的条款位于高档位。
这个结构是自洽的,但它有代价。你每月都要承诺付费,不管产出多少;GPU 时长的账要额外去管;而低档位的默认设置是你的生成结果会出现在公共作品流里。工作量忽高忽低的团队——这个月很重,下个月停摆——付的是平均值而不是实际用量。
工作流摩擦与封闭的接口
Midjourney 是在 Discord 里长起来的,虽然如今网页端已经是个能打的主界面,历史痕迹仍在。基于 Discord 的生成意味着创作过程活在一个聊天频道里,而 Discord 自己的频率限制和审核层就横在你和你的图之间。更重要的是,Midjourney 一直没有提供通用的公开 API。如果你的流程需要程序化生成、批量任务,或者把一个出图步骤接进自动化流水线,Midjourney 就不是那个能插进去的零件。
警告
在把任何只有订阅制的工具选为主力出图引擎之前,先核对适用于你公司规模的授权条款,以及你所在档位是否包含私密生成。这些条款在不同套餐之间差别很大,也会随时间变化。
需要编辑控制时,OmniArt 上的替代方案
下面这些模型都不会给你 Midjourney 那种默认质感,而这正是重点。它们用一套强烈的固有美学,换来了可定位、可复现的控制力——而且它们彼此相邻,共处一个工作区、共用一份额度余额,这会改变你使用它们的方式。
Seedream 5.0 Pro —— 可定位的区域编辑
Seedream 5.0 Pro 是对 Midjourney 编辑天花板最直接的回答。你不必描述一处改动然后指望模型自己找到目标,而是直接指给它:一个选框、一个点、一个箭头,或者一个具体坐标。草图编辑让你画一个粗略形状或色块,再描述它应该在那个确切位置变成什么。锚点编辑能在一个繁杂的画面里锁定小而含糊的目标,让编辑落在正确的元素上。
它还能读取精确的十六进制色值和有名字的材质,而不是给你一个相近的色调——这正是一张配色效果图能不能过品牌审核的分界线。多图融合最多接受 10 张参考图,把它们的物体、风格或材质合成一张输出,于是一整个文件夹里分别拍摄的产品照可以变成一张构好的静物。图层分离则把结果拆成背景加透明元素图层,方便后续重新组合。
代价是真实存在的:这是一个由你指挥的模型,而不是一个替你做艺术指导的模型。提示词写得弱,出来的结果会比 Midjourney 给你的更弱。我们的 Seedream 5.0 Pro 提示词指南 讲了每种编辑模式对应的提示词写法。
Nano Banana 2 —— 参考引导的写实
当需求偏摄影而不是偏插画时——人像、生活场景、材质和光线都要可信的产品主图——Nano Banana 2 就是该拿起来的那一个。它处理参考引导的编辑很稳,能接受物体和角色参考,让同一个主体在一整组图里都认得出来,输出最高到 4K。
它倾向于把复杂指令简化,也不提供 Seedream 那种坐标级的精度。它换回来的是:输出往往需要更少的后期修图就能交付。
GPT Image 2 —— 自然语言修改与文字排版
GPT Image 2 用对话的方式做编辑:用日常语言描述改动,让模型自己判断改在哪里、怎么改。这比给坐标要不精确,但处理日常修改要快得多,也适合那些宁愿说话也不愿标注的人。
它相对 Midjourney 最明显的优势是文字。当一张图必须承载一句读得清的标题、有顺序的示意图步骤、准确的标注,或者版式固定的多个文字元素时,GPT Image 2 是更靠得住的选择,输出同样可达 4K。
Qwen Image —— 便宜、快速的草稿
Qwen Image 填的是 Midjourney 草稿模式那个位置:在需求还没到值得动用更贵模型之前,用低成本快速拿到一个可用方向。它支持 720p 和 1080p、可复现的随机种子以便做受控迭代,以及多张图片输入。把它当成速写本,不是最终成图。
按任务选,而不是按品牌选
| 要做的事 | 合理的第一选择 |
|---|---|
| 用单薄提示词做情绪板和风格探索 | Midjourney |
| 一整组风格统一、固有质感强烈的插画 | Midjourney |
| 改动一个区域,同时保住画面其余部分 | Seedream 5.0 Pro |
| 精确的品牌十六进制色值与材质准确度 | Seedream 5.0 Pro |
| 把好几张产品照合成同一个场景 | Seedream 5.0 Pro |
| 摄影级人像与产品主图 | Nano Banana 2 |
| 必须承载准确、可读文字的图片 | GPT Image 2 |
| 用日常语言描述的快速修改 | GPT Image 2 |
| 小预算下的大批量打草稿 | Qwen Image |
| 按用量付费而不是每月承诺 | OmniArt 额度 |
最常见的现实配置不是替换,而是分工。在能最快给你方向的工具里探索,然后把生产环节——修改、配色方案、带文字的版本、视频版本——搬进一个每一步都有合适模型的工作区。因为 OmniArt 的模型共享同一个工作区和同一份额度余额,这次交接只是换个模型,而不是一次采购决策。
在 OmniArt 上开始
拿一份你平时会交给 Midjourney 的需求,走两条路各跑一遍。先生成概念画面,然后试试你最后总会需要的那处具体修改——把产品改成一个精确的十六进制色值、把一件物品换进已完成的场景,或者加一句必须拼写正确的标题。哪条路用更少的轮次到达可发布的成品,就让它接管你流程里的这个环节。
打开 OmniArt 图片工作区,用同一条提示词对比 Seedream 5.0 Pro、Nano Banana 2、GPT Image 2 和 Qwen Image,再把你确认的那张画面直接带进视频,不用在别处重搭一遍流程。
准备好创作了吗?
开始用 AI 生成精彩内容