Midjourney V8 評測,以及值得一試的替代方案
一篇持平的 Midjourney V8 評測:它的美感領先在哪、方案要花多少錢,以及當你需要精準修圖時,OmniArt 上有哪些 Midjourney 替代方案。

任何一篇誠實的 Midjourney V8 評測,都得從 Midjourney 多年來一直做得很好的那件事講起:它做出來的圖,看起來像是有人做過決定。你丟一句又短又含糊的提示詞給它,它還是會回一張色盤想過、光線有意圖、風格連貫的圖。這不是小成就,也解釋了為什麼概念美術、情緒板和專題插畫這一大塊人,到現在還是先打開 Midjourney。
這也解釋了為什麼這麼多團隊最後都是 Midjourney 加上別的東西一起用。同一台有主見的引擎,一次就給你一張漂亮的畫面,但當你需要改的是某一個特定的地方——換一個標籤顏色、修正標題裡的一個字、把一個產品換進既有的場景——它就很難指揮。這篇評測看的是現在 V8 世代的 Midjourney 做得好的地方、它的限制真正咬人的地方,以及 OmniArt 裡哪些替代方案補得上這些缺口。這個框架是刻意的:它們是不同的取捨,不是一份排名。
說明
Midjourney 改版很頻繁,版本行為、方案結構和功能名稱都會隨著發布而變動。下面的細節請當成方向性參考,在投入預算之前,先到 Midjourney 自己的價格頁和文件頁確認當下的狀況。
Midjourney 現在依然做得好的地方
一種能扛住爛提示詞的自家美感
Midjourney 最鮮明的特質,是它的預設輸出本身就已經被藝術指導過。光線傾向電影感、構圖傾向均衡、調色傾向和諧。對於還在探索、而不是在執行一份鎖定簡報的創作者來說,這個偏好是優點。你打一個想法的片段,就能拿到四張值得回應的畫面。
拿它和那些為了照字面執行指令而調校的模型比一比:那些模型會忠實地畫出一段平淡無趣的描述,因為那就是你要求的。Midjourney 用品味把空缺填起來。當你還不知道自己要什麼的時候,品味比服從有用。
整組圖的風格連貫性
參考系統是很多工作室留下來的實際理由。風格參考、角色和主體參考、情緒板和個人化設定檔,讓你把一種調性立好一次,然後產出一整批彼此掛得住的圖。做一副卡牌、一份提案簡報、一本有章節插畫的書,或一份品牌情緒板時,整組的一致性比任何單一畫面都重要。
快速、低摩擦的探索
在 Midjourney 裡迭代,認知成本很低。變體網格、微調對強變體兩種模式、放大、平移和縮放,構成一個你不用重寫提示詞就能跑的迴圈。V7 之後的草稿模式和對話模式在這條路上走得更遠,在你尋找方向的時候,用最終畫質換速度。Midjourney 也延伸到了圖生影片,所以你喜歡的一張靜態圖,不用離開這個工具就能動起來。
Midjourney 的限制在哪裡冒出來
修圖精準度才是真正的天花板
Midjourney 的編輯器涵蓋局部重繪、外擴、區域變體和重新貼材質,這些工具處理得了很大一部分日常修改。它們沒給你的,是確定性、可定址的編輯。你沒有可靠的辦法說「只改這組座標上的那個物件」,也沒辦法把一個確切的十六進位色碼交給模型、然後期待拿回一模一樣的數值,或是畫一個形狀、讓它在那個精確的位置變成你描述的東西。
實務上,這表示在 Midjourney 裡修圖是一場談判。你圈一個區域、描述改動、然後評估它回了什麼——常常會發現周圍的像素漂了、某塊材質被重畫了,或是顏色落在你的品牌色附近而不是落在上面。做探索性的美術,這沒問題。做包裝樣稿、服飾配色、介面示意稿,或任何會被品牌合規人員檢查的東西,這就是成本。
圖片裡的文字
整個領域的字體排版都進步了,Midjourney 生成短單字也比以前好很多。但當一張圖必須承載一句標題、一組圖解標籤、一份菜單,或好幾個位置固定的獨立文字元素時,它還不是你該找的工具。長字串、小字級和非拉丁文字,仍然是它的弱點。
只能訂閱,沒有像樣的免費方案
Midjourney 是一個付費訂閱產品。免費試用幾年前就消失了,也沒有以任何長期形式回來過。方案過去一直分四個級距,從入門大約每月 $10 到最高大約每月 $120,年繳有折扣。這幾個級距的差別主要在三個軸上:
- Fast GPU 時數——每月一份優先生成的額度,愈貴的級距給得愈多。
- Relax 模式——不計量但要排隊的生成,只有中階以上的級距才有。
- 隱私和授權——隱形生成,以及適合較大公司的條款,都在較高的級距上。
這個結構本身很自洽,但它有後果。你不管產出多少都要按月承諾、GPU 時數的帳要另外管,而低階級距的預設是你的作品會出現在公開的動態牆上。工作量起伏很大的團隊——這個月爆量、下個月停擺——付的是平均值,不是實際用量。
流程摩擦與封閉的介面
Midjourney 是在 Discord 裡長大的,雖然現在的網頁版已經是一個能打的主要介面,但那段歷史還看得出來。在 Discord 上生成,代表創作工作住在一個聊天頻道裡,而 Discord 自己的流量限制和審核層就卡在你和你的圖片之間。更重要的是,Midjourney 一直沒有提供通用的公開 API。如果你的產線需要程式化生成、批次任務,或把一個圖片步驟接進自動化流程,Midjourney 不是你能插上去的那顆零件。
注意
在把任何只能訂閱的工具選成主力圖片引擎之前,先確認符合你公司規模的授權條款,以及你的級距有沒有包含私密生成。這些條款各方案不同,也會隨時間改變。
需要修圖控制時,OmniArt 上的替代方案
下面這些模型都做不出 Midjourney 的預設調性,而這正是重點。它們用強烈的自家美感,換來可定址、可重現的控制——而且它們就並排在同一個工作台、共用同一份點數餘額,這會改變你使用它們的方式。
Seedream 5.0 Pro——可定址的區域編輯
Seedream 5.0 Pro 是對 Midjourney 修圖天花板最直接的回答。你不用描述一個改動然後祈禱模型找得到目標;你直接指給它看:一個選取框、一個點、一支箭頭,或一組實際座標。草圖編輯讓你畫一個粗略的形狀或色塊,並描述它在那個精確位置該變成什麼。錨點編輯則在一個很雜的畫面裡鎖住一個很小或很模糊的目標,讓修改落在對的元素上。
它也讀得懂確切的十六進位色碼和具名材質,而不是抓一個接近的色調充數——這就是一份配色樣稿過得了品牌審查和過不了的差別。多圖融合最多吃 10 張參考圖,把它們的物件、風格或材質合成一張輸出,所以一整個資料夾分開拍的商品照,可以變成一張構圖過的靜物。圖層分離則把結果拆成背景加上透明的元素圖層,方便後續重新組合。
取捨是真的:這是一個你去指揮的模型,不是一個幫你做藝術指導的模型。爛提示詞在這裡得到的結果,會比 Midjourney 給你的更爛。我們的 Seedream 5.0 Pro 提示詞指南談了每一種編輯模式的提示詞寫法。
Nano Banana 2——靠參考圖引導的寫實
當簡報偏攝影而不是插畫時——人像、生活情境、材質和光線都要可信的商品主圖——Nano Banana 2 就是你該找的那個。它很擅長靠參考圖引導的編輯,吃得下物件和角色參考,讓一個主體在整組圖裡都認得出來,而且最高可以生到 4K。
它傾向把複雜的指令簡化,也沒有 Seedream 那種座標級的精準度。它給你的是另一種東西:一份通常修更少就能交出去的輸出。
GPT Image 2——自然語言修改和文字排版
GPT Image 2 用對話的方式處理編輯:用平鋪直敘的話描述改動,讓模型自己去解決在哪裡改、怎麼改。這比座標不精準,但處理日常修改快得多,也適合那些寧願用講的、也不想去標註的人。
它勝過 Midjourney 最明顯的地方是文字。當一張圖必須承載一句讀得懂的標題、有順序的圖解步驟、準確的標籤,或幾個位置固定的文字元素時,GPT Image 2 是比較可靠的選擇,輸出最高到 4K。
Qwen Image——便宜又快的打稿
Qwen Image 補的是 Midjourney 草稿模式的那個位置:在一份簡報還不值得動用更貴的模型之前,用低成本快速拿到一個可用的方向。它支援 720p 和 1080p、可重現的 Seed 讓你做受控迭代,也吃多張圖片輸入。把它當成速寫本,不是成品。
依工作挑,不要依品牌挑
| 這件工作 | 合理的首選 |
|---|---|
| 從很薄的提示詞做情緒板和風格探索 | Midjourney |
| 一整組風格統一、有強烈自家調性的插畫 | Midjourney |
| 只改一個區域,同時保護畫面其餘部分 | Seedream 5.0 Pro |
| 精確的品牌十六進位色碼和材質準確度 | Seedream 5.0 Pro |
| 把好幾張商品照組合進同一個場景 | Seedream 5.0 Pro |
| 攝影感的人像和商品主圖 | Nano Banana 2 |
| 必須承載準確、可讀文字的圖片 | GPT Image 2 |
| 用大白話描述的快速修改 | GPT Image 2 |
| 預算有限的大量打稿 | Qwen Image |
| 想按使用量付費,不想每月綁約 | OmniArt 點數 |
最常見也最務實的做法不是取代,而是分工。哪個工具最快給你方向就在哪裡探索,然後把製作端——那些修改、那些配色、那些帶文字的變體、那個影片版本——搬進一個每一步都有對應模型的工作台。因為 OmniArt 的模型共用同一個工作台和同一份點數餘額,這個交接只是換一個模型,而不是一個採購決策。
在 OmniArt 上開始
拿一份你平常會丟給 Midjourney 的簡報,讓它走兩條路。先生出概念畫面,然後試試那個你最後每次都需要的具體修改——把一個產品改成某個確切的十六進位色、在完成的場景裡換掉一個物件,或是加上一句必須拼對的標題。哪一條路用比較少的來回就走到可以發布的素材,你產線的這一段就該歸它。
打開 OmniArt 圖片工作台,用同一組提示詞比較 Seedream 5.0 Pro、Nano Banana 2、GPT Image 2 和 Qwen Image,然後把你通過的那張畫面直接帶進影片,不用在別的地方重建產線。
準備好開始創作了嗎?
用 AI 生成精彩內容