MiniMax Music 2.6:生成有歌詞的完整歌曲
學會在 OmniArt 上用 MiniMax Music 2.6,把一組風格提示詞和歌詞變成一首完整的歌——人聲、分層樂器編排,還有懂曲風的混音。

多數 AI 音樂工具給你的是一段循環。MiniMax Music 2.6 給你的是一首歌——主歌、副歌、橋段,還有一段真的有強弱起伏的人聲演唱。2.6 版在 2026 年 4 月推出,比前一版有更飽滿的低頻、更自然的人聲演繹,以及更快的初次生成。它在 OmniArt 上免費方案就能用,每首 40 點數,而且就放在你已經在用的圖片和影片工具旁邊。這份指南教你怎麼寫風格提示詞和歌詞,把一個空白文字框變成一首你真的用得上的成曲。
MiniMax Music 2.6 怎麼運作
這個模型吃兩種輸入:一組描述你想要的聲音世界的風格提示詞,以及一段選填的、分好段落的歌詞區塊。它把兩者一起處理,輸出一首完整的曲子——不是循環——內建人聲、分層的樂器編排,以及懂曲風的混音。
2.6 這一代改進的是實務上最重要的幾個地方:低音更溫暖也更有輪廓、人聲演唱會用自然的顫音和情緒塑形而不是平鋪直敘,而且模型更快就跑到一份可用的草稿。MiniMax 這個家族在寫實 AI 人聲上一直有口碑;2.6 又加上了會回應你提供的歌詞結構的樂句處理。
歌詞是選填的。不寫的話,模型就只憑風格提示詞生成純樂器音樂。兩條路下面都會講到。
風格提示詞的詞彙
風格提示詞是你定下聲音方向的地方。MiniMax Music 2.6 對精確、有層次的描述反應很好。從四個面向把你的提示詞建起來:
曲風與次曲風
一開始就要具體。"Lo-fi hip-hop" 比 "hip-hop" 好;"cinematic orchestral" 和 "orchestra" 落點完全不同。好用的詞:indie pop、dark ambient、synthwave、R&B ballad、neo-soul、folk acoustic、Latin trap、jazz fusion、post-rock、chillout electronic。
情緒與情感方向
把你想讓聽眾抵達的那個感覺說出來。有效的詞:melancholic、uplifting、tense、nostalgic、euphoric、intimate、cinematic、playful、brooding、hopeful、anthemic。
速度與能量
你沒有 BPM 控制項,所以用語言描述速度:slow-burning、mid-tempo groove、driving rhythm、relaxed pulse、pulsing and urgent、gentle and unhurried。
樂器編排與質地
把撐起這首曲子的聲音列出來。可用的詞:warm electric piano、fingerpicked acoustic guitar、punchy drum machine、lush string pads、sub bass、muted trumpet、shimmering reverb guitar、808 kick、close-mic piano、airy synth pads。
人聲風格
描述你要的演唱方式:female lead with warm alto、breathy indie vocal、raspy male lead、harmonized background vocals、conversational delivery、belted chorus、whispered verse。
一組把這五項都寫進去的風格提示詞,等於給了模型一份清楚的簡報。含糊的那種("relaxing music")產出含糊的結果。
用段落標記安排歌詞結構
MiniMax Music 2.6 用段落標記來理解一首歌在哪裡換結構。每一段都用方括號包起來:
[verse]——敘事段落,能量比較低,負責鋪陳[chorus]——記憶點,情緒最強,會重複[bridge]——打破主歌/副歌循環的段落,製造對比[pre-chorus]——往副歌堆疊,選填[outro]——收尾段落,可以重複副歌或漸漸收掉
歌詞就照真實歌曲的方式寫。押韻結構、句子長度和文字密度,都會影響模型怎麼唱它們。主歌歌詞密一點適合比較慢、比較著墨的唱法;副歌裡短而有力的句子則帶動前進的動能。
小技巧
實作範例
範例一:給短影音開場的 indie pop
風格提示詞:
Indie pop, nostalgic and warm, mid-tempo groove, fingerpicked acoustic guitar with light electric piano, soft drum machine, female lead with breathy delivery, harmonized background vocals in the chorus, airy reverb tail throughout.
歌詞:
[verse]
Coffee going cold beside the window seat
Morning light is slipping through the leaves
I keep the photos in a box below the bed
Hold onto the versions of us I never said
[chorus]
We were golden, we were almost right
Dancing slow through an ordinary night
Golden, almost right
I'd do it all again if I could
[bridge]
Maybe that's enough, to have held it for a while
Maybe that's enough, to have meant it when I smiled
這個組合給你一首柔和、帶懷舊感的曲子,適合影片剪輯集錦、產品開場或 Podcast 片頭。稀疏的編排留下了空間,讓你在上面疊對白或旁白。
範例二:給社群剪輯用的品牌能量音樂
風格提示詞:
Upbeat electronic pop, euphoric and driving, pulsing synth bass, punchy four-on-the-floor kick, shimmering synth pads, short instrumental drops, anthemic energy, no lead vocals — instrumental only.
歌詞: (留空——純樂器模式)
拿它來做 Reels、產品揭曉剪輯,或精華剪輯——這些地方需要音樂扛住能量,又不能和畫面上的文字互相搶。風格提示詞裡那句 "no lead vocals — instrumental only" 就算沒有歌詞,也會再強化模型走純樂器這條路。
範例三:給創作者專案的 R&B 曲子
風格提示詞:
Contemporary R&B, intimate and late-night, slow-burning mid-tempo, warm sub bass, Rhodes electric piano, brushed snare, male lead with smooth tenor delivery, conversational verse and belted chorus, lush string pads in the bridge.
歌詞:
[verse]
Caught me off guard with a message at midnight
Said you've been thinking and you don't know why
I've been here doing the same thing, you know
Watching the city lights flicker and go
[pre-chorus]
Tell me what you're holding back
I've got time, I've got patience, and I've got your back
[chorus]
Stay a little longer in the conversation
Don't rush the feeling, let it find its way
Stay a little longer
We don't need a reason
Just you, just me, just the end of the day
[bridge]
There's something quiet in the space between us
Something neither of us wants to name
But here we are
Here we are
分好的段落標記給了模型清楚的線索:低能量的主歌、往上堆的導歌、一段開闊而重複的副歌記憶點,還有一段用短促句子製造對比的橋段。這會做出一首可以當短片內容、品牌敘事背景,或創作者單獨發表用的曲子。
純樂器模式
把歌詞欄位留空(或切到純樂器模式),就是告訴模型只憑風格提示詞生成一首完整的曲子。純樂器的曲子很適合:
- Podcast 片頭和片尾——定調,又不會讓歌詞和說話聲互相打架
- 影片背景鋪底——墊在對白或旁白底下,不會分散注意力
- 品牌與產品短片——快切和轉場的地方,歌詞聽起來只會像雜訊
- 氛圍與 lo-fi 內容——長時間聆聽,不會有人聲疲勞
在純樂器模式裡,作曲的工作全部由風格提示詞承擔,所以請多花點時間在它身上。把具體的樂器、質地和你要的曲式弧線都寫出來——"builds from sparse piano to full arrangement" 或 "stays minimal throughout, no percussion."。模型會尊重這些方向性的提示。
說明
MiniMax Music 2.6 在創作者工作流裡
社群內容與短影音
每一批影片生成一首自己的曲子,不要重複用曲庫音樂。一首 40 點數、對得上簡報的曲子——曲風對、能量對、長度對——效果比一首「差不多可以」的罐頭音樂好。要在上面疊文字或旁白的 Reels,就走純樂器那條路。
影片與 Podcast 製作
在同一個工作階段裡,把音樂生成和 OmniArt 的其他音訊、影片工具搭在一起用。用 MiniMax Speech 系列的模型生一段旁白、用 MiniMax Music 2.6 生一段背景音樂,然後把兩者剪到影片上——全程不用離開平台。那條工作流的旁白那一半,請看 YouTube 影片的 AI 旁白。
品牌音樂
品牌音樂——5 秒的開場音、給著陸頁用的 15 秒循環、給廣告用的 30 秒曲子——流程都一樣。寫一組描述品牌性格(不只是曲風)的風格提示詞,生三四個版本,挑一個合的。你不是被綁在單一一首曲庫音樂上;只要簡報一變,隨時可以重新生成。
它跟 OmniArt 上其他音樂模型比起來如何
OmniArt 的音訊工作台裡有三個音樂模型。每一個各贏一種簡報:
| 模型 | 支援歌詞 | 點數 | 最適合 |
|---|---|---|---|
| MiniMax Music 2.6 | 是 | 40 | 有人聲的完整歌曲;各種曲風;也能做純樂器 |
| ElevenLabs Music | 是 | 150 | 結構清楚、懂段落、編曲豐富的音樂 |
| Google Lyria 3 Pro | 否 | 20 | 高品質的純樂器和電影配樂 |
只要簡報牽涉到人聲演唱或一首完整的歌,MiniMax Music 2.6 就是預設起點。想用低成本拿到高品質的電影感純樂器配樂,Lyria 3 Pro 是對的選擇。編曲結構和段落還原度比點數更重要的簡報,就交給 ElevenLabs Music。
想在音樂之外一併處理音效、環境音和旁白,請看音訊模型總覽。
在 OmniArt 上開始
打開音訊工作台,切到音樂分頁。選 MiniMax Music 2.6,用上面那套詞彙寫一組風格提示詞,想要人聲的話就貼上分好段落的歌詞。生兩三個版本、聽過一輪,再替下一輪打磨提示詞。從一份粗略簡報到一首可用曲子之間,通常只差一兩次迭代——提示詞寫得好的話,模型的輸出已經很接近成品,主要的工作是挑,而不是修。
準備好開始創作了嗎?
用 AI 生成精彩內容