Tutorial教學與操作指南閱讀時間 13 分鐘

MiniMax Music 2.6:生成有歌詞的完整歌曲

學會在 OmniArt 上用 MiniMax Music 2.6,把一組風格提示詞和歌詞變成一首完整的歌——人聲、分層樂器編排,還有懂曲風的混音。

OmniArt 團隊
MiniMax Music 2.6:生成有歌詞的完整歌曲

多數 AI 音樂工具給你的是一段循環。MiniMax Music 2.6 給你的是一首歌——主歌、副歌、橋段,還有一段真的有強弱起伏的人聲演唱。2.6 版在 2026 年 4 月推出,比前一版有更飽滿的低頻、更自然的人聲演繹,以及更快的初次生成。它在 OmniArt 上免費方案就能用,每首 40 點數,而且就放在你已經在用的圖片和影片工具旁邊。這份指南教你怎麼寫風格提示詞和歌詞,把一個空白文字框變成一首你真的用得上的成曲。

MiniMax Music 2.6 怎麼運作

這個模型吃兩種輸入:一組描述你想要的聲音世界的風格提示詞,以及一段選填的、分好段落的歌詞區塊。它把兩者一起處理,輸出一首完整的曲子——不是循環——內建人聲、分層的樂器編排,以及懂曲風的混音。

2.6 這一代改進的是實務上最重要的幾個地方:低音更溫暖也更有輪廓、人聲演唱會用自然的顫音和情緒塑形而不是平鋪直敘,而且模型更快就跑到一份可用的草稿。MiniMax 這個家族在寫實 AI 人聲上一直有口碑;2.6 又加上了會回應你提供的歌詞結構的樂句處理。

歌詞是選填的。不寫的話,模型就只憑風格提示詞生成純樂器音樂。兩條路下面都會講到。

風格提示詞的詞彙

風格提示詞是你定下聲音方向的地方。MiniMax Music 2.6 對精確、有層次的描述反應很好。從四個面向把你的提示詞建起來:

曲風與次曲風 一開始就要具體。"Lo-fi hip-hop" 比 "hip-hop" 好;"cinematic orchestral" 和 "orchestra" 落點完全不同。好用的詞:indie popdark ambientsynthwaveR&B balladneo-soulfolk acousticLatin trapjazz fusionpost-rockchillout electronic

情緒與情感方向 把你想讓聽眾抵達的那個感覺說出來。有效的詞:melancholicupliftingtensenostalgiceuphoricintimatecinematicplayfulbroodinghopefulanthemic

速度與能量 你沒有 BPM 控制項,所以用語言描述速度:slow-burningmid-tempo groovedriving rhythmrelaxed pulsepulsing and urgentgentle and unhurried

樂器編排與質地 把撐起這首曲子的聲音列出來。可用的詞:warm electric pianofingerpicked acoustic guitarpunchy drum machinelush string padssub bassmuted trumpetshimmering reverb guitar808 kickclose-mic pianoairy synth pads

人聲風格 描述你要的演唱方式:female lead with warm altobreathy indie vocalraspy male leadharmonized background vocalsconversational deliverybelted choruswhispered verse

一組把這五項都寫進去的風格提示詞,等於給了模型一份清楚的簡報。含糊的那種("relaxing music")產出含糊的結果。

用段落標記安排歌詞結構

MiniMax Music 2.6 用段落標記來理解一首歌在哪裡換結構。每一段都用方括號包起來:

  • [verse]——敘事段落,能量比較低,負責鋪陳
  • [chorus]——記憶點,情緒最強,會重複
  • [bridge]——打破主歌/副歌循環的段落,製造對比
  • [pre-chorus]——往副歌堆疊,選填
  • [outro]——收尾段落,可以重複副歌或漸漸收掉

歌詞就照真實歌曲的方式寫。押韻結構、句子長度和文字密度,都會影響模型怎麼唱它們。主歌歌詞密一點適合比較慢、比較著墨的唱法;副歌裡短而有力的句子則帶動前進的動能。

小技巧

副歌的句子請保持簡短且重複。模型把重複當成「這裡要加強演唱」的訊號——一段有重複記憶點的副歌,會比每一句都塞新資訊的副歌更有力道。

實作範例

範例一:給短影音開場的 indie pop

風格提示詞:

Indie pop, nostalgic and warm, mid-tempo groove, fingerpicked acoustic guitar with light electric piano, soft drum machine, female lead with breathy delivery, harmonized background vocals in the chorus, airy reverb tail throughout.

歌詞:

[verse]
Coffee going cold beside the window seat
Morning light is slipping through the leaves
I keep the photos in a box below the bed
Hold onto the versions of us I never said

[chorus]
We were golden, we were almost right
Dancing slow through an ordinary night
Golden, almost right
I'd do it all again if I could

[bridge]
Maybe that's enough, to have held it for a while
Maybe that's enough, to have meant it when I smiled

這個組合給你一首柔和、帶懷舊感的曲子,適合影片剪輯集錦、產品開場或 Podcast 片頭。稀疏的編排留下了空間,讓你在上面疊對白或旁白。


範例二:給社群剪輯用的品牌能量音樂

風格提示詞:

Upbeat electronic pop, euphoric and driving, pulsing synth bass, punchy four-on-the-floor kick, shimmering synth pads, short instrumental drops, anthemic energy, no lead vocals — instrumental only.

歌詞: (留空——純樂器模式)

拿它來做 Reels、產品揭曉剪輯,或精華剪輯——這些地方需要音樂扛住能量,又不能和畫面上的文字互相搶。風格提示詞裡那句 "no lead vocals — instrumental only" 就算沒有歌詞,也會再強化模型走純樂器這條路。


範例三:給創作者專案的 R&B 曲子

風格提示詞:

Contemporary R&B, intimate and late-night, slow-burning mid-tempo, warm sub bass, Rhodes electric piano, brushed snare, male lead with smooth tenor delivery, conversational verse and belted chorus, lush string pads in the bridge.

歌詞:

[verse]
Caught me off guard with a message at midnight
Said you've been thinking and you don't know why
I've been here doing the same thing, you know
Watching the city lights flicker and go

[pre-chorus]
Tell me what you're holding back
I've got time, I've got patience, and I've got your back

[chorus]
Stay a little longer in the conversation
Don't rush the feeling, let it find its way
Stay a little longer
We don't need a reason
Just you, just me, just the end of the day

[bridge]
There's something quiet in the space between us
Something neither of us wants to name
But here we are
Here we are

分好的段落標記給了模型清楚的線索:低能量的主歌、往上堆的導歌、一段開闊而重複的副歌記憶點,還有一段用短促句子製造對比的橋段。這會做出一首可以當短片內容、品牌敘事背景,或創作者單獨發表用的曲子。

純樂器模式

把歌詞欄位留空(或切到純樂器模式),就是告訴模型只憑風格提示詞生成一首完整的曲子。純樂器的曲子很適合:

  • Podcast 片頭和片尾——定調,又不會讓歌詞和說話聲互相打架
  • 影片背景鋪底——墊在對白或旁白底下,不會分散注意力
  • 品牌與產品短片——快切和轉場的地方,歌詞聽起來只會像雜訊
  • 氛圍與 lo-fi 內容——長時間聆聽,不會有人聲疲勞

在純樂器模式裡,作曲的工作全部由風格提示詞承擔,所以請多花點時間在它身上。把具體的樂器、質地和你要的曲式弧線都寫出來——"builds from sparse piano to full arrangement" 或 "stays minimal throughout, no percussion."。模型會尊重這些方向性的提示。

說明

如果你在風格提示詞裡描述了人聲風格、卻把歌詞留空,模型仍然可能生出一首以人聲為主、帶無字人聲或哼唱旋律的曲子。要避免這件事,在你確定要純樂器輸出時,就在風格提示詞裡明確寫上 "instrumental only" 或 "no vocals"。

MiniMax Music 2.6 在創作者工作流裡

社群內容與短影音

每一批影片生成一首自己的曲子,不要重複用曲庫音樂。一首 40 點數、對得上簡報的曲子——曲風對、能量對、長度對——效果比一首「差不多可以」的罐頭音樂好。要在上面疊文字或旁白的 Reels,就走純樂器那條路。

影片與 Podcast 製作

在同一個工作階段裡,把音樂生成和 OmniArt 的其他音訊、影片工具搭在一起用。用 MiniMax Speech 系列的模型生一段旁白、用 MiniMax Music 2.6 生一段背景音樂,然後把兩者剪到影片上——全程不用離開平台。那條工作流的旁白那一半,請看 YouTube 影片的 AI 旁白

品牌音樂

品牌音樂——5 秒的開場音、給著陸頁用的 15 秒循環、給廣告用的 30 秒曲子——流程都一樣。寫一組描述品牌性格(不只是曲風)的風格提示詞,生三四個版本,挑一個合的。你不是被綁在單一一首曲庫音樂上;只要簡報一變,隨時可以重新生成。

它跟 OmniArt 上其他音樂模型比起來如何

OmniArt 的音訊工作台裡有三個音樂模型。每一個各贏一種簡報:

模型支援歌詞點數最適合
MiniMax Music 2.640有人聲的完整歌曲;各種曲風;也能做純樂器
ElevenLabs Music150結構清楚、懂段落、編曲豐富的音樂
Google Lyria 3 Pro20高品質的純樂器和電影配樂

只要簡報牽涉到人聲演唱或一首完整的歌,MiniMax Music 2.6 就是預設起點。想用低成本拿到高品質的電影感純樂器配樂,Lyria 3 Pro 是對的選擇。編曲結構和段落還原度比點數更重要的簡報,就交給 ElevenLabs Music。

想在音樂之外一併處理音效、環境音和旁白,請看音訊模型總覽

在 OmniArt 上開始

打開音訊工作台,切到音樂分頁。選 MiniMax Music 2.6,用上面那套詞彙寫一組風格提示詞,想要人聲的話就貼上分好段落的歌詞。生兩三個版本、聽過一輪,再替下一輪打磨提示詞。從一份粗略簡報到一首可用曲子之間,通常只差一兩次迭代——提示詞寫得好的話,模型的輸出已經很接近成品,主要的工作是挑,而不是修。

準備好開始創作了嗎?

用 AI 生成精彩內容

免費開始