MiniMax Music 3.0 已上線 SunoMV:音質與人聲雙雙換代,實測出歌不到兩分鐘
MiniMax Music 3.0 已上線 SunoMV:音質與人聲雙雙換代
MiniMax 放出了新一代音樂生成模型 Music 3.0。我們在發布當天完成接上並跑了實測,現在你打開 SunoMV 的創作頁,模型清單裡就能直接選到它——不用等,也不用額外設定。
一、這一代到底升級了什麼
依 MiniMax 官方文件的說法,Music 3.0 的改動集中在三處,而這三處剛好都是過去 AI 生成音樂最容易「露餡」的地方:
1. 語意模型升級,減少「跑偏」。 你寫「深夜、克制、只留一台鋼琴」,上一代很可能給你加滿弦樂。3.0 對創作意圖的還原更準,官方的說法是減少了 AI 生成常見的意圖漂移。對創作者的實際意義是:你少改幾版,風格描述真的會被聽進去。
2. 音質是這次最大的一跳。 官方原話是不再「擠壓、混濁」,並且支援指定具體樂器和真實演奏技法——例如滑音(slide)和圓滑奏(legato)。這代表你可以在風格描述裡寫「電吉他滑音進副歌」,而不只是籠統寫「搖滾」。
3. 人聲引擎換代。 高頻的「數位毛邊」被去掉了,同時把旋律、咬字、換氣、和聲層次都開放成可控項。人聲一直是 AI 音樂裡最容易被聽出來的破綻,這一項的提升最直接影響成品能不能拿去發布。
二、我們的實測數據
接上當天我們用同一段中文歌詞、同一句風格描述(dream pop、女聲、暖色合成器鋪底、90 BPM),分別跑了 3.0 和上一代做對照:
| 生成耗時 | 成品時長 | |
|---|---|---|
| MiniMax 3.0 | 64 秒 | 1 分 49 秒 |
| MiniMax 2.6 | 46 秒 | 1 分 09 秒 |
兩個數字值得說明:
- 生成耗時多了 18 秒,但換來的是完整度更高的成品。 3.0 把同一段歌詞鋪成了接近兩分鐘的結構完整版本,2.6 則收在一分鐘出頭。對做 MV 的人來說,這個差別很實際——歌夠長,畫面才有地方展開。
- 純演奏同樣正常。 不寫歌詞、只給風格描述也能出穩定的純音樂版本,適合做背景樂和轉場。
需要說明的是,音質屬於主觀判斷,上面這組數字只能說明「生成行為」的差異。建議你自己用同一段歌詞各跑一次對比著聽——這是判斷哪個模型更貼你審美最快的方法,也是我們內部選模型時的做法。
三、在 SunoMV 裡怎麼用
SunoMV 的定位不是「再做一個出歌工具」,而是把一句想法變成一支能直接發的音樂影片。Music 3.0 接進來之後,完整路徑是這樣:
- 寫想法或歌詞 —— 只有一句描述也行,AI 會幫你擴寫成完整歌詞
- 選 MiniMax 3.0 —— 在模型清單裡直接選,風格描述裡可以寫具體樂器和演奏技法
- 生成歌曲 —— 一兩分鐘內拿到成品,詞曲同時到位
- 自動配畫面 —— 歌詞按段落拆成分鏡,逐段生成畫面
- 匯出直式 MV —— 直接發 TikTok、Reels、Shorts、YouTube
關鍵在第 4 步:歌只是原料,MV 才是能被演算法分發的成品。 單純出一首歌,你還得自己找畫面、對時間軸、剪輯匯出;SunoMV 把這一整段做完了。
下面這張示意圖,對應的就是上面這條從歌詞到成片的完整路徑:

示意圖:BibiGPT 團隊繪製
四、什麼時候該選它
模型沒有絕對優劣,只有適配場景。就 Music 3.0 而言,這幾類需求最值得優先試:
- 中文歌:MiniMax 在中文咬字和情緒表達上一直是強項,這一代人聲引擎升級後更明顯
- 對樂器有具體要求:想要「鋼琴獨奏進副歌」「電吉他滑音」這類精確控制,3.0 才聽得懂
- 成品要發出去:人聲的高頻毛邊是最容易被聽眾察覺的 AI 痕跡,這一項的改善直接決定成片能不能用
如果你只是想快速出個 30 秒片段試水,清單裡還有更輕更快的選擇;如果要的是能發布的完整作品,Music 3.0 是現在的首選之一。
五、現在就能用
MiniMax Music 3.0 已經在 SunoMV 上線,無需等待、無需申請。 打開創作頁,在模型清單裡選中它,寫下你的第一句歌詞——兩分鐘後你會拿到一首完整的歌,再往下走一步,就是一支可以直接發布的 MV。
上一代 MiniMax 2.6 仍然保留在清單裡,喜歡它的音色可以繼續用。
關於這個模型的完整說明和常見問題,都整理在 MiniMax Music 3.0 功能頁。
Popular guides