操作笔记
如何运行 MiniMax Music 3.0
1. 官方网页
最快出声。官方 Audio 页当前是 Music-3.0,限免创作 Beta,可上传参考翻唱。入口:minimax.io/audio/music。
2. 官方 API
POST https://api.minimax.io/v1/music_generation。这周要用的模型 ID:
music-3.0— 付费 / Token Plan,RPM 120music-3.0-free— API Key,RPM 3music-cover/music-cover-free— 参考翻唱
传 prompt 和带段落标签的 lyrics;或 is_instrumental: true;或 lyrics_optimizer: true 让模型写词。文档:Music Generation。
3. 本地开源权重
权重:MiniMaxAI/MiniMax-Music3。模型卡:8B 全局 LLM + 0.6B 局部 LLM + Flow Matching,输出 32 kHz 16-bit 立体声 WAV。可用 SGLang-Omni 或 Diffusers。需要 CUDA。
4. ComfyUI
权重上线当天就有 Comfy 支持。看 官方教程 或本站 ComfyUI 页。
结构标签
标签单独成行:[Intro] [Verse] [Pre-Chorus] [Chorus] [Bridge] [Outro] 等。描述建议写成三块:全局元数据、人声细节、编曲。