모델 도구
MiniMaxAI/MiniMax-Music3
HFHugging Face
MiniMax Music 3는 가사와 음악 설명을 받아 최대 5분짜리 완성곡을 만드는 음악 생성 모델입니다.
세 줄 요약
- 8B Global LLM과 0.6B Local LLM, Flow Matching, Flow-VAE로 32 kHz 16-bit stereo WAV를 생성합니다.
- 가사에는 [Verse], [Chorus] 같은 섹션 태그를, 음악 설명에는 장르, BPM, 키, 보컬, 편곡을 지정합니다.
- CUDA가 필요하고, 스트리밍 없이 생성되며, 텍스트 프롬프트 5,000 토큰, 오디오 9,000 acoustic frames로 제한됩니다.
MiniMax Music 3는 가사와 음악 설명을 받아 최대 5분짜리 완성곡을 만드는 음악 생성 모델입니다.