bghira's picture
Add converted MiniMax Music 3 audio VAE
fce0d00 verified
|
Raw
History Blame Contribute Delete
742 Bytes
metadata
library_name: diffusers
pipeline_tag: text-to-audio
base_model: MiniMaxAI/MiniMax-Music3
tags:
  - minimax-music-3
  - audio-vae
  - diffusers
  - simpletuner

MiniMax Music 3 Audio VAE

This repository contains the MiniMax Music 3 DAV audio autoencoder converted to a Diffusers-style component for SimpleTuner.

The converted component is stored in audio_vae/ and can be loaded with MiniMaxMusic3DAV.from_pretrained(repo_id, subfolder="audio_vae") from SimpleTuner.

This is the continuous waveform autoencoder used for VAECache and waveform decode. It is not the RVQ tokenizer, Qwen3 language model, RVQ depth decoder, or flow transformer from the full MiniMax Music 3 pipeline.

Source weights: MiniMaxAI/MiniMax-Music3 dav.pth.