MiniMax Music 3 segna un salto di qualità nella generazione musicale con Intelligenza Artificiale, permettendo di creare brani completi fino a cinque minuti partendo da testo e descrizioni dettagliate. Questo modello open-weights può essere eseguito in locale senza dipendere da servizi cloud, offrendo un controllo senza precedenti sulla produzione musicale automatizzata.

La vera innovazione risiede nella capacità di mantenere coerenza strutturale durante tutta la composizione, risolvendo uno dei problemi storici dei modelli text-to-music precedenti. Quando le generazioni si allungavano oltre i due minuti, spesso si verificavano cambiamenti improvvisi di tema, voci inconsistenti e arrangiamenti che perdevano il filo conduttore iniziale. Music 3 affronta questa sfida separando la modellazione della struttura musicale a lungo raggio dalla generazione dei dettagli acustici frame-by-frame.

Per quanto riguarda i linguaggi supportati, lo strumento ne include ben 40, tra cui figura anche l’italiano.

Come funziona MiniMax-Music3

Il sistema produce audio in formato WAV stereo a 32 kHz e 16 bit, supportando testi strutturati con marcatori specifici per ogni sezione del brano.