MiniMax har udgivet MiniMax-Music3, en open-weigths tekst-til-musik-model, der i én gennemgang kan generere en komplet sang på op til fem minutter. Modellen tager et sæt tekster med sektionsmarkeringer og en struktureret billedtekst som input og producerer en 32 kHz, 16-bit stereo WAV-fil. Det skriver MarkTechPost.

For beslutningstagere i musik-, medie- og underholdningsindustrien er det væsentlige ikke kun, at modellen findes, men at den er open-weigths. Det betyder, at virksomheder kan downloade og tilpasse modellen til egne formål uden at være afhængige af en lukket API – en afgørende faktor for dem, der vil integrere AI-genereret musik i eksisterende workflows eller produkter.

Modellen kan producere hele sange med struktur – vers, omkvæd, bro – hvilket går ud over de korte klip, som tidligere generationer af musikmodeller typisk leverede. Det åbner for brug i alt fra film- og spilmusik til reklamer og podcasts, hvor der er behov for længere, sammenhængende musikalske forløb.

Licensvilkårene er dog en central pointe, før man går i gang. Ifølge artiklen er der specifikke betingelser, der skal overvejes, før man implementerer modellen kommercielt. Det er værd at læse den originale meddelelse for at få detaljerne om, hvad der er tilladt i kommercielle produkter.

For indholdsproducenter og platforme, der ønsker at skalere musikproduktion uden at hyre komponister til hver opgave, kan MiniMax-Music3 være et praktisk værktøj. Men fordi modellen er open-weigths, skal man også selv håndtere infrastruktur, hosting og vedligeholdelse – en overvejelse for dem, der ikke har interne ML-teams.

Alt i alt er MiniMax-Music3 et eksempel på, at AI-musikgenerering bevæger sig fra korte fragmenter til komplette værker, og at open-weigths-tilgangen giver virksomheder kontrol og fleksibilitet, men også kræver teknisk kapacitet.