Et open-source projekt ved navn GPT-SoVITS er i øjeblikket et af de hurtigst voksende på GitHub med 61.276 stjerner og 23 nye stjerner i dag. Værktøjet gør det muligt at træne en tekst-til-tale-model (TTS) med kun ét minut stemmedata, hvilket gør stemmeklonning tilgængelig for langt flere end tidligere.
For beslutningstagere betyder dette, at adgangen til personlig og tilpasset tale-generering er blevet markant billigere og hurtigere. Hvor stemmeklonning tidligere krævede store datasæt og specialiseret viden, kan virksomheder nu eksperimentere med få eksempler på en stemme — eksempelvis til kundeservice, lydbøger eller marketing — uden store investeringer.
Projektet er bygget på Python og er open source, hvilket giver fuld kontrol og fleksibilitet for dem, der ønsker at integrere teknologien i egne systemer. Samtidig rejser det spørgsmål om etik og misbrug, da lavere adgangsbarrierer også gør det lettere at misbruge teknologien til deepfakes eller uautoriseret stemmekopiering.
