Et nyt open-source-projekt, Voice-Pro, er hastigt stigende i popularitet på GitHub med 53 stjerner på en enkelt dag og i alt 11.648 stjerner. Værktøjet samler en række centrale AI-lydfunktioner i én Gradio-baseret webgrænseflade: tekst-til-tale (TTS) via Edge-TTS og kokoro, zero-shot voice cloning med E2- og F5-TTS samt CosyVoice, lydbehandling med Whisper, YouTube-download, vokalisolering med Demucs og flersproget oversættelse.
For beslutningstagere og kreative teams betyder det, at man kan opbygge komplette lydarbejdsgange – fra klipning og stemmekopiering til oversættelse – i ét værktøj, uden at være afhængig af en enkelt kommerciel udbyder. Især kombinationen af zero-shot voice cloning og vokalisolering kan være interessant for content-produktion, dubbing og lokalisering, hvor man tidligere skulle investere i flere specialiserede løsninger.
Selvom projektet er open source og dermed kræver teknisk opsætning, er det værd at følge for dem, der vil forstå, hvor markedet for AI-lyd er på vej hen: mod åbne, modulære værktøjer, der kan tilpasses egne behov. Den originale GitHub-repo giver flere detaljer om funktioner og installation.
