KI-Stimme (RVC)
Umwandlung in eine trainierte Zielstimme — die Stimme steckt im Modell, nicht im Programm.
Achtung: Das KI-Stimmpaket ist nicht Teil der App. Es ist ein
separater Download (PyTorch, 2–3 GB) und wird mit voice/build.sh gebaut.
Ohne das Paket funktioniert alles andere ganz normal.
Modelle
.pth-Modell hinzufügen, dazu — wenn vorhanden — die.index-Datei mit demselben Namen. Sie macht das Ergebnis deutlich ähnlicher.- Fertige Modelle gibt es z. B. auf weights.gg oder Hugging Face; eigene trainiert man mit dem RVC-WebUI.
Einstellungen
| Wert | Bedeutung |
|---|---|
| Tonhöhe | Halbtöne vor der Umwandlung (m→w meist +12, w→m meist −12) |
| Ähnlichkeit | Wie stark die Klangfarbe des Modells zieht |
| Qualität | Schnell (~0,4 s) · Mittel (~0,7 s) · Beste (~1,2 s) |
Hinweis: Für lockeres Sprechen ist der Charakter-Modus die bessere Wahl — er hat kaum Verzögerung.
Rechte
Ein Stimmmodell bildet eine echte Person ab. Nutze nur Stimmen, für die du die Erlaubnis hast — deine eigene oder eine ausdrücklich freigegebene.