Neuronales Sprachstudio
Geben Sie Ihren Text ein und testen Sie Studio-Stimmen in Echtzeit.
Studio-Produktionsarchitektur & Neuronale Sprachsynthese
Hochleistungs-Audioworkbench mit latenzfreiem Streaming und deterministischem Cache.
Die OpenTTS Studio-Workbench liefert professionelle Sprachsynthese direkt im Browser â ohne Registrierung, Abonnements oder API-SchlĂŒssel. Dank unserer 2-Stufen-Speicherarchitektur werden wiederkehrende Anfragen in weniger als 1 Millisekunde aus dem Tier-1-RAM-LRU-Cache beantwortet, wĂ€hrend neue Texte sofort in 16-KB-Puffern gestreamt werden.
Unsere Vocoder-Pipeline bildet das gesamte harmonische Spektrum bis 24.000 Hz ab. Sie haben die volle Kontrolle ĂŒber Tonhöhe, Sprechgeschwindigkeit und LautstĂ€rke ohne digitale Verzerrungen.
Leitfaden fĂŒr natĂŒrliche Pausensyntax
FĂŒgen Sie lebensnahe Atempausen direkt in Ihr Skript ein â ganz ohne komplizierte SSML-Tags.
| Syntax-Tag | Pausendauer | Kadenz-Ăquivalent | Empfohlenes Szenario |
|---|---|---|---|
[pause:short] | ~0,4s â 0,6s | Kurze Komma-Atempause | Satzglieder, AufzĂ€hlungen und Einleitungen. |
[pause:medium] | ~0,8s â 1,1s | Semikolon-Denkpause | GedankenĂŒbergĂ€nge, Themenwechsel und Betonung. |
[pause:long] | ~1,4s â 1,8s | Absatz-Pause | Szenenwechsel, ZwischenĂŒberschriften und Kapitelenden. |
[pause:Xs] (z.B. [pause:2.5s]) | Benutzerdefinierte Dauer | Gezielte Zeitpause | Meditation, FolienĂŒbergĂ€nge und Podcast-Intros. |
Mastering- & Audio-Export-Spezifikationen
SendefĂ€hige Audiotranskodierung optimiert fĂŒr Streaming, Podcasts und Videoschnitt.
| Audioformat | Container-Spezifikation | Standard-Bitrate | Abtastrate (Hz) | Optimaler Einsatzzweck |
|---|---|---|---|---|
MP3 | MPEG-1 Audio Layer III | 48 kbps / 128 kbps | 24.000 Hz | Web-Streaming, Podcasts, mobile Apps (schnellste Ladezeit). |
WAV | Unkomprimiertes 16-Bit Linear PCM | 768 kbps / 1536 kbps | 24.000 Hz / 48.000 Hz | Premiere Pro, DaVinci Resolve, Final Cut Pro Schnitt & Mastering. |
OGG | Ogg Vorbis / Opus | 64 kbps | 24.000 Hz | Spiele-Engines (Unity, Unreal Engine), Discord Bots, Web-Audio. |
AAC | Advanced Audio Coding (M4A) | 64 kbps | 24.000 Hz | Apple-Ăkosystem, iOS-Apps, Safari-Streaming. |
FLAC | Free Lossless Audio Codec | Variabel verlustfrei | 24.000 Hz | Langzeitarchivierung und verlustfreie Podcast-Distribution. |
Entwickler-Schnellstart: REST-API-Integration
Generieren Sie Sprache programmgesteuert ĂŒber unsere öffentliche REST-API ohne Authentifizierungs-Header.
curl -X POST "http://localhost:8000/api/v1/tts" \
-H "Content-Type: application/json" \
-d '{
"text": "Willkommen bei OpenTTS. [pause:medium] Professionelle Sprachsynthese im Studio.",
"voice": "voice-107",
"pitch": 0,
"speed": 0,
"volume": 100,
"format": "mp3"
}' --output output.mp3HĂ€ufig gestellte Fragen zum OpenTTS Studio
Technische Richtlinien, kommerzielle Rechte und Tipps fĂŒr den Workflow.
Ja! Alle im OpenTTS Studio erstellten Audiodateien sind zu 100% lizenzfrei und fĂŒr die kommerzielle Nutzung auf YouTube, Podcasts und in Apps freigegeben.
Sie können bis zu 2.000 Zeichen pro Einzelanfrage eingeben. LĂ€ngere Texte lassen sich mit [pause:long]-Tags abschnittsweise zusammenfĂŒgen.
OpenTTS steuert Tonhöhe und Tempo unabhÀngig voneinander. Die Tonhöhe Àndert die Frequenz ohne LÀngenÀnderung, das Tempo Àndert die Sprechgeschwindigkeit ohne Micky-Maus-Effekt.
FĂŒr den Videoschnitt empfehlen wir unkomprimiertes 16-Bit 48kHz WAV fĂŒr maximale TonqualitĂ€t.
Zwischengespeicherte Anfragen werden in unter 1 Millisekunde ausgeliefert und spielen sofort ab.