Skip to main content
100% Kostenloses Öffentliches Neurales Audio-Studio

Neuronales Sprachstudio

Geben Sie Ihren Text ein und testen Sie Studio-Stimmen in Echtzeit.

Vorlagen:
181 / 2,000
Tonhöhen-Modulation ‱ Tempo / Geschwindigkeit ‱ LautstĂ€rke-VerstĂ€rkung
Ausgabeformat:
Abtastrate:
Architektur & Vocoder-Engine

Studio-Produktionsarchitektur & Neuronale Sprachsynthese

Hochleistungs-Audioworkbench mit latenzfreiem Streaming und deterministischem Cache.

Die OpenTTS Studio-Workbench liefert professionelle Sprachsynthese direkt im Browser – ohne Registrierung, Abonnements oder API-SchlĂŒssel. Dank unserer 2-Stufen-Speicherarchitektur werden wiederkehrende Anfragen in weniger als 1 Millisekunde aus dem Tier-1-RAM-LRU-Cache beantwortet, wĂ€hrend neue Texte sofort in 16-KB-Puffern gestreamt werden.

Unsere Vocoder-Pipeline bildet das gesamte harmonische Spektrum bis 24.000 Hz ab. Sie haben die volle Kontrolle ĂŒber Tonhöhe, Sprechgeschwindigkeit und LautstĂ€rke ohne digitale Verzerrungen.

NatĂŒrliche Pausensyntax

Leitfaden fĂŒr natĂŒrliche Pausensyntax

FĂŒgen Sie lebensnahe Atempausen direkt in Ihr Skript ein – ganz ohne komplizierte SSML-Tags.

Syntax-TagPausendauerKadenz-ÄquivalentEmpfohlenes Szenario
[pause:short]~0,4s – 0,6sKurze Komma-AtempauseSatzglieder, AufzĂ€hlungen und Einleitungen.
[pause:medium]~0,8s – 1,1sSemikolon-DenkpauseGedankenĂŒbergĂ€nge, Themenwechsel und Betonung.
[pause:long]~1,4s – 1,8sAbsatz-PauseSzenenwechsel, ZwischenĂŒberschriften und Kapitelenden.
[pause:Xs] (z.B. [pause:2.5s])Benutzerdefinierte DauerGezielte ZeitpauseMeditation, FolienĂŒbergĂ€nge und Podcast-Intros.
Transkodierung & Mastering

Mastering- & Audio-Export-Spezifikationen

SendefĂ€hige Audiotranskodierung optimiert fĂŒr Streaming, Podcasts und Videoschnitt.

AudioformatContainer-SpezifikationStandard-BitrateAbtastrate (Hz)Optimaler Einsatzzweck
MP3
MPEG-1 Audio Layer III48 kbps / 128 kbps24.000 HzWeb-Streaming, Podcasts, mobile Apps (schnellste Ladezeit).
WAV
Unkomprimiertes 16-Bit Linear PCM768 kbps / 1536 kbps24.000 Hz / 48.000 HzPremiere Pro, DaVinci Resolve, Final Cut Pro Schnitt & Mastering.
OGG
Ogg Vorbis / Opus64 kbps24.000 HzSpiele-Engines (Unity, Unreal Engine), Discord Bots, Web-Audio.
AAC
Advanced Audio Coding (M4A)64 kbps24.000 HzApple-Ökosystem, iOS-Apps, Safari-Streaming.
FLAC
Free Lossless Audio CodecVariabel verlustfrei24.000 HzLangzeitarchivierung und verlustfreie Podcast-Distribution.
Entwickler-Integration

Entwickler-Schnellstart: REST-API-Integration

Generieren Sie Sprache programmgesteuert ĂŒber unsere öffentliche REST-API ohne Authentifizierungs-Header.

cURL-Befehl (Direkte REST-API)200 OK Chunked-Streaming
curl -X POST "http://localhost:8000/api/v1/tts" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Willkommen bei OpenTTS. [pause:medium] Professionelle Sprachsynthese im Studio.",
    "voice": "voice-107",
    "pitch": 0,
    "speed": 0,
    "volume": 100,
    "format": "mp3"
  }' --output output.mp3

HĂ€ufig gestellte Fragen zum OpenTTS Studio

Technische Richtlinien, kommerzielle Rechte und Tipps fĂŒr den Workflow.

Ja! Alle im OpenTTS Studio erstellten Audiodateien sind zu 100% lizenzfrei und fĂŒr die kommerzielle Nutzung auf YouTube, Podcasts und in Apps freigegeben.

Sie können bis zu 2.000 Zeichen pro Einzelanfrage eingeben. LĂ€ngere Texte lassen sich mit [pause:long]-Tags abschnittsweise zusammenfĂŒgen.

OpenTTS steuert Tonhöhe und Tempo unabhÀngig voneinander. Die Tonhöhe Àndert die Frequenz ohne LÀngenÀnderung, das Tempo Àndert die Sprechgeschwindigkeit ohne Micky-Maus-Effekt.

FĂŒr den Videoschnitt empfehlen wir unkomprimiertes 16-Bit 48kHz WAV fĂŒr maximale TonqualitĂ€t.

Zwischengespeicherte Anfragen werden in unter 1 Millisekunde ausgeliefert und spielen sofort ab.