graphic_eq
ProsodyAI
menu
graphic_eqText-to-Speech

Sie führen Regie.
Der Vortrag folgt.

Die meisten Text-to-Speech-Engines lesen Ihre Wörter vor. Diese trägt sie vor — weil Sie in einem Satz sagen, wie er klingen soll, statt ein Modell aus der Zeichensetzung raten zu lassen.

1.000 Premium-Zeichen zum Ausprobieren, gratis. Keine Karte, keine Testfrist.

Regie statt Markup

Sagen Sie in einem Satz, wie es klingen soll

Andere Engines lesen die Satzzeichen und raten eine Stimmung. Deshalb kommt derselbe Satz fröhlich zurück, wenn Sie ihn ernst gebraucht hätten. Hier briefen Sie den Vortrag wie einen Menschen, und beide Engines nehmen dieselbe Anweisung.

  • check_circleIn normaler Sprache: „warm, ohne Eile, wie an der Rezeption“
  • check_circleKein Markup zu lernen — kein SSML, keine Tags, kein Feintuning pro Wort
  • check_circleDieselbe Anweisung funktioniert bei OpenAI und bei Gemini
EIN SATZ, DREI ANWEISUNGENRUHIG, WARMWIE NOTIERTZÜGIG, HELL
Zwei Engines, eine Rechnung

Engine wechseln, ohne Anbieter zu wechseln

OpenAI für die größte Sprachabdeckung, Gemini für Studioqualität in regionalen Stimmen. Sie wählen pro Projekt statt pro Abo.

  • check_circleKein zweites Konto, kein weiterer API-Schlüssel, keine getrennte Rechnung
  • check_circleEin gemeinsames Premium-Kontingent — verbrauchen Sie es dort, wo es passt
  • check_circle59 Sprachen über die zwei Engines
OpenAIGeminiEin Kontoeine Rechnung, ein Schlüssel

Text to Speech mit Emotionen — in Worten verlangt

Beide Engines können begeistert, traurig, warm, angespannt oder amüsiert klingen. Ein Menü mit Voreinstellungen gibt es nicht: Sie schreiben die Emotion in die Anweisung, so genau, wie die Szene es braucht, und die Zeile kommt so gelesen zurück.

sentiment_very_satisfied

Begeistert

„Begeistert, als würden Sie den Gewinner verkünden — schnell, steigend, mit einem Lächeln in der Stimme.“

sentiment_dissatisfied

Traurig

„Traurig und leise, langsam, mit einer Pause vor dem letzten Wort.“

favorite

Warm

„Warm und beruhigend, wie eine Pflegekraft, die den nächsten Schritt erklärt.“

bolt

Angespannt

„Angespannt und dringlich, tiefe Stimme, knappe Sätze.“

Vom Absatz zur fertigen Audiodatei

01

Text einfügen

Zahlen, Datumsangaben, Beträge und Abkürzungen werden vor der Erzeugung in sprechbare Wörter umgeschrieben, damit „24/7“ nicht als Bruch gelesen wird.

02

Engine und Stimme wählen

Auf Wunsch eine Zeile Regieanweisung dazu. Die Zeichenzahl steht auf dem Bildschirm, bevor Sie sich festlegen.

03

Herunterladen oder weitergeben

MP3, WAV oder FLAC je nach Tarif. Oder weitermachen: im Studio über ein Video legen oder per API an Ihre eigenen Systeme geben.

Im kostenlosen Tarif enthalten

Ein einmaliges Kontingent, um beide Engines richtig zu hören, bevor Sie sich entscheiden.

KostenlosBezahlte Tarife
Premium-Zeichen1.000 zum Testen, einmalig100.000 bis 2.000.000 im Monat
Premium-Enginesbeide, solange die Willkommenszeichen reichenOpenAI + Gemini, gemeinsames Kontingent
ExportMP3MP3, WAV, FLAC je nach Tarif
Kommerzielle Lizenz—enthalten

Das Premium-Kontingent ist ein gemeinsamer Topf für OpenAI und Gemini. Sie können es vollständig für die Engine ausgeben, die zum Projekt passt, statt zwei Zähler zu beobachten.

Hören Sie, was Regie ausmacht

Erzeugen Sie dieselbe Zeile einmal zügig und einmal ohne Eile — der Unterschied erklärt sich von selbst. Tausend Premium-Zeichen, ohne Karte.