Schreiben Sie das Intro, den Werbeeinspieler oder die ganze Folge, wählen Sie eine Stimme von OpenAI oder Gemini und sagen Sie in eigenen Worten, wie sie klingen soll. Dann legen Sie sie im Studio auf ein Cover oder auf Ihr Material und exportieren einen Videopodcast — ohne Sprecherkabine.
1.000 Premium-Zeichen zum Ausprobieren, gratis. Keine Karte, keine Testfrist.
Bis zu 5.000 Zeichen pro Erzeugung — etwa fünf bis sechs Minuten Sprache. Längere Folgen werden in Teilen vertont und im Studio verbunden; Zahlen, Daten und Abkürzungen werden vorher in sprechbare Wörter umgewandelt.
„Locker, wie im Gespräch mit Freunden“, „Late-Night-Radio“, „klar und ruhig für einen Nachrichtenüberblick“. Dieselbe Anweisung funktioniert bei beiden Engines; Sie hören zwei Fassungen, bevor Sie wählen.
MP3 in jedem Tarif; bezahlte Tarife bieten zusätzlich verlustfreies WAV. Die Datei geht so, wie sie ist, an Ihren Podcast-Host oder in Ihren Editor.
Die Podcast-Vorgabe im Studio liefert 16:9, 1080p, 256 kbps Audio und −16 LUFS — über einem Cover, einer Diashow oder Ihrem eigenen Material, auf Wunsch mit eingebrannten Untertiteln.
Kein Ersatz für einen Host mit Meinung. Eine Stimme für die Teile, die jede Woche gleich klingen sollen.
Dieselbe Stimme, derselbe Vortrag, jede Folge. Einen Satz ändern, neu erzeugen — der Rest bleibt, wie er war.
Der Text des Sponsors ändert sich; der Vortrag muss nicht auf den nächsten Aufnahmetermin warten.
Geschichte, True Crime, Erklärformate und vorgelesene Newsletter — ein Sprecher, Zeile für Zeile gesteuert.
Die Sätze jedes Sprechers mit einer anderen Stimme erzeugen und bis zu acht Sprachclips auf eine Studio-Zeitleiste legen.
Das übersetzte Skript einfügen und dieselbe Folge in einer von 59 Sprachen vertonen.
Einen Moment schneiden, kräftige Untertitel dazu, 9:16 für Shorts und Reels exportieren — mit derselben Stimme.
Besser vor der Anmeldung wissen als danach.
| ProsodyAI | |
|---|---|
| Aus einem Dokument ein Gespräch zweier Hosts machen | Nein — es vertont das Skript, das Sie schreiben; den Dialog erfindet es nicht |
| Ihre eigene aufgenommene Stimme | Nein — Sie wählen aus fertigen Stimmen von OpenAI und Gemini |
| Eine echte Aufnahme schneiden | Nein — für mehrspurigen Schnitt echter Gespräche braucht es einen vollwertigen Audio-Editor |
| Für Sie beim Podcast-Host veröffentlichen | Nein — Sie laden die Datei herunter und veröffentlichen sie selbst |
Ja. Das erzeugte Audio gehört Ihnen, und die bezahlten Tarife enthalten die kommerzielle Lizenz — gesponserte Folgen und Werbeeinspieler eingeschlossen. Die kostenlose Testphase ist zum Anhören, nicht zum Veröffentlichen.
Eine Minute Sprache sind grob 800–900 Zeichen. Die 100.000 Premium-Zeichen von Starter im Monat ergeben etwa zwei Stunden Audio, die 400.000 von Creator etwa acht. Der Schnitt im Studio zieht nichts vom Zeichenkontingent ab.
Beide Rollen schreiben Sie selbst. Die Sätze jedes Sprechers mit einer anderen Stimme erzeugen und der Reihe nach auf die Studio-Zeitleiste legen; bis zu acht Clips passen in ein Video. Einen Knopf, der das Gespräch für Sie schreibt, gibt es nicht.
Manche ja, manche nein; der Vortrag ist gesteuert statt flach, und gerade das verrät eine synthetische Stimme meistens. Sagen Sie es trotzdem — in den Shownotes, dass die Stimme erzeugt ist.
Ja. Ein neues Konto startet mit einmalig 1.000 Premium-Zeichen, ohne Karte — genug, um Ihr Intro in beiden Engines zu hören.
Einfügen, in beiden Engines anhören, die Fassung behalten, die nach Ihrer Show klingt. 1.000 Premium-Zeichen zum Testen, ohne Karte.