Lektion schreiben, eine Stimme von OpenAI oder Gemini wählen und sie im Studio über Bildschirmaufnahmen oder Folien legen — mit eingebrannten Untertiteln oder als .srt. Ändert sich das Produkt, erzeugen Sie eine Zeile neu, statt ein Modul neu aufzunehmen.
1.000 Premium-Zeichen zum Ausprobieren, gratis. Keine Karte, keine Testfrist.
Bis zu 5.000 Zeichen pro Erzeugung, etwa fünf Minuten Sprechtext. Zahlen, Daten, Einheiten und Abkürzungen werden vorher in Wörter umgewandelt; „3,5 kg“ und „Q4“ klingen, wie ein Trainer sie lesen würde.
„Ruhig und klar, für Einsteiger“, „zügig, für ein Produkt-Update“. Eine Stimme und eine Anweisung für den ganzen Kurs — jedes Modul klingt nach demselben Trainer.
Die Stimme über eine Bildschirmaufnahme oder einen als Bilder exportierten Foliensatz legen — bis zu zwanzig Folien werden ein vertontes Video, getaktet nach der Stimme. Bis zu acht Sprachclips passen in ein Video.
Untertitel ins Video einbrennen oder als .srt-Datei für den Player Ihres LMS herunterladen. Export in 720p oder 1080p.
Kurse ändern sich nach der Veröffentlichung. Die Vertonung sollte der einfach zu ändernde Teil sein.
Eine Funktion wurde umbenannt? Zeile ändern, neu erzeugen, einsetzen. Kein Studiotermin, kein Angleichen an die alte Aufnahme.
Das übersetzte Skript einfügen und dasselbe Modul in einer von 59 Sprachen vertonen; der Schnitt bleibt gleich.
Bis zu zwanzig Bilder werden ein vertontes Video; jede Folie steht so lange, wie ihr Anteil an der Stimme dauert.
Eingebrannt oder als separate Datei — für Barrierefreiheit und für alle, die ohne Ton schauen.
In bezahlten Tarifen vertont die Stapelverarbeitung bis zu 500 Zeilen pro Auftrag und liefert sie als benannte Dateien in einem ZIP.
Eine REST-API mit Webhooks für Teams, die die Vertonung in ihre Autorenstrecke einbauen.
Besser vor der Anmeldung wissen als danach.
| ProsodyAI | |
|---|---|
| Das Skript übersetzen | Nein — die Übersetzung bringen Sie mit; die Stimmen sprechen 59 Sprachen |
| SCORM- oder xAPI-Pakete | Nein — Sie exportieren Video, Audio und .srt und fügen sie in Ihr Autorentool oder LMS ein |
| Ihre eigene aufgenommene Stimme | Nein — Sie wählen aus fertigen Stimmen von OpenAI und Gemini |
| Lange Quellvideos | Bis zu 20 Minuten pro hochgeladenem Video in bezahlten Tarifen, 5 Minuten im kostenlosen |
Ja. Die bezahlten Tarife enthalten die kommerzielle Lizenz, und das erzeugte Audio gehört Ihnen — für bezahlte Kurse ebenso wie für interne Schulungen.
Eine Minute Sprechtext sind grob 800–900 Zeichen. Die 100.000 Premium-Zeichen von Starter im Monat sind etwa zwei Stunden, die 400.000 von Creator etwa acht, die 1.000.000 von Studio etwa zwanzig. Der Schnitt im Studio verbraucht keine Zeichen.
Ja. Sie wählen eine Stimme mit Namen, und sie liest jede Lektion; Modul zwölf klingt wie Modul eins. Die Anweisung ändert die Art des Vortrags, nicht den Sprecher.
Es erzeugt Standarddateien — MP4-Video, MP3- oder WAV-Audio und .srt-Untertitel —, die jedes LMS und jedes Autorentool annimmt. SCORM-Pakete erstellt es nicht.
Ja. Ein neues Konto startet mit einmalig 1.000 Premium-Zeichen, ohne Karte — genug, um den Anfang einer Lektion in beiden Engines zu hören. Das Studio ist in jedem Tarif enthalten.
Eine Lektion einfügen, in beiden Engines anhören, über Ihre Folien legen. 1.000 Premium-Zeichen zum Testen, ohne Karte.