Was macht das Modul Text-to-Speech?
Text-to-Speech von ecomDNAI macht aus Text gesprochene Sprache für Ansagen, Mailbox-Texte und Voice-Bots — mit wählbarer Stimme und Sprache, einer einfachen Stimme mit regelbarer Geschwindigkeit und Tonhöhe oder einer HD-Stimme in natürlichem Tempo, als MP3 oder WAV.
Aus Text wird gesprochene Sprache — Stimme, Sprache, Geschwindigkeit und Tonhöhe stellen Sie selbst ein. Gedacht für Ansagen, Mailbox-Texte und Voice-Bots, die nicht jedes Mal neu eingesprochen werden sollen.
So funktioniert's
- Text eingeben
- Stimme, Sprache, Geschwindigkeit und Tonhöhe einstellen
- Vorlesen lassen und die Audio-Datei übernehmen
Das bekommen Sie
- Gesprochene Audio-Datei
- Auswahl an Stimmen
- Geschwindigkeit und Tonhöhe regelbar
- Mehrsprachig
Typische Anwendungsfälle
Telefonansage in mehreren Sprachen
Sie geben den Ansagetext ein, wählen Sprache und Stimme und hören eine kurze Hörprobe, bevor Sie erzeugen. Die fertige Datei laden Sie als MP3 oder WAV in Ihre Telefonanlage.
Mailbox-Text, der nicht neu eingesprochen werden muss
Ändert sich der Text — Öffnungszeiten, Feiertage, Aktionen —, ändern Sie ihn hier und erzeugen die Ansage neu, mit derselben Stimme wie zuvor.
Aus dem Kundenservice in die Stimme
Antworten aus dem Reply-Assistenten und gespeicherte Textbausteine übernehmen Sie mit einem Klick in Text-to-Voice — für Voice-Bots und Sprachdialoge im Service.
Für wen
Shops und Dienstleister mit Hotline oder Mailbox, Service-Teams, die Ansagen ohne Studio pflegen, und Agenturen, die Sprachdateien für Kunden liefern. Das Modul erzeugt die Audiodatei — eingebunden wird sie in Ihrer Telefonanlage oder Ihrem Bot.
Häufige Fragen
Welche Stimmen gibt es?
Eine einfache Stimme mit regelbarer Geschwindigkeit und Tonhöhe und eine HD-Stimme, die in ihrem natürlichen Tempo spricht. Welche Stimmen für eine Sprache verfügbar sind, zeigt die Auswahl — nicht jede Sprache hat jede Stimme.
Kann ich die Stimme vorher hören?
Ja. Eine kurze Hörprobe ist kostenlos; erst die eigentliche Erzeugung wird abgerechnet — und zwar erst, wenn die Wiedergabe tatsächlich startet.
In welchen Formaten bekomme ich die Datei?
Als MP3 oder WAV zum Herunterladen. Die MP3 trägt eine maschinenlesbare Kennzeichnung als KI-erzeugte Sprache.
Gibt es eine Textgrenze?
Ja; ist der Text länger als erlaubt, bittet das Modul um Kürzung. Längere Ansagen teilen Sie in mehrere Dateien.
Was kostet eine Sprachausgabe?
Jede Erzeugung wird in Credits abgerechnet — über einen Tarif oder Pay-as-you-go; den Bedarf zeigt das Modul vor dem Start. Startet die Stimme nicht, wird nichts berechnet.