Free Text-To-Speech for 28+ languages & MP3 Download
Kostenloser Text-zu-Stimme-Übersetzer für 28+ Sprachen sowie MP3-Download – damit die KI-gestützte Audioverarbeitung effizienter und einfacher wird.
Tags:KI-Audio-ToolsWas ist ttsMP3?
ttsMP3 ist ein Online-Dienst zur Umwandlung von Text in Sprache, der von EPSILON WEBCRAFTS LLC betrieben wird. Die Nutzer können eine Stimme auswählen, den Text eingeben, anschließend einen Vorschau-Audio-Clip anhören und das MP3-File herunterladen – ohne dass ein zusätzliches Software-Programm installiert werden muss.
Die Plattform teilt die herkömmlichen Stimmen von den KI-Stimmen in zwei separate Konverter auf. Die zugrunde liegenden Anbieter, die Steuerungsmethoden sowie die täglichen Limits unterscheiden sich, weshalb die Funktionen nicht miteinander verwechselt werden dürfen.
Hauptfunktionen
Übliche Text-zu-Stimme-Umwandlung
Standardstimmen werden von Amazon Polly bereitgestellt und umfassen mehr als 28 Sprachen sowie verschiedene regionale Akzente. Sie eignen sich für Kommentare, Hinweistöne, Lehrmaterialien und Sprachprototypen für Telefonate.
SSML-Stimmensteuerung
Herkömmliche Konverter unterstützen die Steuerung von Pausen, Betonungen, Geschwindigkeit, Tonhöhe, Flüstereffekten und teilweiser Aussprache mithilfe von SSML. Die Tags müssen paarweise und im korrekten Format vorhanden sein, andernfalls kann die Konvertierung fehlschlagen.
KI-Stimme
Die KI-Stimme wird durch die Text-zu-Stimme-Funktion von OpenAI angetrieben und zeichnet sich durch eine natürlichere Rhythmik aus. Die Nutzer können Stimmenanweisungen hinzufügen, um Stil, Tonfall und Emotionen zu steuern, können jedoch nicht wie bei herkömmlichen Stimmen alle Tonhöhenparameter direkt anpassen.
MP3-Hörprobe und Download
Nach einem erfolgreichen Konvertieren kann man das Audio auf der Webseite anhören und als MP3 herunterladen. Das Wiederabspielen desselben bereits erstellten Audios zieht keine weiteren Zeichen ab.
Mehrsprachigkeit und Tonauswahl
Die übliche Liste der Sprachen umfasst Standardchinesisch, Englisch, Französisch, Deutsch, Japanisch, Koreanisch, Spanisch usw. Der AI-Übersetzer unterstützt eine weitere Gruppe automatisch erkannter Sprachen; die tatsächlichen Sprachen hängen von dem zuständigen Lieferanten ab.
Kommerzielle Nutzung
Die derzeitige Lizenzbedingung erlaubt die kostenlose sowie kostenpflichtig erstellten MP3-Dateien für kommerzielle und nicht-kommerzielle Projekte – einschließlich Videos, Webseiten, Apps, Präsentationen und Online-Kurse. Die Angabe „ttsMP3“ ist nicht zwingend erforderlich.
Entwickler-API
Für das Jahresabonnement kann man per E-Mail eine API-Schlüssel anfordern. Nachdem die Anwendung Text sowie Parameter für den Sprecher gesendet hat, gibt die Schnittstelle Informationen über den Status, die bereits verwendeten Zeichen, die verbleibende Anzahl an Zeichen sowie Details zum erstellten MP3-Datei zurück.
Vergleich zwischen herkömmlichen Stimmen und KI-Stimmen
| Projekt | Normale Geräusche | KI-Stimme |
|---|---|---|
| Unterliegende Dienste | Amazon Polly | OpenAI Text-to-Speech |
| Sprache | Mehr als 28 Sprachen, verschiedene feste Sprecher | Einzeln unterstützte automatische Spracherkennung |
| Kontrolle | Pausen, Betonung, Geschwindigkeit, Tonhöhe, Flüstern und Aussprache | Pausen sowie Anweisungen zu Stil, Tonfall und Emotionen |
| Kostenlose Nutzungsmenge | Derzeit maximal 3000 Zeichen pro Tag. | Einzeln tägliche Beschränkung, der Wert ist vorerst nicht öffentlich. |
| Ausgabe | MP3s können angehört und heruntergeladen werden. | MP3s können angehört und heruntergeladen werden. |
Anleitung zur Nutzung der Website
- Wählen Sie den herkömmlichen Ton oder den AI-Tonwandler.
- Wählen Sie aus der verfügbaren Liste die Sprache, den Akzent und den Sprecher aus.
- Geben Sie einen kurzen Testtext ein, um zunächst die Aussprache von Namen, Zahlen und Abkürzungen zu überprüfen.
- Zu herkömmlichen Stimmen können unterstützte SSML-Tags hinzugefügt werden, während zu KI-Stimmen Tonhöhenanweisungen eingetragen werden können.
- Beginnen Sie mit der Konvertierung und warten Sie, bis der Player das Ergebnis anzeigt.
- Probieren Sie die Sprachgeschwindigkeit, Pausen, Betonung, Stimmung und Eigennamen aus.
- Ändern Sie den Text oder die Kontrollparameter und erzeugen Sie die gewünschte Version erneut.
- Laden Sie das MP3 herunter und speichern Sie es unter Angabe der Sprache, Version und Verwendungszweck.
- Prüfen Sie vor der Veröffentlichung das Urheberrecht des Textes, die Nutzung des Sounds sowie die Regeln der Zielplattform.
Preise und Zeichenzahl
Der aktuelle Betrag auf der Zahlelseite wird von FastSpring je nach Abrechnungsregion dynamisch geladen; es ist derzeit nicht möglich, die genaue Währung und den Preis eindeutig zu bestimmen. Hier werden nur die bereits festgelegten Beträge und Zeiträume aufgelistet. Der Kaufpreis richtet sich nach den Angaben auf der Zahlelseite.
| Paket oder Version | Preis | Abrechnungszeitraum | Kernrechte oder -beträge | Für Nutzer geeignet |
|---|---|---|---|---|
| Kostenlose Standardgeräusche | Kostenlos | täglich | Maximal 3000 Zeichen; Webseitengenerierung und MP3-Download | Kurze Audiodateien und Erlebnisse |
| Kostenlose KI-Stimmen | Kostenlos | täglich | Begrenzung für einzelne Zeichen, genaue Zahl ist derzeit noch nicht öffentlich. | Natürlicher Sprachton-Test |
| Standard | Gemäß der Abrechnungsseite. | Einmalig für 24 Stunden | 1 Million Zeichen; keine automatische Verlängerung | Kurzfristige, großvolumige Projekte |
| Flexible | Gemäß der Abrechnungsseite. | Monatliche automatische Verlängerung | 1 Million Zeichen pro Monat | Anhaltende Inhaltsproduktion |
| Long-Term | Gemäß der Abrechnungsseite. | Jährliche automatische Verlängerung | Jährlich 10 Millionen Zeichen; es ist eine API-Anfrage möglich. | Hohe Mengen und Entwicklung von Zugängen |
Ein fehlgeschlagener Konvertierungsversuch führt nicht zur Abzüglich von Zeichen, und eine erneute Wiedergabe des bereits erstellten Audios wird ebenfalls nicht erneut berechnet. Auch nach Kündigung der Mitgliedschaft kann es bis zum Ende des bereits bezahlten Zeitraums weiter verwendet werden.
API-Anbindungsprozess
- Erwerben Sie ein Einjahres-Abo und beantragen Sie über die Support-E-Mail einen API-Schlüssel.
- Siehen Sie sich die Liste der Lautsprecher an und wählen Sie den festgelegten Namen, der zur Sprache passt.
- Speichern Sie die Schlüssel auf der Serverseite, schreiben Sie sie nicht auf die Client-Seiten.
- Verwenden Sie GET oder POST, um Schlüssel, Sprecher und Text einzusenden.
- Analysieren von Fehlern in den zurückgegebenen Daten, Zeichenzahl, verbleibendem Speicherplatz und MP3-Informationen.
- Überprüfen Sie vor dem Herunterladen oder Abspielen des Audios, ob das Fehlerfeld null ist.
- Für Limits, Netzwerkfehler und abgelaufene Dateien: Erneute Versuche sowie Caching.
Passend für Nutzer und Szenarien
- Video-Content-Ersteller: Erstellung von Kommentaren, Kurzvideos und Kanalbeschreibungen.
- Lehrkräfte und Lehrplanerteams: Erstellung von mehrsprachigen Lernmaterialien und Audio-Inhalten für das Online-Lernen.
- Produktteam: Erstellung von Anwendungs-Tonbenachrichtigungen, barrierefreier Vorlesung und Prototypen.
- Kundenservice- und Kommunikationsteam: Erstellung von IVR-Aufnahmen und Benachrichtigungstönen.
- Entwickler: Nutzung einer jährlich zu entrichtenden API zur Anbindung von Webseiten oder für interne Automatisierung.
- Privatnutzer: Artikel, Skripte oder Lernmaterialien in MP3 umwandeln.
Vorteile
- Man kann eine Probehörung sowie den MP3-Download ohne Installation durchführen.
- Herkömmliche Sprache bietet eine feinere SSML-Kontrolle.
- KI-Stimmen unterstützen die Beschreibung von Stil und Stimmung in natürlicher Sprache.
- Sowohl kostenlose als auch kostenpflichtige Audiodateien dürfen für kommerzielle Zwecke genutzt werden, ohne dass eine Nennung der Quelle erforderlich ist.
- Einmalige, monatliche und jährliche Beträge passen sich den verschiedenen Projektzyklen an.
Einschränkungen und Hinweise
- Die kostenlose Zeichenzahl ist begrenzt, und die genauen täglichen Werte für die KI-Stimme sind nicht öffentlich bekannt.
- Klang und Sprache hängen von den Zulieferern ab und können jederzeit geändert werden.
- Unescapede Klammern in SSML oder fehlende Schließtags führen zu Fehlern.
- Synthetische Sprache kann Personennamen, Abkürzungen, Zahlen und Fachbegriffe falsch aussprechen.
- Die API ist nur im jährlichen Abonnement erhältlich und erfordert einen manuellen Antrag auf einen Schlüssel.
- Heruntergeladen wird Audio, es wird kein Download von Sprachmodellen offline angeboten.
- Offizielle native Mobil- oder Desktop-Apps wurden nicht bestätigt.
API, SDK und Open-Source-Status
| Projekt | Aktueller Zustand | Erklärung |
|---|---|---|
| Webseiten-Converter | Bereitgestellt | Herkömmliche und KI-generierte Stimmen werden getrennt verwendet. |
| REST-Style-API | Einjähriges Programm | GET oder POST, gibt Informationen zum MP3-Datei zurück |
| Offizielles SDK | Noch nicht veröffentlicht | Das Dokument bietet Beispiele für PHP, Python und Ruby – es handelt sich dabei nicht um SDKs. |
| Quellcode des Produkts | Offene Quelle nicht bestätigt | Die Nutzung von Amazon- und OpenAI-Diensten bedeutet nicht, dass das Produkt open source ist. |
| Offline-Klangmodell | Nicht verfügbar | Man kann nur die erstellte MP3-Datei herunterladen. |
Privatsphäre und Sicherheit
Die Datenschutzerklärung befasst sich mit den Daten zu Seitenbesuchen, Traffic, Standort und Kommunikationsdaten sowie mit den Informationen, die bei der Registrierung, beim Kauf und bei der Kontaktaufnahme mit dem Support freiwillig eingereicht werden. Die Website verwendet außerdem Cookies, wobei auch Cookies von Drittanbietern verwendet werden können.
Daten können an Orte außerhalb der EU übertragen werden, um dort verarbeitet und gespeichert zu werden. Die Richtlinien geben keine klaren Angaben dazu, wie lange Eingabetexte, generierte MP3-Dateien, Protokolle sowie der Cache gespeichert werden sollen.
- Geben Sie keine Passwörter, Kundengeheimnisse oder nicht veröffentlichte finanzielle oder gesundheitliche Daten ein.
- API-Schlüssel werden nur auf der Serverseite gespeichert und beschränken den Textinhalt in den Protokollen.
- Prüfen Sie vor der Massenerstellung die Anforderungen an die interne Datenverarbeitung und den grenzüberschreitenden Datentransfer.
- Nach dem Herunterladen legen Sie in Ihrer Speicherung die Zugriffsrechte sowie den Löschzeitraum fest.
- Wenn Anomalien beim Konto festgestellt werden, ändern Sie umgehend das Passwort und wenden Sie sich an den Support.
Urheberrecht, kommerzielle Nutzung und Rückerstattung
Die Lizenz für kommerzielle Nutzung regelt die Genehmigung zur Erstellung von MP3-Dateien mit TTSMP3 und ersetzt nicht die Rechte am Eingabetext, an Namen von Personen, an Marken, an Musik oder an anderen Plattformen. Die Verwendung zur Nachahmung bestimmter Personen oder zur Täuschung der Zuhörer kann weiterhin rechtliche sowie risikoreiche Folgen für die Plattform haben.
Die Mitgliedschaft kann gekündigt werden und bleibt bis zum Ende der Laufzeit gültig, doch in den aktuellen Bedingungen sind keine klaren allgemeinen Fristen für Rückerstattungen angegeben. Vor dem Kauf sollten die Zahlungsbedingungen von FastSpring überprüft werden; Fragen zu Rückerstattungen und Steuern müssen an den Support gestellt werden.
Häufige Fragen
Wie hoch ist die kostenlose Nutzung von ttsMP3?
Für normale Stimmen gilt derzeit eine Obergrenze von maximal 3000 Zeichen pro Tag. Für KI-Stimmen gibt es eine eigene tägliche Grenze, doch in den offiziellen FAQ werden keine konkreten Werte angegeben.
Kann das erzeugte MP3 für kommerzielle Zwecke verwendet werden?
Ja, die aktuelle Lizenz ermöglicht die Erstellung von Audioinhalten sowohl kostenlos als auch gegen Entgelt, und eine Nennung der Quelle ist nicht erforderlich. Der Eingabetext sowie der konkrete Verwendungszweck müssen jedoch weiterhin rechtlich zulässig sein.
Was ist der Unterschied zwischen herkömmlichen Stimmen und KI-Stimmen?
Herkömmliche Stimmen betonen die Geschwindigkeit, die Tonhöhe und die Art der Aussprache in SSML, während künstliche Intelligenz-Stimmen einen natürlicheren Stil sowie Anweisungen bezüglich Tonfall und Emotionen unterstützen.
Wird bei einem fehlgeschlagenen Konvertieren ein Zeichen abgezogen?
Nein. Es werden nur Zeichen abgezogen, wenn eine erfolgreiche Konvertierung stattfindet. Das Wiederabspielen des bereits erstellten Audios führt nicht zu weiteren Abzügen.
In welchem Paket ist die API enthalten?
Die API wird im Rahmen eines einjährigen Plans angeboten; nach dem Kauf muss man per E-Mail einen Schlüssel anfordern.
Kann man die Sprachmodelle herunterladen, um sie offline zu verwenden?
Nein. Der Benutzer kann nur die erstellten MP3-Dateien herunterladen; die Stimmmodelle von Amazon Polly und OpenAI bieten keine Herunterladeoptionen an.
Wie hoch ist der Preis?
Der Betrag wird vom Abrechnungssystem je nach Region dynamisch angezeigt und kann derzeit nicht eindeutig bestimmt werden. Es gelten die Währung, die Steuern und der Gesamtpreis, wie sie auf der Kaufseite angezeigt werden.
Wird eine Rückerstattung unterstützt?
Die allgemeinen Bedingungen geben keinen klaren, einheitlichen Zeitraum für die Rückerstattung an. Vor dem Kauf sollten die Rückerstattungsbedingungen des Zahlungsdienstleisters überprüft und die Bestellunterlagen aufbewahrt werden.
Zusammenfassung
ttsMP3 eignet sich dazu, Texte in mehreren Sprachen schnell in herunterladbare Sprachaufnahmen umzuwandeln. Die herkömmlichen SSML- sowie AI-Stimmlausch-Anweisungen decken beide Arten von Steuerungsvorgaben ab. Lizenzen für kommerzielle Zwecke sind besonders nützlich für Videos, Kurse und Anwendungsprojekte.
Bei der Auswahl eines Zahlungsplans sollte man besonders auf die Anzahl der Zeichen, die Gültigkeitsdauer sowie die API-Rechte achten. Bei sensiblen Inhalten muss zudem zunächst geklärt werden, wie mit den Daten gespeichert und wie deren Übertragung über Grenzen hinweg abgewickelt wird.
Guigong-Netzwerk-Sicherheitsnummer: 45132202000164