Murf
Kostenloser Mehrwert
Komplette Liste an KI-Tools KI-Audio-Tools

Murf

KI-Stimmenstudio für Kommentare, Schulungen und Werbeproduktionen

Tags:

Was ist Murf AI?

Murf AI ist eine Plattform, die KI-gestützte Synchronisation, Video-Erzählungen, Lokalisierung, Stimmenklonierung sowie Sprachinterfaces für Entwickler umfasst. Normale Kreative nutzen hauptsächlich Murf Studio, um aus Drehbüchern Erzählungen zu erstellen und diese in Kombination mit Bildern, Videos und Musik zu fertigen Werken zu verarbeiten.

Teams, die bereits vorhandene Audio- und Videodateien übersetzen müssen, verwenden Murf Dub; Entwickler hingegen integrieren Sprachfunktionen in ihre Anwendungen mithilfe der TTS-, Voice Changer-, Dubbing-, Translation-, Streaming- und WebSocket-APIs.

Die Abrechnungsmethoden für diese Produkte unterscheiden sich: Studio wird nach der Dauer der Stimmengenerierung abgerechnet, Dub wird nach Anzahl der Credits berechnet, und API wird je nach Anzahl der Zeichen, Minuten oder auf Grundlage eines Unternehmensvertrags abgerechnet. Die 24-Stunden-Limite für die Sprachaufnahmen in Studio kann nicht direkt für die Nutzung der API oder zur Erstellung von mehrsprachigen Untertiteln derselben Dauer verwendet werden.

Text zu Sprache Text in Sprache umwandeln

Murf Studio bietet derzeit mehr als 300 verschiedene Stimmen sowie mehr als 30 Sprachen und Akzente an. Sie können für Kurse, Werbung, Podcasts, Produktpräsentationen, audiobasierte Inhalte, Unternehmensschulungen sowie YouTube-Untertitel verwendet werden. Das Menü mit den Stimmen lässt sich nach Sprache, Akzent, Geschlecht, Alter, Stil und Verwendungszweck filtern.

Verschiedene Aussprachen derselben Sprache zeigen sich in Zahlen, Abkürzungen, Markennamen und Fachbegriffen unterschiedlich. Formelle Projekte sollten Abschnitt für Abschnitt angehört werden, und eine einheitliche Aussprache sollte mithilfe der Pronunciation Library gespeichert werden.

Gen2-Stimmmodell

Gen2 ist für hochwertige Medien-Erzählungen konzipiert und bietet eine genauere Kontrolle über Tonfall, Stil, Pausen, Geschwindigkeit und Tonhöhe. Im Vergleich zu Modellen für Echtzeit-Dialoge legt es mehr Wert auf Ausdruckskraft und Bearbeitungsmöglichkeiten und eignet sich daher für die Erstellung von nicht-echtzeitbasierten Videos und Lehrinhalten.

Bei der Ausgabe des Modells können weiterhin unnatürliche Betonungen, widersprüchliche Stimmungen sowie Probleme mit dem Rhythmus in langen Abschnitten auftreten. Es ist in der Regel einfacher, das Skript in kleinere, semantisch sinnvolle Blöcke aufzuteilen, um so größere Audioabschnitte, die auf einmal erzeugt werden, besser korrigieren zu können.

Betonung, Variabilität und „Sag es auf meine Weise“

Business und höhere Versionen bieten Emphasis, Variability und Say It My Way. Emphasis dient dazu, Wörter hervorzuheben, Variability sorgt für mehr Tonvarianz, und Say It My Way ermöglicht es den Nutzern, eine Beispielsatz aufzunehmen, damit die KI-Stimme ihren Rhythmus, ihre Intonation und ihre Ausdrucksweise nachahmt.

Die Beispieldateien beeinflussen die Art der Darstellung, entsprechen aber nicht einer Klonierung der Identität des Sprechers. Verschiedene Stimmen und Stile können eine komplexe Darbietung nicht vollständig nachahmen; daher sollte man Satz für Satz vergleichen und übermäßige Verzerrungen vermeiden.

Voice Changer

Der Voice Changer wandelt bereits vorhandene Aufnahmen in eine festgelegte KI-Stimme um und behält dabei möglichst den Rhythmus, den Tonfall, den Akzent sowie die Pausen des ursprünglichen Sprechers bei. Er eignet sich dazu, Familienaufnahmen, Bildschirmaufnahmen sowie vorübergehende Kommentare durch eine einheitliche Markenstimme zu ersetzen.

Die Eingabe über die API dauert derzeit maximal etwa 3 Minuten. Es werden die Formate WAV, MP3, ALAW, ULAW und FLAC unterstützt, und es ist möglich, in verschiedene Audioformate zu exportieren. Für die Umwandlung von Audiodaten ist weiterhin eine gesetzliche Genehmigung sowohl vom Aufnahmeeigner als auch vom Empfänger der Audiodaten erforderlich.

Audio to Text

Business bietet die Funktion Audio zu Text umzuwandeln – man kann Aufnahmen hochladen, diese in bearbeitbare Texte umwandeln und anschließend mit KI-Stimmen ersetzen. Dabei bleibt die Gesamtlänge erhalten, sodass eine Synchronisierung mit dem ursprünglichen Video möglich ist. Die jährliche Mitgliedschaft bei Business beinhaltet 48 Stunden Umwandlungszeit; bei Enterprise sind keine Beschränkungen vorhanden.

Die Transkription kann Personennamen, Zahlen und Fachbegriffe falsch erfassen. Nach der Bearbeitung des Textes muss überprüft werden, ob das Audio weiterhin mit Bildern, Folien und Untertiteln übereinstimmt.

Voice Over Video

Murf Studio ermöglicht es, KI-gestützte Kommentare mit Bildern, Videos, Musik und Untertiteln in einem Projekt zu kombinieren, wobei die Länge über Szenen oder eine Zeitlinie angepasst werden kann. Die Nutzer können Audio-, Untertitel- oder Full-HD-Videos exportieren.

Studio eignet sich für erklärende Videos und Schulungen, ist aber kein professionelles Softwaretool für die Bearbeitung mehrerer Kameras. Komplexe Farbkorrekturen, Effekte sowie Mehrspur-Mixing sollten weiterhin in Tools wie Premiere Pro oder DaVinci Resolve durchgeführt werden.

Integration mit Canva, Google Slides und PowerPoint

Creator unterstützt Canva, während Business zudem die Integration mit Google Slides und PowerPoint bietet. Die Benutzer können in den Sprecherhinweisen der Präsentationsdiapositive einen Text schreiben, eine Stimme auswählen und so eine synchronisierte Erzählung erstellen. Anschließend wird das Projekt in Murf Studio gespeichert, um weitere Bearbeitungen vorzunehmen.

Bei der automatischen Synchronisierung müssen Animationen, Seitenwechsel und Pausen überprüft werden. Ebenso werden importierte Schriftarten, Medien und eingebettete Objekte nicht unbedingt vollständig in das Video umgewandelt.

AI Translation

Enterprise bietet eine KI-gestützte Übersetzung, mit der Studio-Projekte in andere Sprachen umgewandelt werden können, und es ist weiterhin möglich, in den neuen Projekten Scripts, Töne und Szenen zu bearbeiten. Die Plattform unterstützt derzeit mehr als 30 Sprachen, und Multi-Native Voices ermöglicht einen natürlichen Wechsel zwischen verschiedenen Sprachen innerhalb derselben Stimme.

Automatische Übersetzung kann die Überprüfung durch Muttersprachler nicht ersetzen. Für juristische, politische, gesundheitliche, sicherheitsrelevante sowie markenbezogene Begriffe muss ein Wörterbuch erstellt werden, und die Länge der Untertitel sowie ihre kulturelle Angemessenheit müssen überprüft werden.

Murf Dub-Video-Synchronisation

Murf Dub wird verwendet, um bereits vorhandene Videos oder Audiodateien hochzuladen und mehrsprachige Versionen zu erstellen. Das System erkennt den Sprecher, übersetzt die Dialoge, erzeugt neue Stimmen und versucht, die ursprünglichen Zeitstempel sowie die Hintergrundmusik und Effekte beizubehalten.

Derzeit werden mehr als 25 Quell- und Zielsprachen unterstützt, auf der Dubbing-API-Seite werden etwa 28 Sprachen aufgeführt.

Bei der automatischen Übersetzung mit Synchronisation können Probleme wie getrennte Stimmen, emotionale Aspekte, Lautstärkeprobleme sowie Fehler bei der Übersetzung und Synchronisation auftreten. Enterprise kann eine qualitativ hochwertige Synchronisation erwerben, die von internen Experten überprüft wurde – für Anwendungen mit höheren Anforderungen an die Lokalisierung.

Kostenloser Probemonat bei Murf Dub

Die kostenlose Testversion von Dub bietet standardmäßig 200 Credits, mit denen man ein Projekt erstellen und das Ergebnis mit Wasserzeichen exportieren kann. Das entspricht nicht dem Umfang der 10 Minuten an Voice-Generation, der bei Studio Free zur Verfügung steht.

Preis- und Versionsvergleich

Paket oder VersionPreise, Limits und Kernvorteile
Murf Dub Pay-as-you-go-PreiseDub wird zu 1 US-Dollar pro Credit abgerechnet, der Mindestbestellwert beträgt 5 US-Dollar. Pro Bestellung können maximal 10.000 Credits erworben werden, und es ist eine Automatenzahlung einrichten möglich. Bei der regulären PAYG-Methode können maximal etwa 5 Projekte erstellt werden; der genaue Verbrauch hängt von der Anzahl der Dateien, der Länge des Originalvideos, der Anzahl der Zielsprachen sowie den Vorlieben bezüglich der Synchronisation ab. Jede zusätzliche Zielsprache erhöht den Verbrauch. Bei umfangreichen Inhalten sollte zunächst mit kurzen Beispielen die Übersetzung und die Sprachqualität getestet werden, bevor entschieden wird, ob ein Enterprise-Discount in Anspruch genommen wird.
Creator-PreisDer Creator-Plan kostet 19 US-Dollar pro Monat – insgesamt also 228 US-Dollar im Jahr. Er beinhaltet 1 Editor, 100 Projekte, 24 Stunden Voice Generation pro Jahr, mehr als 200 verschiedene Stimmen und Stile, Multi-Native Voices, unbegrenzte Downloads, Integration mit Canva, kommerzielle Rechte, Export in Full HD sowie Vorlagen und HTML-Embeds. Der Creator eignet sich für individuelle Kreative und Freiberufler – doch er beinhaltet keine Funktionen wie Emphasis, Variability, Say It My Way, Audio to Text, PowerPoint sowie keinen Business License.
Business-PreiseDie jährliche Business-Lizenz kostet 66 US-Dollar pro Monat, insgesamt also 792 US-Dollar im Jahr. Sie beinhaltet 1 Editor, 500 Projekte, 96 Stunden Voice-Generation pro Jahr, 48 Stunden Transkription, unbegrenzte Downloads sowie Geschäftsrechte und eine Business-Lizenz. Zudem sind Funktionen wie Emphasis, Variability, Say It My Way, PowerPoint, Google Slides, Windows-Sounds sowie Audio-to-Text enthalten. Der Name „Business“ bedeutet nicht, dass mehrere Personen gleichzeitig arbeiten können: Das derzeitige Self-Service-Angebot umfasst weiterhin nur 1 Editor – es gibt keine Viewer-Sitze. Wenn man Projekte, Rechte sowie die Möglichkeit zur gemeinsamen Bearbeitung benötigt, sollte man sich für die Enterprise-Lizenz entscheiden.
Enterprise-PreisKundenspezifische Angebote von Enterprise beginnen in der Regel ab 5 Editoren. Es werden angepasste Anzahl an Projekten angeboten, unbegrenzte Voice-Generation, unbegrenzte Transkription und Übersetzung, Funktionen für den Austausch und die Zusammenarbeit, Viewer, Zugriffskontrolle, private Ordner, SSO, Zugriffsprotokolle, Wiederherstellung nach 60 Tagen Löschung, schnelle Renderung, keine Trainierung der Daten, MSA, Bestellformulare sowie ein Kundenservice-Manager. Custom Voice Clone, angepasste Modelle, Integration sowie vollständige Ausstrahlungsrechte können zusätzliche Leistungen sein. Bei der Bestellung müssen Datenspeicherung, Modelltraining, Konkurrenzfähigkeit, Servicelevel und Lizenzen im Vertrag festgelegt werden.
API-Preise und -EinschränkungenDer kostenlose API-Test bietet 100.000 Zeichen, eine API-Schlüssel sowie eine Konkurrenzzahl von 5 und 1.000 Anfragen pro Minute. Bei der regulären PAYG-Option kostet es 0,03 US-Dollar pro 1.000 Zeichen; der Mindestbestellwert beträgt 2 US-Dollar. Es können 3 Schlüssel erstellt werden, die Konkurrenzzahl liegt bei 15 und es sind 10.000 Anfragen pro Minute möglich. Das Custom-Angebot bietet Mengenrabatte sowie höhere Limits. Auf der offiziellen Website des Falcon-Modells wird ein Preis von etwa 0,01 US-Dollar pro Minute angegeben – dieses Angebot eignet sich für Voice Agents. Für verschiedene Modelle und Funktionen gelten unterschiedliche Preise; der endgültige Preis ergibt sich aus dem API-Dashboard.

Murf Dub Pay-as-you-go-Preise

Dub wird zu 1 US-Dollar pro Credit abgerechnet, der Mindestkaufwert beträgt 5 US-Dollar. Pro Transaktion können maximal 10.000 Credits erworben werden, und es ist eine Automatikzahlung einrichten möglich. Bei der regulären PAYG-Methode können maximal etwa 5 Projekte erstellt werden;

Der genaue Verbrauch hängt von der Anzahl der Dateien, der Länge des Originalvideos, der Anzahl der Zielsprachen sowie den Präferenzen bezüglich der Synchronisation ab.

Jeder zusätzliche Zielsprache führt zu höheren Kosten. Bei umfangreichen Inhalten sollten zunächst kurze Beispiele zur Überprüfung der Übersetzung und des Sounds verwendet werden, bevor entschieden wird, ob ein Enterprise-Discount in Anspruch genommen wird.

Klangklonierung

Murfs Custom Voice Cloning ist derzeit keine Funktion für normale Nutzer, sondern ein zusätzlicher Service für Unternehmen. Ein Accountmanager hilft bei der Aufnahme, dem Training, der Qualitätskontrolle und der Implementierung. Die geklonten Stimmen können in Studio-, Dub- oder Unternehmensworkflows verwendet werden.

Unternehmen müssen eine ausdrückliche Genehmigung von Sprecher:innen oder Mitarbeitern haben sowie die Verwendungszwecke, die Sprache, die Dauer sowie den Zugriff auf und die Löschung der Modelle festlegen. Die Klonierung von Stimmen darf nicht zur Täuschung, zum Betrug oder für Werbung und Aussagen ohne Zustimmung verwendet werden.

Kostenloses Angebot

Studio Free kostet 0 Dollar – es ist keine Kreditkarte erforderlich. Es umfasst 10 Projekte, 10 Minuten Zeit für die Stimmengenerierung sowie einen Editor. Es können die Funktionen der Business-Ebene ausprobiert werden, doch es ist keine Herunterladung möglich und es besteht kein kommerzieller Nutzungsschluss.

Die kostenlose Version eignet sich zum Anhören von Sounds und zum Testen der Steuerelemente, ist aber nicht geeignet für eine offizielle Veröffentlichung. Die Möglichkeit, ein Projekt anzusehen, bedeutet nicht, dass man die Audiodatei oder eine kommerzielle Lizenz erhält.

Creator-Preis

Der jährliche Creator-Plan kostet 19 US-Dollar pro Monat, also insgesamt 228 US-Dollar im Jahr. Enthalten sind 1 Editor, 100 Projekte, 24 Stunden Voice Generation pro Jahr, mehr als 200 verschiedene Stimmen und Stile, Multi-Native Voices, unbegrenzte Downloads, Integration mit Canva, kommerzielle Rechte, Export in Full HD sowie vordefinierte Medien und HTML-Embeds.

Creator eignet sich für individuelle Kreative und Freiberufler, enthält jedoch nicht Emphasis, Variability, Say It My Way, Audio to Text, PowerPoint und Business License.

Business-Preise

Die jährliche Business-Version kostet 66 US-Dollar pro Monat, also insgesamt 792 US-Dollar im Jahr. Enthalten sind 1 Editor, 500 Projekte, 96 Stunden Voice Generation pro Jahr sowie 48 Stunden Transkription. Zudem gibt es unbegrenzte Downloads sowie Geschäftsrechte und eine Business-Lizenz. Außerdem sind Funktionen wie Emphasis, Variability, Say It My Way und PowerPoint enthalten.

Google Slides, Windows-Sound und Audio zu Text.

Der Name „Business“ bedeutet nicht, dass mehrere Personen zusammenarbeiten können: Bei der aktuellen Self-Service-Lösung gibt es nur einen Editor – es gibt außerdem keine Viewer-Sitze. Wenn man Projekte, Berechtigungen sowie die Möglichkeit zur gemeinsamen Bearbeitung benötigt, sollte man sich für die Enterprise-Version entscheiden.

Enterprise-Preis

Kundenspezifische Angebote von Enterprise beginnen in der Regel ab 5 Editoren und umfassen eine Anpassung der Anzahl der Projekte, unbegrenzte Voice-Generation, unbegrenzte Transkription und Übersetzung, gemeinsame Nutzung und Zusammenarbeit, Viewer, Zugriffssteuerung, private Ordner, SSO, Zugriffsprotokolle, Wiederherstellung nach 60 Tagen Löschung, schnelle Renderung, kein Training mit Ihren Daten, MSA, Bestellaufträge sowie einen Customer Success Manager.

Custom Voice Clone, maßgeschneiderte Modelle, Integration sowie vollständige Ausstrahlungsrechte können zusätzliche Leistungen sein. Bei der Beschaffung sollten Datenspeicherung, Modelltrainierung, Konkurrenzfähigkeit, Servicelevel sowie Lizenzen im Vertrag festgelegt werden.

Wie wird die Sprachgenerierungszeit berechnet?

VGT wird entsprechend der tatsächlichen Länge des erzeugten Audios abgezogen. Ein englischer Text mit etwa 1000 Wörtern ergibt in der Regel ein Audio von etwa 6 Minuten Länge, wobei dies von der Stimme und der Sprechgeschwindigkeit abhängt.

Für die Erstellung eines 500-Wort-Skripts werden 4 Minuten und 34 Sekunden abgezogen.

Die Anpassung des Textes und die erneute Erstellung verbrauchen erneut einen entsprechenden Anteil. Die aktuelle Hilfedokumentation besagt, dass der verbleibende VGT für aktive oder pausierte Abonnements in den nächsten Zeitraum übertragen werden kann; die genaue Gültigkeit hängt vom Account-Zustand ab und ist auf der Abonnementseite zu prüfen.

Gewerberechte und Geschäftslicenz

Alle bezahlten Studio-Pläne beinhalten das kommerzielle Recht auf die Erstellung von Untertiteln, das für originelle YouTube-Inhalte, Streaming-Dienste sowie kommerzielle Inhalte genutzt werden kann; der Business-Plan enthält zudem eine Business-Lizenz.

Laut den offiziellen Hilfedokumenten bleiben die Rechte an dem erstellten Inhalt bezüglich des kommerziellen und geschäftlichen Einsatzes auch nach Ablauf der Abonnementlaufzeit gültig.

Gewerbliche Rechte umfassen keine Skripte, Charaktere, Musik oder hochgeladene Materialien, für die der Nutzer keine Rechte hat, und sie garantieren auch nicht, dass Drittplattformen künftig KI-Stimmen zulassen werden. Die Richtlinien von YouTube und Werbeplattformen müssen ständig überprüft werden.

Hintergrundmusik und YouTube-Codes

Murf bietet mehr als 8.000 Musikstücke im Bestand an. Beim Hochladen einiger Murf-Musikstücke auf YouTube kann dies den Content ID-Mechanismus auslösen. Das System stellt einen einmaligen YouTube-Code im Exportpaket bereit; der Benutzer muss diesen gemäß den Anweisungen in die Videobeschreibung eingeben, um die Lizenzangabe automatisch zu entfernen.

Murf TTS API

Die Entwickler-API bietet hochleistungsstarkes TTS der Gen2-Klasse sowie ein Echtzeit-TTS mit niedriger Verzögerung von Falcon. Zudem werden Geschwindigkeit, Tonhöhe, Pausen, Aussprache, Zieldauer, Variationen, Multi-Native-Formate sowie Ausgabe in MP3, WAV, FLAC, ALAW, ULAW und Base64 unterstützt – bei einer maximalen Auflösung von 48 kHz.

Die API-Stimmlibliothek umfasst derzeit über 150 verschiedene Stimmen, die etwa 35 Sprachen abdecken; sie sind nicht exakt identisch mit den mehr als 300 Stimmen in Studio.

Prüfen Sie vor der Auswahl das Zielmodell und die Sprache in der API Voice Library.

Anleitung zur Verwendung von Murf AI

Eine grundlegende Aufgabe erledigen

  1. Bestätigung der Aufnahmen, der Geräusche, der Musik sowie der Genehmigung der Teilnehmer;
  2. Laden Sie hochauflösendes Audio bei Murf AI hoch oder eingeben Sie es.
  3. Wählen Sie Einstellungen wie Sprache, Sprecher und Text-zu-Stimme-Umwandlung aus;
  4. Verwenden Sie das Gen2-Stimmmodell zur Erstellung von Transkripten, Voice-Over-Aufnahmen oder zur Aufbereitung von Inhalten;
  5. Überprüfen Sie Abschnitt für Abschnitt Namen, Zahlen, Pausen, Lautstärke und Stimmung;
  6. Prüfen Sie vor der Exportierung das Format, die Lautstärke sowie die Anforderungen bezüglich Urheberrechten und Datenschutz.

Erstellung wiederverwendbarer professioneller Workflows

  1. Erstellen Sie einen Testdatensatz mit echtem Rauschen, Akzenten und mehrsprachigen Abschnitten;
  2. Vergleichen Sie die Unterschiede in der Verarbeitung von Text-to-Speech-, Gen2-Stimmmodellen und Voice Changer.
  3. Beibehalten der ursprünglichen Aufnahmen und unveränderten Transkripte;
  4. Vor der Veröffentlichung für die Öffentlichkeit eine mündliche Anhörung anberaumen;
  5. Statistische Auswertung der Verarbeitungszeit, Fehlerquote und Verbrauch von Limits;
  6. Regelmäßige Aktualisierung des Glossars, der Lizenzen für Töne und der Löschrichtlinien;

API-Preise und -Einschränkungen

  • APIFreeTrial bietet 100.000 Zeichen, 1 API-Key, 5 parallele Anfragen sowie 1000 Anfragen pro Minute;
  • Bei der regulären PAYG-Option beträgt die Gebühr 0,03 US-Dollar pro 1000 Zeichen. Die Mindestbestellung beträgt 2 US-Dollar. Es können 3 Schlüssel erstellt werden, es besteht eine Konkurrenzlast von 15 gleichzeitigen Anfragen sowie 10.000 Anfragen pro Minute.
  • Das Custom-Angebot bietet Mengenrabatte und höhere Limits;
  • Die offizielle Website des Falcon-Realtime-Modells gibt einen Preis von etwa 0,01 US-Dollar pro Minute an – geeignet für VoiceAgent.
  • Verschiedene Modelle und Fähigkeiten verwenden unterschiedliche Einheiten, die endgültige Kosten richten sich nach dem APIDashboard.

Dubbing, Übersetzung und Streaming-API

Murf bietet die Dub Automation API, die Translation API sowie Streaming und WebSocket mit niedriger Verzögerung. Für das Dubbing können Transient-Aufgaben verwendet werden; die Ausgabelinks verfallen nach 72 Stunden.

Es ist auch möglich, persistente Projekte zu erstellen, um weiterhin in der Murf Dub-Oberfläche zu editieren und zusammenzuarbeiten.

Der TTS Key unterscheidet sich vom Murf Dub API Key. Das Produktionsystem sollte das Webhook Secret überprüfen, doppelte Benachrichtigungen verarbeiten und die vorübergehenden Ausgaben rechtzeitig speichern.

Offizielle SDKs, MCP und Integration

GitHub bietet offizielle Beispiele für das Python SDK, Cookbooks, Pipecat, LiveKit, den MCP Server sowie Voice Agents. MCP ermöglicht es kompatiblen Agenten, Murf TTS aufzurufen, während Pipecat und LiveKit zur Integration in Echtzeit-Stimmanwendungen dienen.

Diese Open-Source-Connector enthalten das Murf-Stimmmodell nicht. Der Betrieb erfordert weiterhin eine API-Schlüssel, was Cloud-Kosten verursacht; der Schlüssel darf weder in den Client geschrieben noch in öffentliche Repositorien eingestellt werden.

Ist es Open Source?

Murf Studio, Dub, Soundmodelle sowie Cloud-APIs sind keine Open-Source-Projekte – es gibt auch keine vollständig selbsthostbaren Versionen. Die offiziellen SDKs, MCPs sowie Integrationssamples können zwar als Open Source bereitgestellt werden, doch das bedeutet nicht, dass die Kerndienste offen zugänglich sind.

Unternehmen mit strengen Anforderungen an die Speicherung von Daten sowie deren Bereitstellung im internen Netzwerk können sich an Falcon On-Prem oder an maßgeschneiderte Lösungen wenden. Ob diese verfügbar sind, muss im Rahmen eines Vertrags geklärt werden.

Für welche Nutzer geeignet?

  • Kreative, die Kurse, Werbung, Produktpräsentationen und YouTube-Einspülungen erstellen;
  • Team, das Schulungsvideos mit PPT, Slides und Canva erstellt;
  • Unternehmen, die eine Übersetzung und Synchronisation von Videos in mehreren Sprachen benötigen;
  • Organisation der Markenstimme durch Klangklonierung;
  • Entwickler von Voice Agents, IVR-Systemen, Spielen und barrierefreien Anwendungen;
  • Plattformen, die Echtzeit-TTS mit niedriger Verzögerung sowie Batch-Dubbing-APIs benötigen.

Vorteile des Produkts

  • Studio, Dub und API umfassen Erstellung, Lokalisierung und Produktintegration;
  • Mehr als 300 Studio-Töne und mehr als 30 Sprachen;
  • Gen2 bietet präzise Leistungssteuerung, Falcon ist für Echtzeit-Dialoge geeignet;
  • „Say It My Way“ kann als Vorbild für die Aussprache dienen.
  • Unterstützung für Canva, Slides, PowerPoint und Windows-Anwendungen;
  • Die offiziellen SDKs, MCP, Pipecat und LiveKit bilden eine vollständige Ökosystem-Struktur.

Einschränkungen und Hinweise

  • Free kann nicht heruntergeladen werden und es bestehen keine kommerziellen Rechte;
  • Sowohl das Creator- als auch das Business-Selbstbedienungsangebot verfügen nur über 1 Editor;
  • Stimmenklonierung ist keine Selbstbedienungsfunktion, Übersetzung und Zusammenarbeit gehören hauptsächlich zu Enterprise;
  • Studio-, Dub- und API-Lizenzen können nicht ausgetauscht werden;
  • Die Neuerstellung des Audios verbraucht VGT. Bei mehrsprachigen Dubs werden die Kosten je nach Sprache und Datei erhöht; die API wird außerdem pro Zeichen oder Minute abgerechnet.
  • KI-Stimmen, Transkriptionen und Übersetzungen können Fehler aufweisen;
  • Für Clone, VoiceChanger und Dubbing müssen Lizenzen für Stimmen und Materialien eingeholt werden, und wichtige Inhalte müssen einer manuellen Qualitätskontrolle unterzogen werden.

Häufige Fragen

Ist Murf kostenlos?

Studio bietet ein kostenloses Paket an, das 10 Minuten Voice Generation sowie 10 Projekte umfasst, jedoch kein Herunterladen möglich ist und keine kommerziellen Rechte gewährt. Für Dub und API gelten eigene Probierläufe.

Wie viel kostet Murf?

Studio: Monatspreis für Creator 19 US-Dollar, für Business 66 US-Dollar; bei Enterprise werden individuelle Preise angegeben. Bei Dub PAYG beträgt der Preis 1 US-Dollar pro Credit.

Die TTS API PAYG kostet 0,03 US-Dollar pro 1000 Zeichen.

Unterstützt Murf Chinesisch?

Chinesisch sowie verschiedene Akzente werden unterstützt, doch Studio, API und Dub bieten unterschiedliche Anzahl an Sprachen und Stimmen. Vor dem Kauf sollte man in dem jeweiligen Produkt die gewünschte Stimme anhören.

Kann man seine eigene Stimme klonen?

Ja, das ist möglich. Allerdings ist die Funktion „Custom Voice Cloning“ derzeit keine reguläre Selbstbedienungsfunktion. Sie erfordert die Unterstützung des Enterprise-Teams und muss als zusätzlicher Service aktiviert werden.

Hat Murf eine kommerzielle Lizenz?

Alle kostenpflichtigen Studio-Pläne beinhalten kommerzielle Rechte; der Business-Plan enthält außerdem eine Geschäftslizenz. Die Rechte am erstellten Inhalt bleiben auch nach der Kündigung gültig, doch der Nutzer muss die Rechte an den Skripten und Materialien besitzen.

Hat Murf eine API?

Es gibt TTS-, Voice-Changer-, Streaming-, WebSocket-, Übersetzungs- und Dubbing-APIs, sowie ein Python-SDK, MCP und verschiedene Integrationen für Voice Agents.

Ist Murf Open Source?

Die Kernplattform und die Modelle sind nicht open source. Das offizielle SDK, MCP sowie die Beispiele für die Integration sind zwar open source, erfordern aber weiterhin die Murf-Cloud-API sowie bezahlte Lizenzen.

©️ Urheberrechtshinweis: Sofern nicht anders angegeben, liegen die Urheberrechte an allen Artikeln auf dieser Website beiTeilen von AI-ToolsAlle Urheberrechte liegen bei uns. Ohne Genehmigung darf keine Person, kein Medienunternehmen, keine Website oder irgendeine Gruppe den Inhalt dieser Website kopieren, nachahmen oder auf andere Weise verbreiten. Ebenso ist es nicht gestattet, Spiegelseiten auf Servern zu erstellen, die nicht uns gehören. Andernfalls behalten wir uns das Recht vor, rechtliche Schritte gegen die Verantwortlichen einzuleiten.

Werkzeuge, die denen von Murf ähneln