LOVO
Eine Plattform, die KI-gestützte Sprachsynthese, Stimmenklonierung und Video-Editing in einem vereint.
Tags:KI-Audio-ToolsWas ist LOVO AI?
LOVO AI ist eine Plattform für die Erstellung von Inhalten, bei der künstliche Intelligenz zur Stimmenbeschallung genutzt wird. Die Hauptbenutzeroberfläche trägt den Namen Genny. Nutzer können im Browser Skripte schreiben, Stimmen auswählen oder kopieren, Untertitel erstellen und anschließend Bilder, Videos, Musik, Effekte sowie Untertitel in die Zeitlinie einfügen. So entstehen Audio- und Videoinhalte, die für Kurse, Marketingzwecke, soziale Medien, YouTube sowie Unterhaltungsprojekte geeignet sind.
Genny ist keine einfache Umbenennung der alten Version von LOVO Studio. LOVO Studio war ein frühes Tool zur Umwandlung von Text in Sprache, während Genny Sprache, Video, Untertitel, AI Writer und AI Art integriert.
Neue Benutzer sollten Genny verwenden; die Studio-Oberfläche sowie die Pakete aus den alten Anleitungen sind möglicherweise nicht mehr gültig.
KI-Stimmengenerator – Text zu Sprache
Genny bietet mehr als 500 verschiedene Stimmen, die 100 Sprachen und Akzente abdecken. Die Nutzer können nach Sprache, Geschlecht, Alter und Stil filtern, für unterschiedliche Textabschnitte im selben Projekt verschiedene Sprecher auswählen sowie Geschwindigkeit, Pausen, Betonung und Aussprache anpassen.
Die Anzahl der Sprachbibliotheken bedeutet nicht, dass jede Sprache die gleiche Qualität und den gleichen Stil aufweist. Chinesische Zeichen, Markennamen, Zahlen, Abkürzungen und Fachbegriffe sollten einzeln angehört werden;
Das Erneute Generieren nach Bearbeitung des Textes verbraucht erneut die entsprechende Sprachmenge.
Pro Voices und die Ausdrucksweise von Emotionen
Einige Pro-Stimmen betonen einen natürlicheren Rhythmus und eine stärkere Emotionenwiedergabe und eignen sich für Werbung, Geschichten, Spielcharaktere sowie audiovisuelle Inhalte. Die von den verschiedenen Stimmen unterstützten Emotionen und Kontrollmöglichkeiten unterscheiden sich nicht vollständig; bei der Auswahl sollte man zunächst mit einem echten Drehbuch testen.
Eine Erhöhung der emotionalen Intensität kann zu Unstabilitäten in Sprachgeschwindigkeit, Lautstärke und Betonung führen. Lange Texte sollten in semantisch abgeschlossene Abschnitte unterteilt werden, die Lautstärke sollte konstant gehalten werden, und es sollten Alternativen für eine gesprochene Darstellung vorhanden sein.
Klangklonierung
Mit Genny kann man in etwa 1 Minute eigene Sounds erstellen. In der offiziellen Hilfedokumentation wird erklärt, dass sowohl zahlende Nutzer als auch Nutzer mit kostenlosem Probemonat diese Funktion nutzen können. Bei der Erstellung von Klon-Sounds werden keine Voice Generation Credits abgezogen. Dennoch wird bei der Erstellung solcher Sounds weiterhin Zeit für die Sprachgenerierung verbraucht.
Die Aufnahmen sollten von einer einzigen Person angefertigt werden, ohne Musik, mit geringem Hall sowie bei konstanter Entfernung zur Mikrofonanlage. Der Nutzer muss eine ausdrückliche Genehmigung des Sprechers einholen; es ist nicht zulässig, öffentliche Persönlichkeiten, Kunden, Mitarbeiter oder Sprecher ohne Zustimmung für Werbezwecke, Täuschungsversuche oder irreführende Inhalte zu verwenden.
Voice Over und Video-Projekte
Bei Projekten mit Voice-Over wird hauptsächlich reiner Audiomaterial erstellt, während bei Video-Projekten Videos und Bilder hinzugefügt und bearbeitet werden können. In den Einstellungen kann man den Ansichtsmodus wechseln, um zunächst die Erzählung fertigzustellen und anschließend in der Videoliste visuelle Elemente hinzuzufügen.
Genny eignet sich für Videos mit Voiceover-Funktion in Browsern, ist aber kein Ersatz für professionelle Schnittprogramme. Komplexe Farbkorrekturen, Compositing, mehrere Kameras sowie fortgeschrittene Mixing-Verfahren sollten weiterhin in speziellen Programmen durchgeführt werden.
Online-Video-Editor
Der Videobearbeitungsprogramm ermöglicht das Hochladen von Materialien, das Hinzufügen von KI-generierten Stimmen, Texten, Bildern, Logos, Musik, Effekten sowie Übergängen und Untertiteln. Zudem können Dateien exportiert werden oder über Genny gespeichert werden, sodass Share-Links für die Wiedergabe bereitgestellt werden können. Für Nutzer ohne Erfahrung in der Videobearbeitung reduziert dieser integrierte Ablauf den Wechsel zwischen verschiedenen Tools.
Browserprojekte sind von der Netzverbindung und der Cloud-Bearbeitung abhängig, wodurch die Darstellung großer Dateien langsamer sein kann. Vor der endgültigen Bereitstellung sollten Bildgröße, Bitrate, Schriftlizenz, Musiklizenzen sowie die Sicherheitsbereiche für Untertitel überprüft werden.
Automatische Untertitel
Genny bietet vier Möglichkeiten zur Erstellung von Untertiteln: Automatische Transkription aus hochgeladenen Audio- und Videodateien, Erstellung von Untertiteln aus bereits erstellten TTS-Textblöcken, manuelle Eingabe von Untertiteln sowie Hochladen von SRT-Dateien. Die Texte und Zeiten der Untertitel können bearbeitet werden, außerdem können vorgefertigte Styles angewendet werden.
Man kann auch SRT herunterladen oder die Untertitel in das Video einbrennen.
Wenn das Projekt bereits Textblöcke für TTS hat, ist Auto Subtitles möglicherweise nicht verfügbar; in diesem Fall sollte Textblocks to Subtitles verwendet werden. Die automatische Transkription erkennt Personennamen, Zahlen und Fachbegriffe falsch – daher muss der Text vor der Veröffentlichung überprüft werden.
AI Writer und AI Art
Der AI Writer kann anhand eines Themas Skripte erstellen oder umschreiben, während AI Art zur Erstellung von Bildern für Projekte genutzt wird – ideal zur schnellen Erstellung von Entwürfen, Hintergründen und Storyboard-Materialien. Die erzeugten Ergebnisse können anschließend in die Genny-Zeitlinie eingefügt und mit Sprache kombiniert werden.
KI-Skripte können Faktischfehler enthalten, und bei KI-Bildern können Probleme mit Texten, Personendetails und Ähnlichkeiten auftreten. Bei kommerziellen Inhalten müssen Fakten, Markenvorgaben sowie Rechte Dritter überprüft werden; ein Entwurf darf nicht direkt als fertiges Produkt angesehen werden.
Musik, Soundeffekte und Materialien
Benutzer können Musik, Effekte, Bilder und Videos hochladen oder hinzufügen, um Inhalte für Sprachprojekte zu erstellen. Die verschiedenen Tonspuren in einem Projekt können über die Zeitlinie synchronisiert werden und mit Untertiteln sowie Szenen abgestimmt werden.
Die Verfügbarkeit der Plattform bedeutet nicht, dass die Materialien für jede Art von Werbung, Übertragung oder Kundenprojekt verwendet werden können. Es ist notwendig, die Lizenzen für jedes einzelne Material im Bestand sowie für hochgeladene Musikstücke und erstellte Bilder zu überprüfen, um zu vermeiden, dass ein kommerzieller Nutzungsschluss fälschlicherweise als Berechtigung für alle Materialien Dritter angesehen wird.
14-tägige kostenlose Testphase
Neue Konten erhalten einen 14-tägigen Pro-Testlauf – ohne Kreditkarte – und können die kostenpflichtigen Funktionen sowie eine begrenzte Anzahl an Sprachgenerierungseinheiten ausprobieren. Nach Ablauf des Testlaufs wird das Konto, sofern es nicht auf ein Premium-Konto aufgerüstet wird, in ein kostenloses Konto umgewandelt. Die bereits erstellten Projekte bleiben weiterhin im Arbeitsbereich erhalten.
Kostenlose oder testweise verfügbare Projekte können über Share-Links mit dem LOVO-Wasserzeichen abgespielt werden. Das Wasserzeichen, die Exportfunktionen sowie die kommerziellen Rechte sind durch den aktuellen Account-Status begrenzt. Vor der offiziellen Veröffentlichung sollte der Account auf ein höheres Niveau erhoben und neu exportiert werden.
Kostenloses Angebot
Free eignet sich dazu, Projekte und kleine Tests auch nach Ablauf der Testphase beizubehalten. Die maximale Anzahl der aktuellen Projekte beträgt 5. Der kostenlose Umfang unterscheidet sich von den Vorteilen der Testphase; die Anzahl der gesprochenen Minuten sowie die verfügbaren Download-Formate sind auf der Abonnementsseite des Kontos zu finden.
Das kostenlose Paket kann nicht als stabiles Produktionspaket angesehen werden. Die API kann aus Sicherheitsgründen für kostenlose Nutzer deaktiviert werden, und kommerzielle Projekte können sich nicht auf die Lizenzbedingungen der kostenlosen oder testhaften Versionen stützen.
Preis- und Versionsvergleich
| Paket oder Version | Preise, Limits und Kernvorteile |
|---|---|
| Grundpreise und Limits | Der derzeit übliche jährliche Preis für Basic beträgt etwa 24 US-Dollar pro Monat, was im Jahr insgesamt etwa 288 US-Dollar entspricht; der monatliche Preis kann höher sein. In den offiziellen Hilfedokumenten wird angegeben, dass pro Monat 2 Stunden für die Stimmengenerierung zur Verfügung stehen, wobei die Gesamtzahl der Projekte auf 10 begrenzt ist. Basic eignet sich für individuelle Kreative, die regelmäßig kurze Videos und Kommentare erstellen möchten. Preise für Aktionen, Währungen sowie Verlängerungsgebühren können sich ändern; vor der Zahlung sollte überprüft werden, ob es einen Rabatt für das erste Jahr gibt und ob die Gebühr einmalig für ein ganzes Jahr berechnet wird. |
| Pro-Preise und -Beträge | Der derzeit angegebene Preis für Pro beträgt etwa 48 US-Dollar pro Monat. In einigen Fällen wird im ersten Jahr ein Rabatt von etwa 50 Prozent auf die jährliche Gebühr angeboten. Im Monatspreis sind 5 Stunden Voice Generation inbegriffen; es können maximal 50 Projekte gleichzeitig gespeichert werden. Dies eignet sich ideal für Freiberufler sowie für die kontinuierliche Erstellung von Inhalten. Pro ist in der Regel eine persönliche Lösung mit umfassenden Funktionen und einer hohen Kapazität – doch der Sonderpreis gilt nicht als Preis für eine dauerhafte Vertragsverlängerung. Beim Kauf sollte man auf die Kosten für die nächste Zahlungsperiode, die Anzahl der Teammitgliedschaften sowie die Anzahl der zu clonierenden Projekte achten. |
| Pro+-Preise und -Limits | Der aktuelle Preis für Pro+ beträgt etwa 149 US-Dollar pro Monat. Bei manchen Jahreszahlungsangeboten liegt der Preis bei etwa 75 US-Dollar pro Monat – insgesamt also 900 US-Dollar für das ganze Jahr. Im Preis inbegriffen sind 20 Stunden Voice Generation pro Monat; die Anzahl der Projekte ist unbegrenzt. Dieser Service eignet sich für Institutionen, Agenturen sowie Teams, die häufig Inhalte erstellen müssen. Auf der offiziellen Hilfeseite wird außerdem erklärt, dass bei einem Bedarf von mehr als 30 Stunden pro Monat man sich an den Verkauf wenden soll. Bei der massenhaften Erstellung von Inhalten muss auch berücksichtigt werden, dass weitere Kosten durch wiederholte Anpassungen entstehen können – man sollte daher nicht nur auf die endgültige Länge des Videos schauen. |
Grundpreise und Limits
Der derzeit übliche jährliche Preis für Basic beträgt etwa 24 US-Dollar pro Monat, was im Jahr insgesamt etwa 288 US-Dollar entspricht; der monatliche Preis kann höher sein.
Die offizielle Hilfedokumentation bestätigt, dass pro Monat 2 Stunden für die Stimmengenerierung zur Verfügung stehen, wobei die maximale Anzahl an Projekten 10 beträgt.
Basic eignet sich für individuelle Kreative, die regelmäßig kurze Videos und Kommentare erstellen möchten. Die Preise für Werbemaßnahmen, Währungen sowie Verlängerungsgebühren können sich ändern. Vor der Abrechnung sollte überprüft werden, ob ein Rabatt für das erste Jahr gilt und ob die Zahlung einmalig für ein ganzes Jahr erfolgt.
Pro-Preise und -Beträge
Der derzeit angegebene Preis beträgt etwa 48 US-Dollar pro Monat. In einigen Zeiträumen wird ein Rabatt von etwa 50 Prozent auf die jährliche Zahlung im ersten Jahr angeboten. Inbegriffen sind 5 Stunden Voice Generation pro Monat sowie die Möglichkeit, bis zu 50 Projekte gleichzeitig zu speichern – ideal für Freiberufler und alle, die kontinuierlich Inhalte erstellen möchten.
Pro ist in der Regel ein individuelles Angebot mit umfassenderen Funktionen und einem höheren Limit, doch der Rabattpreis gilt nicht als Preis für eine dauerhafte Verlängerung. Beim Kauf sollte man den Betrag für die nächste Abrechnungsperiode, die Anzahl der Teamplätze sowie die Anzahl der Kopien prüfen.
Pro+-Preise und -Limits
Der aktuelle Preis für Pro+ beträgt etwa 149 US-Dollar pro Monat. Bei manchen Jahresabonnement-Angeboten liegt der Preis bei etwa 75 US-Dollar pro Monat – insgesamt also 900 US-Dollar für das ganze Jahr. Im Preis inbegriffen sind 20 Stunden Voice Generation pro Monat. Es gibt keine Beschränkung bezüglich der Anzahl der Projekte. Dieses Angebot eignet sich für Organisationen, Agenturen sowie Teams, die häufig Inhalte erstellen müssen.
Auf der offiziellen Hilfeseite wird außerdem erklärt, dass bei einem Bedarf von mehr als 30 Stunden pro Monat man sich an den Verkauf wenden soll. Bei einer hohen Menge an zu erstellenden Inhalten muss auch der zusätzliche Aufwand durch wiederholte Anpassungen berücksichtigt werden – man kann nicht einfach nur auf die Gesamtlänge des fertigen Produkts schließen.
Enterprise-Unternehmenslösung
Kundenspezifische Angebote von Enterprise – es gibt keine Beschränkung bezüglich der Anzahl der Projekte. Die Konfiguration ist möglich anhand von Teamgrößen, Dauer der Sprachkommunikation, Stimme des Unternehmens, API-Nutzung sowie Anforderungen in Bezug auf Sicherheit und Support. Organisationen, die eine Erstellungsdauer von mehr als 30 Stunden benötigen, Kaufverträge wünschen, eine skalierbare Zusammenarbeit oder kundenspezifische Dienstleistungen benötigen, sollten sich an den Vertrieb wenden.
Bei Unternehmenskäufen sollten Sitzplätze, Berechtigungen für die Arbeitsbereiche, Konkurrenzfähigkeit, Datenspeicherung, Verwendung zum Modelltraining, SLAs, Mechanismen zur Beendigung der Übertragung sowie Lizenzen für Materialien berücksichtigt werden – anstatt nur den Preis pro Stunde zu vergleichen.
Wie werden Generation Credits berechnet?
Generation Credits werden in Stunden und Minuten angegeben. Jedes Mal, wenn Text in Sprache umgewandelt wird, wird die für die Erstellung des Audios benötigte Zeit abgezogen. Der verbleibende Betrag wird in Echtzeit im Arbeitsbereich, auf der Abonnementseite sowie oben im Projekt angezeigt.
Der Betrag wird jeden Monat im Rahmen des Rechnungszyklus aktualisiert; der nicht verbrauchte Teil wird nicht auf den nächsten Monat übertragen. Bei der erneuten Erstellung des geänderten Textes wird erneut eine Gebühr berechnet. Daher sollte man zuerst den Script sowie die Aussprache überprüfen, bevor man in Massen erstellt.
LOVO AI-Anleitung
Eine grundlegende Aufgabe erledigen
- Bestätigung der Aufnahmen, der Geräusche, der Musik sowie der Genehmigung der Teilnehmer;
- Laden Sie hochwertigen Audioinhalt in LOVO AI hoch oder eingeben Sie ihn dort ein;
- Wählen Sie Einstellungen wie Sprache, Sprecher und Text-zu-Stimme-Generierung des AI Voice Generators aus;
- Verwenden Sie Pro Voices zur Erstellung von Transkripten, Synchronisationen oder Bearbeitungsergebnissen für die emotionale Darstellung;
- Überprüfen Sie Abschnitt für Abschnitt Namen, Zahlen, Pausen, Lautstärke und Stimmung;
- Prüfen Sie vor der Exportierung das Format, die Lautstärke sowie die Anforderungen bezüglich Urheberrechten und Datenschutz.
Erstellung wiederverwendbarer professioneller Workflows
- Erstellen Sie einen Testdatensatz mit echtem Rauschen, Akzenten und mehrsprachigen Abschnitten;
- Vergleich der Unterschiede bei der Text-zu-Stimme-Umwandlung durch den AI Voice Generator, Pro Voices sowie bei der Darstellung von Emotionen und der Stimmenklonierung;
- Beibehalten der ursprünglichen Aufnahmen und unveränderten Transkripte;
- Vor der Veröffentlichung für die Öffentlichkeit eine mündliche Anhörung anberaumen;
- Statistische Auswertung der Verarbeitungszeit, Fehlerquote und Verbrauch von Limits;
- Regelmäßige Aktualisierung des Glossars, der Lizenzen für Töne und der Löschrichtlinien;
Begrenzung der Anzahl der Projekte
- Free: maximal 5 Projekte, Basic: 10, Pro: 50, Pro+ und Enterprise: unbegrenzt;
- Die Projektbeschränkung ist die Gesamtanzahl an Konten oder Teams, die der Account oder das Team derzeit speichern kann – es handelt sich dabei nicht um eine monatlich erneuerte Obergrenze.
- Das Teamkonzept wird für das gesamte Team zusammen berechnet, und nicht für jedes einzelne Mitglied separat.
- Nach Erreichen der Obergrenze müssen alte Einträge gelöscht oder aufgewertet werden;
- Bevor sie gelöscht werden, sollten Audio-, Video- und Untertiteldateien exportiert werden, da das Löschen von Elementen spätere Änderungen beeinträchtigen kann.
Gewerbliche Nutzungsrechte
Die offiziellen Hilfedokumente erklären, dass die kostenpflichtigen Abonnements Basic, Pro, Pro+ und Enterprise kommerzielle Rechte für Inhalte bereitstellen, die mit Genny erstellt werden, und diese können für Kundeninhalte sowie für YouTube-Videos verwendet werden, bei denen Einnahmen erzielt werden.
Gewerbliche Rechte beinhalten keine Töne, Skripte, Musik, Bilder, Markenzeichen und Charaktere, die der Nutzer nicht nutzen darf. Eine kostenlose Testversion sowie eine kostenlose Ausgabe sollten standardmäßig kein gleichwertiges gewerbliches Lizenzrecht erhalten.
Für die Klonierung von Stimmen muss zudem die ausdrückliche Zustimmung der betreffenden Person eingeholt werden.
Wasserzeichen und Export
Kostenlose Testversionen oder Free-Projekte können über Links mit dem LOVO-Wasserzeichen geteilt werden. Nach einem kostenpflichtigen Upgrade kann der Inhalt ohne Plattform-Wasserzeichen gemäß dem gewählten Plan exportiert werden; alte Projekte müssen jedoch möglicherweise neu erstellt oder erneut exportiert werden, um das Wasserzeichen zu entfernen.
Kein Wasserzeichen bedeutet nicht, dass die KI-Generierung verheimlicht werden kann. Nachrichten, Werbung, echte Stimmen sowie Inhalte mit hohem Risiko müssen gemäß den lokalen Vorschriften und den Richtlinien der Plattform als synthetische Stimmen deklariert werden.
Stornierung, Verlängerung und Löschung des Kontos
Die Abonnementierung kann jederzeit auf der Abonnementseite von Genny gekündigt werden. Die Zahlungsverpflichtungen gelten bis zum Ende des aktuellen Rechnungszyklus; danach wird das Konto auf kostenlos umgestellt. Die Kündigung des Abonnements bedeutet nicht die Löschung des Kontos – die Projekte können weiterhin über ein kostenloses Konto zugänglich gemacht werden.
Durch die endgültige Löschung des Kontos werden alle Elemente in Genny gleichzeitig gelöscht und können nicht wiederhergestellt werden. Vor der Durchführung sollten Sie die Projekte, Audiodateien, Untertitel sowie Materialien exportieren und sicherstellen, dass die Abonnementverbindung gekündigt wurde.
Genny TTS API
LOVO bietet die Genny-API an, über die man einen API-Schlüssel erhalten kann, eine Liste der Stimmen einsehen sowie synchronen oder asynchronen TTS verwenden kann. Die asynchrone Schnittstelle gibt einen Job-ID zurück; Entwickler können den Status abfragen oder eine Callback-URL konfigurieren, um Benachrichtigungen über die Fertigstellung zu erhalten. Dies eignet sich besonders für große Mengen an Texten oder längere Texte.
Die API-Nutzung und die Funktionen eines Studio-Mitglieds können nicht einfach als ein und dasselbe Paket angesehen werden. In den offiziellen Dokumentationen werden derzeit keine vollständigen Preise für die Nutzung nach Verbrauch angegeben. Anfragen von kostenlosen Nutzern können außerdem durch Sicherheitsrichtlinien blockiert werden. Vor der Inbetriebnahme sollte man in der Konsole oder beim Vertrieb die Gebühren, Zeichenzahlengrenzen, Konkurrenzfähigkeit sowie die kommerziellen Lizenzen überprüfen.
Sicherheit und Zuverlässigkeit von APIs
Die API-Schlüssel sollten nur auf der Serverseite gespeichert werden und nicht in Frontend-Code, mobilen Anwendungen oder öffentlichen Repositorien enthalten sein. Asynchrone Aufgaben erfordern die Handhabung von wiederholten Rückrufen, Fehlzuständen, Zeitüberschreitungen, Wiederholungsversuchen sowie abgelaufenen Ausgabe-Dateien.
Vor der Massenerstellung sollten Stichproben in der Zielsprache sowie im Ton abgenommen werden, und der Speaker-ID, die Script-Version, die Anfrage-ID sowie die Autorisierungsdaten sollten gespeichert werden, um zu verhindern, dass nach Änderungen am Modell oder an der Sprachdatenbank keine Wiederherstellung mehr möglich ist.
GitHub und der Open-Source-Zustand
Die LOVO Genny-Plattform, die gehosteten Sprachmodelle, der Videoeditor sowie die API sind keine Open-Source-Produkte. In der offiziellen GitHub-Organisation gibt es zwar einige öffentliche SDKs, Experimentier- oder Beispiel-Repositorien, doch es werden weder der Code noch die Modellgewichte zur vollständigen Selbsthostung von Genny bereitgestellt.
Dass Drittlager oder andere Open-Source-TTS-Projekte in den Sammlungen und Suchergebnissen einer Organisation auftauchen, bedeutet nicht, dass es sich um Gennys aktuelles Produktionsmodell handelt. Bei der Beurteilung von Open-Source-Projekten und deren Lizenzen sollte man das jeweilige Lager, den Eigentümer, die LICENSE sowie den Wartungsstatus überprüfen.
Für welche Nutzer geeignet?
- Kreative, die Untertitel für YouTube-Videos, Kurzvideos und Podcasts erstellen;
- Teams, die Kurse, Schulungen sowie Produktvorführungsvideos benötigen;
- Mitarbeiter, die mehrsprachige Marketinginhalte und Untertitel erstellen;
- Benutzer, die mit einer 1-minütigen Aufnahme eine persönliche oder markenbezogene Stimme schaffen möchten;
- Entwickler, die mithilfe der TTS-API Sprachausgaben für Anwendungen in Bulk erstellen.
Vorteile des Produkts
- Mehr als 500 verschiedene Stimmen, die 100 Sprachen und Akzente abdecken;
- Sprache, Kloning, Skripte, Bilder, Untertitel und Video-Editing sind in Genny zusammengefasst.
- Für die Klonierung einer Stimme reicht eine klare Aufnahme von etwa 1 Minute aus;
- Untertitel unterstützen vier Quellen: Transkription, TTS-Text, manuell und SRT;
- Das Pay-Plan bietet eine kommerzielle Nutzungsrechte.
- Es werden sowohl synchrone als auch asynchrone TTS-APIs bereitgestellt.
Einschränkungen und Hinweise
- Die Sprachvolumen werden monatlich erneuert und nicht übertragen; auch eine Neuerstellung verbraucht das Volumen.
- Kostenlose und kostenlose Probenversionen mit Wasserzeichen, Downloads, API sowie begrenzte kommerzielle Rechte;
- Die geplanten Preise sowie die Rabatte im ersten Jahr ändern sich häufig.
- Aufgrund unterschiedlicher Sprachen und ungleicher Tonqualitäten können automatische Untertitel sowie AI-Skripte Fehler aufweisen.
- Für das Klonen von Stimmen muss Zustimmung eingeholt werden. Die Genny-Plattform selbst ist nicht open source, und es gibt auch keine vollständige, privat genutzte Version.
Häufige Fragen
Ist LOVO AI kostenlos?
Neue Benutzer können eine 14-tägige Pro-Testversion ausprobieren, die danach in eine kostenlose Version umgewandelt wird. Bei der kostenlosen Version können Projekte gespeichert und weitere begrenzte Tests durchgeführt werden, doch Exportfunktionen, Wasserzeichen, API-Anbindungen sowie kommerzielle Rechte sind eingeschränkt.
Wie viel kostet LOVO AI?
Die aktuellen üblichen Preise sind 24 US-Dollar pro Monat für Basic (Jahresabonnement), 48 US-Dollar pro Monat für Pro und 149 US-Dollar pro Monat für Pro+. Für Pro und Pro+ kann es einen Rabatt im ersten Jahr geben; Enterprise-Abos werden nach den Angaben auf der Zahlelseite festgelegt.
Wie viele können pro Monat erstellt werden?
Basic beträgt 2 Stunden, Pro 5 Stunden und Pro+ 20 Stunden. Nicht verbrauchte Kontingente werden nicht übertragen; bei Neuerstellung wird erneut abgezogen.
Kann man seine eigene Stimme klonen?
Ja, es ist möglich, eine klare Aufnahme in etwa 1 Minute zu erstellen; sowohl bezahlte als auch kostenlose Testnutzer können dies nutzen; die Zustimmung des Sprechers ist erforderlich.
Hat LOVO eine kommerzielle Lizenz?
Basic, Pro, Pro+ und Enterprise gewähren Genny kommerzielle Rechte zur Erstellung von Inhalten, doch der Nutzer muss weiterhin die Rechte an Stimmen, Drehbüchern, Musik, Bildern und anderen Materialien besitzen.
Ist LOVO open source?
Die Genny-Plattform, die Sprachmodelle und die API sind keine Open-Source-Produkte. Offene Beispiele oder SDKs bedeuten nicht, dass man einen vollständigen Service selbst hosten kann.
Guigong-Netzwerk-Sicherheitsnummer: 45132202000164