Die Untertitel sagen
Kostenloser Mehrwert
Komplette Liste an KI-Tools KI-Audio-Tools

Die Untertitel sagen

Online-Tools für Sprachsynthese, Untertitel und Videoerstellung – Videos können ohne eigene Auftritte erstellt werden.

Tags:

Was steht in den Untertiteln?

Die Untertitel besagen, dass es sich um ein AI-basiertes Tool zur Abstimmung von Ton und Text für die Videobearbeitung handelt, mit dem aus vorhandenem Audio und fertigem Text eine SRT-Untertiteltimeline erstellt werden kann.

Es löst das Problem, dass der Textinhalt bereits feststeht, aber die genauen Zeitpunkte für die Untertitel fehlen – es handelt sich dabei nicht um ein gewöhnliches Tool zur Umwandlung von Sprache in Text.

Hauptfunktionen

  • Laden Sie den Audio-Datei sowie den entsprechenden fertigen Text hoch.
  • Automatische Abstimmung von Text- und Sprachzeitpositionen.
  • Erstellung einer SRT-Untertitel-Zeitachse in Millisekunden.
  • Verringerung von Eigennamen und Fehlern bei mehrdeutigen Schriftzeichen.
  • Unterstützung bei der Erstellung von Untertiteln für bereits vorhandene Scripts.
  • Es werden Ausrichtungsmethoden wie Abstandsbearbeitung bereitgestellt.
  • Neue Nutzer können kostenlose Probeminuten erhalten.
  • Es werden Pakete mit langer Laufzeit für professionelle Abstimmung angeboten.
  • In dem Konto werden Aufgaben sowie Ergebnisprotokolle gespeichert.
  • Die Sprachsynthesefunktion befindet sich in einer begrenzten Beta-Phase.

Für welche Benutzer geeignet

BenutzerPassende SzenarienVoraussetzung
Kurzvideo-ErstellerUntertitel für Sprachaufnahmen und Kommentare erstellenDie Aufnahme wird im Grunde nach dem Text vorgelesen.
KurslehrerErstellung von Kursen und untertitelten Inhalten gegen BezahlungVollständige Vorlesungsnotizen beibehalten
UnternehmensausbilderUntertitel für Schulungsvideos bearbeitenErhaltung der Berechtigung zur Nutzung von Audio- und Videomaterialien
Podcast-EditorErstellung einer Zeitachse für audiovisuelle MaterialienImprovisierte Inhalte sollten nicht zu viele sein.
Team für audiovisuelle InhaltePassende Texte zu echten AufnahmenEinzelspur-Klang ist klar.
Video-Postproduktions-MitarbeiterNach dem Exportieren als SRT fortfahren mit der FormatierungEs ist weiterhin eine manuelle Stichprobenkontrolle zu den jeweiligen Zeitpunkten erforderlich.

Unterschied zwischen Ton-Text-Alignierung und Spracherkennung

ProjektPhonem-Text-AlignierungSpracherkennung
Ist ein Text notwendig?Es ist ein entsprechender, endgültiger Text erforderlich.Normalerweise ist das nicht notwendig.
HauptaufgabeSuche nach der Zeitposition jedes TextabschnittsTextinhalt aus der Sprachstimme erraten
EigennamenDirekte Verwendung des vom Benutzer bereitgestellten TextesKann als Homonym erkannt werden
Improvisierte InhalteBei großen Abweichungen kann eine Ausrichtung fehlschlagen.Man kann versuchen, es direkt zu transkribieren.
Schlüsselpunkte der AusgabeUntertiteltimelinesTranskription des Textes
Eignete MaterialienAudio- und Video-Dateien mit Vortrag nach dem ManuskriptVorträge, Interviews und freie Reden

Wie funktioniert die Ton-Text-Abstimmung?

Das System verwendet den vom Benutzer bereitgestellten Text als Grundlage, sucht im Audio nach den entsprechenden Stellen für Anfang und Ende der Sätze und erstellt anschließend die Untertitelblöcke.

Daher ergibt sich die Genauigkeit des Textes aus dem endgültigen Entwurf, während die Zeitgenauigkeit von der Qualität der Aufnahme, der Einheitlichkeit der Vorlesung und der Satzteilung abhängt.

  1. Die endgültige Version des Sprechtextes vorbereiten.
  2. Exportieren Sie klares, unverarbeitetes Audiomaterial.
  3. Stellen Sie sicher, dass die Reihenfolge der Aufnahme und des Textes übereinstimmt.
  4. Laden Sie den Audio-Datei hoch und fügen Sie den Text ein.
  5. Wählen Sie die geeigneten Ausrichtungseinstellungen aus.
  6. Übermitteln Sie die Aufgabe und warten Sie auf die Bearbeitung.
  7. Voranschau der Untertiteltage und Zeichensetzung.
  8. Korrigiere fehlende Lesungen, zusätzliche Lesungen und Pausenpositionen.
  9. Exportieren Sie eine SRT-Datei für das Schnittbearbeiten.

Wie man Audio vorbereitet

ProjektEmpfehlungenEs sollte vermieden werden.
KlangDie Stimme soll klar bleiben und der Lautstärkepegel konstant sein.Lautstärkeüberschreitung, zu leise Tonhöhe und starke Hallwirkung
HintergrundVerwenden Sie möglichst stimmliche Aufnahmen ohne Musik.Die Musik übertönt die Gespräche.
Anzahl der PersonenEs ist einfacher, eine einzelne Person beim kontinuierlichen Vorlesen in Einklang zu bringen.Mehrere Personen unterbrechen sich gegenseitig und sprechen gleichzeitig.
MontageDer Text und das auditive Material bleiben in derselben Reihenfolge.Sätze kürzen, ohne den Text zu ändern
PauseBeibehaltung der natürlichen SatzpausenLange Leerphasen und wiederholte Abschnitte
DokumenteVerwenden Sie klaren und einwandfrei abspielbaren Audio.Beschädigte Dateien und mehrfaches Konvertieren bei niedriger Bitrate

Wie man Texte vorbereitet

Je näher der Text dem tatsächlichen Sprechtext ist, desto stabiler ist die Übereinstimmung; Satzzeichen und Absatztrennungen beeinflussen außerdem den Lesetakt der Untertitelblöcke.

  • Verwenden Sie die tatsächlich bei der Aufnahme verwendete Version.
  • Löschen Sie die unvorgelesenen Überschriften und Anmerkungen.
  • Fügen Sie die tatsächlich im Aufnahmegerät vorkommenden Sätze ein.
  • Einheitliche Schreibweise für Zahlen, Einheiten und Eigennamen.
  • Setzen Sie natürliche Satzzeichen entsprechend der Bedeutung und des Sprachtempos.
  • Fügen Sie keine Zeitcodes oder irrelevante Anmerkungen hinzu.
  • Lange Texte werden zunächst in Abschnitten bearbeitet.

Was sind SRT-Untertitel?

SRT ist ein gängiges Untertitelformat, bei dem jeder Untertitelblock eine Nummer, einen Startzeitpunkt, einen Endzeitpunkt sowie den zu zeigenden Text enthält.

Nach der Erstellung kann es in die meisten Video-Editor- und Player-Programme importiert werden, doch Schriftarten, Farben und Positionen müssen in der Bearbeitungssoftware eingestellt werden.

ÜberprüfungspunkteWarum ist es wichtig?Behandlungsmethoden
StartzeitDie Untertitel dürfen nicht deutlich vor der Sprachaufnahme erscheinen.Hören Sie sich Abschnitt für Abschnitt an und justieren Sie leicht.
EndezeitVermeiden Sie, dass die Untertitel zu früh verschwinden oder übereinanderliegen.Bewahren Sie eine angemessene Lesezeit bei.
Länge einer ZeileZu lange Texte beeinträchtigen die Lesbarkeit auf Mobilgeräten.In semantische Kurzsätze aufteilen
Anzahl der UntertitelZu feine Splitter können dazu führen, dass das Bild zittert.Kombinieren von aufeinanderfolgenden Phrasen
KodierungFehlerhafte Kodierung kann unsinnige Zeichen anzeigen.Verwenden Sie die von dem Editor unterstützte UTF-Kodierung.

Handhabung von Abständen und Pausen

Pausen im Vortrag, Atemzüge und leere Abschnitte beeinflussen die Aufteilung der Untertitelblöcke – man darf sich nicht nur darauf verlassen, dass der Text identisch ist.

  • Kurze Pausen können im selben Untertitelblock beibehalten werden.
  • Am semantischen Ende eignet sich ein neuer Untertitelsegment.
  • Der vorherige Untertitel sollte rechtzeitig vor einer langen Pause beendet werden.
  • Die Hintergrundmusik sollte nicht zwangsläufig zum Text passen.
  • Die Einleitungs- und Abspannsequenzen können in der Videobearbeitungssoftware separat bearbeitet werden.
  • Nach der Exportierung überprüfen Sie die Synchronisation erneut bei der endgültigen Framerate.

Die Untertitel besagen: Vollständige Anleitung zur Nutzung

  1. Gehen Sie auf die offizielle Website, wie in den Untertiteln angegeben.
  2. Registrieren Sie ein Konto und erhalten Sie einen Probeneinsatz.
  3. Wählen Sie die Funktion zur Ton-Text-Abstimmung aus.
  4. Klaren Audio-Dateien ohne Hintergrundmusik bereitstellen.
  5. Die endgültige Textversion wird so bearbeitet, dass sie mit der Aufnahme übereinstimmt.
  6. Entfernen Sie die unvorgelesenen Überschriften und Anmerkungen.
  7. Laden Sie den Audio-Datei hoch und fügen Sie den vollständigen Text ein.
  8. Überprüfen Sie die Dauer, die Datei- und Zeichenzahlbeschränkungen.
  9. Wählen Sie die Einstellungen für Ausrichtung oder Abstand aus.
  10. Übermitteln Sie die Aufgabe und warten Sie auf die Erstellung.
  11. Voranschau der Untertitel und der Synchronisation des Tonfalls.
  12. Achten Sie besonders auf die Pausen und die Stellen mit umfangreichen Überarbeitungen.
  13. Laden Sie die generierten SRT-Untertitel herunter.
  14. Ein Video-Editor-Programm importieren.
  15. Einstellen von Schriftart, Position und Untertitelformat.
  16. Überprüfen Sie die vollständige Wiedergabe des Endvideos.

Kostenloser Datenvolumen und Profipakete

Die aktuelle Startseite bietet bei der Anmeldung 100 Minuten kostenlos zum Ausprobieren an und zeigt außerdem ein Profipaket an, das für 125 Yuan 30.000 Minuten umfasst.

ProjektPreis oder LimitErklärung
Neue Benutzererfahrung100 MinutenNach der Registrierung erhältlich, die Teilnahmeregeln können sich ändern
Professionelles Ausrichtungspaket125 YuanEnthält 30.000 Minuten
UmrechnungskursEtwa 0,004 Yuan pro MinuteSchätzung nach Gesamtpreis des Pakets und Anzahl der Minuten
SprachsyntheseNeue Preise sind noch nicht veröffentlicht.Derzeit in begrenztem Beta-Test oder kurz vor dem Release.

Die genauen Gültigkeitsdauer, Rückerstattungen, Rechnungen sowie Nutzungseinschränkungen richten sich nach den Bedingungen auf der Kaufseite nach dem Anmelden sowie den Zahlungsbedingungen.

Wie sieht es mit den alten Mitgliedsregeln aus?

Die alte offizielle Mitgliederseite zeigt weiterhin an, dass man durch einen Einzahlung von 100 Yuan 10.000 Punkte erhält und somit zum lebenslangen Mitglied wird, sowie die bisherigen Vorteile wie Sprachsynthese.

Da die aktuelle Startseite die Sprachsynthese als begrenzte Beta-Version ausweist, können die Rechte der alten Version nicht direkt als Verpflichtung für die neue Version angesehen werden.

InformationenInhalt der alten SeiteAktuelle Nutzungsempfehlungen
MitgliedschaftsbedingungenEinmalige Aufladung ab 100 YuanPrüfen Sie vor dem Kauf, ob es noch gültig ist.
PunkteErhalten Sie 10.000 Punkte, wenn Sie 100 Yuan aufladen.Überprüfen, für welche aktuellen Funktionen es verwendet werden kann
Abo-DauerDie Seite besagt, dass es lebenslang aufbewahrt wird.Überprüfung des tatsächlichen Kontostands
SprachsyntheseEinst wurden verschiedene Mitgliedsvorteile angeboten.Die aktuelle Startseite ist als Beta-Version gekennzeichnet.
Phonem-Text-AlignierungEs gab tägliche und geschenkte Limits.Gemäß der Seite mit den neuen Paketen.

Der aktuelle Stand der Sprachsynthesefunktionen

Auf der aktuellen Startseite der offiziellen Website wird TTS als „bald verfügbar“ oder „in begrenztem Beta-Zustand“ angezeigt, weshalb normale Nutzer davon ausgehen müssen, dass es noch nicht vollständig verfügbar ist.

  • Berücksichtigen Sie die Anzahl der aktuellen Sprecher nicht gemäß den Versprechen in älteren Artikeln.
  • Laden Sie nicht erst Geld auf, bevor Sie annehmen, dass TTS verwendet werden kann.
  • Die Berechtigung für die Beta-Testung, die Audiofunktionen sowie die Datenvolumina können unterschiedlich sein.
  • Für die kommerzielle Nutzung der Synchronisation müssen die geltenden Lizenzbedingungen überprüft werden.
  • Die Ansprüche des alten Kontos müssen nach dem Anmelden separat überprüft werden.

Wie versteht man „100% genau“?

Die Angabe einer 100%-Genauigkeit auf der offiziellen Website ist eine Marketingaussage, die hauptsächlich darauf abzielt, hervorzuheben, dass der Text der Untertitel aus dem von den Nutzern bereitgestellten Endtext stammt.

Es garantiert keine absoluten Fehler in Bezug auf den Zeitverlauf, die Trennung der Abschnitte, das Umgang mit Auslassungen sowie unter allen Audiobedingungen; vor der Veröffentlichung ist daher eine manuelle Überprüfung erforderlich.

SituationMögliche ErgebnisseSchwerpunkte der Überprüfung
Vorlesen nach dem EntwurfIn der Regel ist eine Abstimmung einfacher.Pausen und Länge der Untertitelsegmente
Kleine AussprachefehlerMögliche fehlerverzeihende AusrichtungZeitpunkte vor und nach dem Fehler
Massive ImprovisationMögliche Fehlmatches oder Sprünge in den AbschnittenText umformulieren und nach der Transkription neu strukturieren
MehrfachgesprächDie Rollen und Reihenfolge können durcheinandergeraten.Getrennte Verarbeitung oder in Abschnitten
Die Hintergrundmusik ist ziemlich laut.Die Zeitbestimmung kann beeinträchtigt werden.Mit trockener Stimme erneut einreichen

Urheberrecht und Privatsphäre

Audio-, Text- und Videomaterial können vertrauliche Inhalte enthalten; vor dem Hochladen sollten die Richtlinien der Plattform sowie die Anforderungen an die Vertraulichkeit des Projekts überprüft werden.

  • Bearbeiten Sie nur Aufnahmen, die Ihnen gehören oder für die Sie autorisiert sind.
  • Für die Stimmen der Personen sowie den Inhalt der Interviews ist eine Genehmigung erforderlich.
  • Der Script darf keine Kontoinformationen oder Identifikationsdaten enthalten.
  • Kurse zum Thema Wirtschaft sollten die Urheberrechte an den Materialien berücksichtigen.
  • Für geheime Projekte ist zunächst die Vorschrift der zuständigen Einheit zu konsultieren.
  • Verwalten Sie die Cloud-Aufgaben rechtzeitig nach dem Herunterladen der Ergebnisse.
  • Entfernen Sie sensible Untertitelinhalte vor der Veröffentlichung nach außen.

API und Open Source

Derzeit wurden keine Untertitel gefunden, die auf eine öffentliche API, ein offizielles SDK, ein Repository mit dem Quellcode des Produkts oder ein verifizierbares offizielles GitHub-Projekt hinweisen.

ProjektAktuelle SituationErklärung
Web-ToolsBereitgestelltNach der Registrierung die Ton-Schrift-Alignierung verwenden
Öffentliche APINoch nicht veröffentlichtEntwickler-Dokumentation nicht gefunden
Offizielles SDKNoch nicht veröffentlichtKein verifizierbares Entwicklungs-Paket gefunden.
Quellcode des ProduktsNicht open sourceOnline-Geschäftsdienste
Offizieller GitHubNoch nicht bestätigtProjekte mit demselben Namen können nicht als offiziell angesehen werden.

Vorteile des Produkts

  • Konzentrieren Sie sich auf den Zeitstrahl der Untertitel für audiodateien mit Text.
  • Verringerung der Tippfehler durch die allgemeine Erkennung.
  • Es ist möglich, im universellen SRT-Format zu exportieren.
  • Die Registrierung bietet kostenlose Probeminuten.
  • Der Preis für das Paket mit längerer Laufzeit ist niedriger.
  • Geeignet für Kurse und festgelegte Texte für Sprachaufnahmen.

Nutzungsbeschränkungen

  • Es muss ein Text vorbereitet werden, der zur Aufnahme passt.
  • Eignet sich nicht für die direkte Transkription von umfangreichen Improvisationen.
  • Hintergrundmusik und mehrere sprechende Personen erhöhen die Schwierigkeit.
  • Die Genauigkeit der Marketingmaßnahmen bedeutet nicht, dass keine manuelle Überprüfung mehr notwendig ist.
  • Die alten Mitgliedsregeln können sich von den aktuellen Produkten unterscheiden.
  • Sprachsynthese ist derzeit nicht als vollständig verfügbare Funktion verfügbar.
  • APIs, SDKs und Open-Source-Code sind derzeit noch nicht veröffentlicht.

Häufige Fragen

Was können Untertitel im Grunde tun?

Es synchronisiert die vorhandenen Audiodateien mit dem fertigen Text und erzeugt automatisch SRT-Untertiteldateien, die in Bearbeitungsprogramme importiert werden können.

Sagen die Untertitel, es handelt sich um ein Tool zur Spracherkennung?

Nein, es dient hauptsächlich der Zuordnung von Ton und Text – der Benutzer muss zunächst den entsprechenden Text bereitstellen. Freies Sprechen ohne Text eignet sich besser für Spracherkennungstools.

Sagt die Untertitelung, dass sie kostenlos genutzt werden können?

Ja, neue Nutzer können bei der Registrierung 100 Minuten kostenlose Nutzung erhalten. Die Details zu der Aktion sowie die Bedingungen für die Inanspruchnahme sind auf der Konto-Seite zu finden.

Was kostet das Professional-Paket, steht im Untertitel?

Auf der offiziellen Website wird angegeben, dass 125 Yuan 30.000 Minuten umfassen – das entspricht etwa 0,004 Yuan pro Minute. Die genaue Gültigkeitsdauer ist auf der Zahlungsseite zu entnehmen.

Sagen die Untertitel, dass die erzeugten Untertitel unbedingt genau sein müssen?

Texte, die auf den Inhalten des Benutzers basieren, können Tippfehler verringern, doch bei Zeitachsen, Satzzeichen und Abweichungen im Text können immer noch Fehler auftreten. Vor der Veröffentlichung muss alles sorgfältig überprüft werden.

Sagen die Untertitel, dass jetzt Sprachsynthese verfügbar ist?

Die aktuelle Startseite ist als bald verfügbar oder in einer begrenzten Beta-Phase gekennzeichnet; die Sprachsynthese-Funktionen der alten Mitgliederseite können nicht direkt als vollständig verfügbar angesehen werden.

Sagen die Untertitel, dass eine API oder Open-Source-Code bereitgestellt wird?

Derzeit wurden keine überprüfbaren öffentlichen APIs, offizielle SDKs, Quellcode-Repositorys für das Produkt oder offizielle GitHub-Projekte gefunden.

©️ Urheberrechtshinweis: Sofern nicht anders angegeben, liegen die Urheberrechte an allen Artikeln auf dieser Website beiTeilen von AI-ToolsAlle Urheberrechte liegen bei uns. Ohne Genehmigung darf keine Person, kein Medienunternehmen, keine Website oder irgendeine Gruppe den Inhalt dieser Website kopieren, nachahmen oder auf andere Weise verbreiten. Ebenso ist es nicht gestattet, Spiegelseiten auf Servern zu erstellen, die nicht uns gehören. Andernfalls behalten wir uns das Recht vor, rechtliche Schritte gegen die Verantwortlichen einzuleiten.

Werkzeuge, ähnlich denen, die in den Untertiteln erwähnt werden