Auphonic
KI-Tools zur automatischen Bearbeitung von Lautstärke, Rauschreduzierung, Equalisierung und Veröffentlichung von Podcasts
Tags:KI-Audio-ToolsWas ist Auphonic?
Auphonic ist eine Plattform für die automatisierte Audio-Postproduktion sowie für die Bearbeitung von Podcast-Masterdateien. Die Nutzer laden bereits aufgenommene Audiodateien oder Videos hoch. Das System analysiert dabei die Sprache, Musik und Hintergrundgeräusche und führt automatisch Aufgaben wie Lautstärkeanpassung, Reduzierung von Störgeräuschen und Halleffekten, Filterung, AutoEQ, Lautstärkennormalisierung sowie Begrenzung der Spitzenwerte durch. Anschließend werden Dateien erzeugt, die den Anforderungen für Podcasts, Radio, Streaming-Dienste oder Hörbücher entsprechen.
Es handelt sich weder um eine Plattform zur Fernaufnahme noch um eine digitale Audio-Workstation, bei der komplexe manuelle Bearbeitungen im Vordergrund stehen. Auphonic eignet sich besser als „letzter automatischer Nachbearbeitungsschritt“ in einem Produktionsprozess: Zunächst wird der Inhalt und die Struktur in einer Aufnahm- oder Bearbeitungssoftware erstellt, anschließend sorgt Auphonic dafür, dass die Klangqualität, Lautstärke sowie die Metadaten optimiert werden – außerdem übernimmt es den Veröffentlichungsprozess.
Kernfunktionen von Auphonic
Intelligent Leveler – intelligente Elektronische Nivellierung
Adaptive Leveler erkennt verschiedene Sprecher, Musikstücke und Hintergrundgeräusche, hebt leisere Stimmen hervor und reguliert zu laute Passagen – ohne dabei Atemgeräusche, Windgeräusche oder Stille unnötig zu verstärken. Es eignet sich für Inhalte, die hauptsächlich aus Sprache bestehen, wie Interviews, Podcasts, Kurse, Konferenzen und Kommentare, und reduziert die Notwendigkeit manueller Kompression sowie der individuellen Anpassung der Lautstärke für jeden Abschnitt.
Rauschreduzierung, Reverb-Entfernung und Sprachreparatur
Die Funktionen zur Reduzierung von Störgeräuschen und Reverb dienen dazu, anhaltende Hintergrundgeräusche sowie Umgebungsgeräusche, die sich im Laufe der Zeit ändern, zu bewältigen. Der Benutzer kann außerdem entscheiden, ob er Elemente wie Musik oder Atemgeräusche beibehalten oder reduzieren möchte. Filterung, AutoEQ und Bandwidth Extension werden eingesetzt, um das Frequenzverhältnis zu verbessern sowie Zähneknirschen, plosive Laute sowie unzureichende Bandbreite zu beseitigen.
Starke Clipping-Effekte, sehr starke Echoeffekte oder mehrere Personen, die gleichzeitig sprechen, lassen sich nur schwer vollständig beheben – die Aufnahmqualität bleibt stets begrenzt.
Lautstärkennormalisierung und True Peak-Beschränkung
Auphonic kann die durchschnittliche Lautstärke verschiedener Dateien anhand von LUFS, RMS und dem tatsächlichen Peakwert einheitlich gestalten und unterstützt gängige Standards wie EBU R128, ATSC A/85 sowie Podcasts und mobile Audio-Formate wie YouTube, Spotify, Netflix, Audible/ACX. Der True Peak Limiter verwendet Überabtastung, um Spitzenwerte zwischen den Abtastungen zu vermeiden, und eignet sich dazu, vor der Veröffentlichung die Konformität mehrerer Programme und Plattformen sicherzustellen.
Automatische Entfernung von Pausen, Füllwörtern und Husten
Die Plattform kann zu lange Pausen, Unterbrechungen, Hustenanfälle sowie Füllwörter wie „Ah“, „Hmm“ in mehrsprachigen Texten erkennen und entfernen. Durch das automatische Schneiden können versehentlich Pausen, die zur Gestaltung des Rhythmus dienen, entfernt werden. Deshalb sollten bei formellen Sendungen zunächst die Ergebnisse der Bearbeitung angezeigt werden, und gegebenenfalls sollten die betreffenden Abschnitte wieder hinzugefügt werden.
Mehrspuriges automatisches Mischen
Die Multitrack-Produktion analysiert die verschiedenen Spuren wie Moderator, Gäste und Musik getrennt voneinander und erstellt anschließend automatisch das endgültige Mix. Dabei werden Funktionen wie automatisches Ducking, Noise Gate sowie die Behandlung von Mikrofonstörgeräuschen unterstützt. Jede Spur sollte in einer eigenen Datei gespeichert werden und zum selben Zeitpunkt beginnen.
Ein Sprecher sollte am besten einer Spur zugeordnet werden, und die Musik sollte von der Stimme getrennt sein.
Es ist für Sprachprogramme konzipiert und eignet sich nicht für die kreative Mischung von rein musikalischen Werken.
Transkription, Anmerkungen und Kapitel
Die Benutzer können Auphonic Whisper aktivieren oder eine externe Spracherkennungsdienstleistung anschließen, um transkribierte Texte mit Zeitstempeln zu erzeugen. Das System kann außerdem automatisch Zusammenfassungen, Tags, Anmerkungen und Kapitel erstellen sowie Metadaten in die Ausgabedatei schreiben.
Mehrspurige Projekte ermöglichen die getrennte Identifizierung jeder Sprecherin und jedes Sprechers, wodurch der Einfluss von Störgeräuschen auf die Genauigkeit verringert wird. Der automatisch erzeugte Text muss dennoch manuell hinsichtlich Namen, Zahlen und Fachbegriffen überprüft werden.
Kodierung, Video, Veröffentlichung und Automatisierung
Bei einer einzigen Bearbeitung können mehrere Formate wie MP3, AAC, WAV, FLAC usw. erzeugt werden. Es ist außerdem möglich, Coverbilder, Metadaten sowie Kapitel hinzuzufügen. Zudem können die Tonspuren in Videos bearbeitet und Audiospektren erstellt werden. Die Plattform unterstützt die Verbindung mit Cloud-Speicherdiensten sowie Podcast-Veröffentlichungsdiensten. Mit Presets, Watch Folder, Batch-Verarbeitung, Zapier, CLI sowie REST-API kann der Prozess von „Upload – Bearbeitung – Veröffentlichung“ automatisiert werden.
API und GitHub
Auphonic bietet eine einfache API sowie eine vollständige JSON-API. Mit Hilfe von API-Schlüsseln, Basic Auth oder OAuth 2.0 können Einzel- oder Mehrspur-Aufgaben erstellt werden, Dateien hochgeladen werden, Vorlagen angewendet werden, der Fortschritt abgefragt und die Ergebnisse abgerufen werden. Die offizielle GitHub-Community stellt Beispiele für API-Code in den Sprachen Python, JavaScript, PHP und Shell zur Verfügung.
Dass ein Beispiel unter Open Source verfügbar ist, bedeutet nicht, dass Auphonics Cloud-Audio-Algorithmen und -Modelle ebenfalls unter Open Source stehen.
Vergleich der Preise und Pakete von Auphonic
Auphonic zieht die Credits abhängig von der Länge des ausgegebenen Audios nach erfolgreicher Verarbeitung ab; die Mindestabrechnungszeit beträgt 3 Minuten. Die monatliche Mitgliedschaft beinhaltet feste, wiederkehrende Credits – bei jährlicher Zahlung werden etwa 20 % eingespart.
Nachstehend ist der Wechselkurs zum US-Dollar zum Zeitpunkt der Überprüfung angegeben; Steuern und Gebühren sowie die Zahlungsbedingungen können variieren.
| Plan | Verarbeitungsdauer | Monatsgebühr / Jahresgebühr, durchschnittlich pro Monat | Passende Szenarien |
|---|---|---|---|
| Auphonic Free | 2 Stunden/Monat | 0 US-Dollar | Testen Sie den Kernalgorithmus; kostenlose Ausgabe mit Auphonic-Jingle, keine Anrechnung auf das Kontingent |
| Auphonic S | 9 Stunden/Monat | 13,75 / 11 US-Dollar | Persönliche Podcasts und seltenere Updates |
| Auphonic M | 21 Stunden/Monat | 31,25 / 25 US-Dollar | Stabile wöchentliche Ausstrahlung oder mehrere Programmblöcke |
| Auphonic L | 45 Stunden/Monat | 65 / 52 US-Dollar | Hochfrequenter Inhalt und kleine Produktionsteams |
| Auphonic XL | 100 Stunden/Monat | 141,25 / 113 US-Dollar | Ateliers, Kurse und Serienproduktionen |
| Auphonic XXL | 250 Stunden/Monat | 306,25 / 245 US-Dollar | Großangelegte Audio-Produktion |
| Business | 1000 Stunden/Monat oder mehr | Kontaktieren Sie den Verkauf | Teamkonten, maßgeschneiderte Verträge, manuelle Rechnungen und Massenverarbeitung |
Recurring Credits werden monatlich zurückgesetzt, der ungenutzte Teil wird nicht übertragen. Bei unregelmäßigem Verbrauch können einzeln 5, 10, 25, 50, 100, 250, 500, 1000, 2000 oder 3000 Stunden an One-Time Credits erworben werden;
Solche einmaligen Limits verfallen niemals. Die genauen Preise sind auf der Kaufseite angegeben. Zudem kann eine automatische Auffüllung des Kontostands bei einem unter dem festgelegten Wert liegenden Saldo aktiviert werden.
Unterschiede zwischen der kostenlosen und der kostenpflichtigen Version
| Fähigkeiten | Free | Monatliche/Einmalzahlung | Jahresabonnement/Unternehmen |
|---|---|---|---|
| Kernausgleich, Rauschreduzierung, AutoEQ, Lautstärke | Unterstützung | Unterstützung | Unterstützung |
| Mehrspur-Produktion | Einmal weniger als 20 Minuten | Unterstützung | Unterstützung |
| Mehrsprachige Transkription, automatische Anmerkungen und Kapitel | ohne | Unterstützung | Unterstützung |
| Watch Folder und Massenerstellung | ohne | Unterstützung | Unterstützung |
| Ausgabe-Jingle | Enthält | Keines | Keines |
| Teamkonto und Priorisierung | ohne | ohne | Unterstützungsrichtung |
Wie werden die Credits berechnet?
- Es wird nach der Länge des endgültig ausgegebenen Audios abgerechnet, und nicht nach der Gesamtlänge der Eingabespuren.
- Bei der Mehrspurproduktion mit 1 Stunde und 4 Spuren werden in der Regel 1 Stunde an Credits verbraucht, um ein 1-stündiges Video zu erstellen.
- Fügen Sie 1 Minute Einleitung zu einer 20-minütigen Sendung hinzu – das ergibt 21 Minuten, die als Zeitraum herangezogen werden.
- Bei Misserfolgen werden keine Credits abgezogen; bei unzufriedenstellenden Ergebnissen kann man auf der Aufgabenseite das Problem beschreiben und eine Rückerstattung beantragen.
- Der offizielle Editor unterstützt eine kostenlose Neubearbeitung, sofern nur die Bearbeitungsergebnisse, Metadaten und Einstellungen geändert und anschließend erneut angewendet werden, ohne die Eingabedatei zu wechseln.
- Zuerst wird die wiederkehrende Option genutzt, danach die einmalige Option und zuletzt der kostenlose Betrag.
Auphonic-Anleitung
- Fertigstellung des Inhaltsmontages:Zuerst werden in dem üblichen Editor große Mengen an Fehlern entfernt, um sicherzustellen, dass die Struktur von Einleitung, Hauptteil und Schluss korrekt ist.
- Erstellen von Production:Laden Sie eine einzige Endmischung hoch, oder laden Sie für jeden Sprecher und jede Musikstücke separat mit synchronen Startpunkten hoch.
- Algorithmus einstellen:Aktivieren Sie für Aufnahmeprobleme Leveler, Noise/Reverb Reduction, AutoEQ sowie Pause/Slang-Cutting.
- Lautstärke auswählen:Podcasts im Stereo-Format beginnen in der Regel bei -16 LUFS; für Monophonie, Rundfunk oder Hörbücher sollten die entsprechenden Normen gewählt werden.
- Einstellungen für die Ausgabe:Wählen Sie das Dateiformat, die Bitrate, das Cover, die Kapitel sowie den Veröffentlichungszweck aus und speichern Sie es als Vorlage für die spätere Wiederverwendung in Sendungen.
- Verarbeiten und überprüfen:Konzentrieren Sie sich beim Anhören auf die Anfangs-, lautesten und leisesten Abschnitte und überprüfen Sie den Schnitt, die Lautstärke, die Transkription sowie die Metadaten.
Auphonic-Anleitung
Erstellung wiederverwendbarer professioneller Workflows
- Erstellen Sie einen Testdatensatz mit echtem Rauschen, Akzenten und mehrsprachigen Abschnitten;
- Vergleichen Sie die Unterschiede in der Verarbeitung durch Intelligent Leveler – wie intelligente Pegelanpassung, Rauschreduzierung, Reverb-Beseitigung sowie Sprachreparatur und Lautstärkennormalisierung und True Peak-Limitierung.
- Beibehalten der ursprünglichen Aufnahmen und unveränderten Transkripte;
- Vor der Veröffentlichung für die Öffentlichkeit eine mündliche Anhörung anberaumen;
- Statistische Auswertung der Verarbeitungszeit, Fehlerquote und Verbrauch von Limits;
- Regelmäßige Aktualisierung des Glossars, der Lizenzen für Töne und der Löschrichtlinien;
Für welche Benutzer geeignet
- Podcaster, die eine ausgewogene, geräuschreduzierte und gut klingende Masterdatei schnell erstellen möchten;
- Pädagogisches Team zur Bearbeitung von Aufnahmen von Vorträgen, Kursen, Konferenzen und Interviews;
- Hersteller von audiophilen Inhalten, die den Lautstärkenormen für ACX, Radio oder Streaming entsprechen müssen;
- Teams, die hoffen, durch API, Watch Folder und automatische Veröffentlichung von Builds eine batchbasierte Pipeline zu erstellen;
- Es gibt bereits Videobearbeitungssoftware, aber für Nutzer von Audio- und Videoinhalten, die eine stabile Automatisierung der letzten Bearbeitungsschritte benötigen.
Häufige Fragen
Ist Auphonic kostenlos?
Monatlich werden 2 Stunden an Audio-Inhalten kostenlos verarbeitet. Der kostenlose Umfang ist nicht anreichbar, und die von kostenlosen Nutzern erstellten Produkte enthalten einen Auphonic-Jingle. Dies eignet sich zum Testen; für eine offizielle Veröffentlichung werden in der Regel bezahlte Credits benötigt.
Kann Auphonic Audition oder andere Videobearbeitungsprogramme ersetzen?
Es kann nicht vollständig ersetzt werden. Es ist gut für die automatische Nachbearbeitung, Lautstärkeneinstellungen und Veröffentlichung, eignet sich jedoch nicht für die Bearbeitung komplexer Inhalte, das Mischen von reinen Musikstücken oder die Erstellung präziser kreativer Effekte.
Wird nach der Gesamtlänge der Spuren abgerechnet?
Nein. In der Regel wird nach der Gesamtdauer der Ausgabe abgerechnet – 4 Synchronisierungsspuren à 1 Stunde ergeben zusammen 1 Stunde Videomaterial, wofür etwa 1 Stunde an Credits benötigt werden.
Verfallen einmalige Credits?
Nein. One-Time Credits verfallen niemals.
Die monatlichen wiederkehrenden Kredite werden bei der monatlichen Neujustierung auf Null gesetzt und können nicht übertragen werden.
Hat Auphonic eine API?
Ja, sowohl kostenlose als auch bezahlte Nutzer können die REST-API nutzen. Zudem werden eine CLI, Zapier, Watch Folder sowie Beispielcodes bereitgestellt. Für eine Integration in großem Umfang oder unter eigenem Markenname wenden Sie sich bitte an den Vertrieb.
Ist Auphonic open source?
Die Kern-Cloud-Bereitstellungsplattformen und Algorithmen sind nicht offen zugänglich. Auf GitHub werden Beispieldateien für APIs bereitgestellt, und einige Community-Cliente sind ebenfalls offen zugänglich – doch das bedeutet nicht, dass man den gesamten Auphonic-Dienst lokal bereitstellen kann.
Guigong-Netzwerk-Sicherheitsnummer: 45132202000164