audEERING
audEERING – macht die Arbeit mit KI-gestütztem Audio effizienter und einfacher.
Tags:KI-Audio-ToolsWas ist audEERING?
audEERING ist ein deutsches Unternehmen für KI im Bereich Sprache und Audio, das sich auf die Extraktion nicht-verbaler Informationen aus Stimmen spezialisiert hat. Sein Hauptprodukt, devAIce, wird in Form von SDKs, Web-APIs und XR-Plugins angeboten und richtet sich an Anwendungen in den Bereichen Software, Hardware, Callcenter, Automobilindustrie, Robotik, Wearables sowie an Forschungsprojekte.
Es handelt sich nicht um eine Website zur Bearbeitung von Aufnahmen, zur Erzeugung von Musik oder zur Umwandlung von Sprache in Text. Der Schwerpunkt des Produkts liegt auf der Erkennung von Tonaktivitäten, akustischen Ereignissen, Ausdrucksdimensionen, Rhythmik, Eigenschaften des Sprechers, Audioqualität sowie der jeweiligen akustischen Umgebung.
Die Hauptprodukte von audEERING
devAIce SDK
Das SDK läuft auf lokalen Geräten und eignet sich für Szenarien, in denen eine geringe Verzögerung, die Offline-Verarbeitung oder das Vermeiden einer ständigen Übertragung von Audio erforderlich ist. Auf der offiziellen Website werden Windows, Linux, macOS, Android und iOS aufgeführt; zudem wird die Unterstützung für die Architekturen x86-64 und ARMv8 angeboten.
devAIce Web API
Die Web-API dient der batchbasierten Analyse von Audioinhalten in der Cloud und ist kein grafischer Editor für normale Benutzer. Entwickler können über die Kommandozeile, direkte HTTP-Anfragen oder Client-Tools in Python, .NET, Java, JavaScript und PHP JSON-Ergebnisse abrufen.
devAIce XR
devAIce XR bringt Sprachausdruck und Szenenerkennungsfähigkeiten in Spiele Engines wie Unity und Unreal. Es kann für virtuelle Charaktere, immersive Erlebnisse und Spielerforschung eingesetzt werden, wobei die genauen Module sowie die kommerziellen Lizenzen noch bestätigt werden müssen.
AI SoundLab
AI SoundLab ist eine Entwicklungsplattform zur Sammlung von Audiodaten und zur Echtzeit-Analyse. Im Bereich der Gesundheitsforschung ermöglicht sie es den Nutzern, ihre Daten zu verwalten. Laut der offiziellen Website werden die entsprechenden Audiodateien sowie persönlichen Informationen in Deutschland gespeichert und können dort auch gelöscht werden.
openSMILE
openSMILE ist ein von audEERING gewartetes Werkzeug zur großskaligen Extraktion von Audio-Features, das zur Analyse von Sprache, Musik, Emotionen, Sprechern und Rhythmus eingesetzt werden kann. Offiziell wird auch eine Python-Bindung bereitgestellt, die es Forschern ermöglicht, direkt gängige Feature-Sete zu extrahieren.
Was kann devAIce analysieren?
BASE-Basispaket
- Sprachaktivitätserkennung, zur Unterscheidung zwischen gesprochenen und nicht-sprachlichen Abschnitten.
- Akustische Ereigniserkennung, zur Identifizierung von akustischen Ereignissen wie Telefonklingeln oder Weinen.
- Sprecherverifikation, zur Vergleich der Stimmenidentitätsmerkmale.
- Automatische Spracherkennung, die Sprache in Text umwandelt.
- Analyse der Audioqualität und Extraktion allgemeiner akustischer Merkmale.
EXPRESSION-Expressionspaket
- Stimmdarstellung und große Darstellungsmodelle.
- Analyse der multimodalen Darstellung.
- Tonfall, Sprachtempo und andere rhythmische Merkmale.
- Kontinuierliche Ausdrucksdimensionen wie Aktivität, Freude und Kontrollgrad.
SPEAKER und SCENE
- Schätzung von Eigenschaften des Sprechers wie Alter und wahrgenommener Geschlecht.
- Unterscheidung zwischen drei Arten von akustischen Szenarien: Innenräume, Außenbereiche und Verkehr.
- Unter den drei großen Kategorien werden weitere acht Szenarien unterschieden.
Für welche Anwendungsfälle eignet sich audEERING?
- Das Callcenter analysiert die Stimme der Kundenservice-Mitarbeiter sowie die Qualität der Gespräche mit den Kunden.
- Roboter, Autos und intelligente Geräte passen ihre Interaktion an die akustische Umgebung an.
- Spiele und XR-Anwendungen lassen virtuelle Charaktere auf den Tonfall des Spielers reagieren.
- Das Marktforschungsteam analysiert die in Interviews und Produktfeedbacks geäußerten Meinungen.
- Forschungseinrichtungen extrahieren reproduzierbare Audiomerkmalen und trainieren Modelle.
- Medizinische Forschungen untersuchen akustische Biomarker, können aber nicht direkt zur klinischen Diagnose verwendet werden.
Leitfaden zur Verwendung der devAIce Web API
- Um die Aufgabe zu bestimmen, sind die Module BASE, EXPRESSION, SPEAKER oder SCENE erforderlich.
- Stellen Sie sich audiovisuelle Materialien mit rechtlicher Genehmigung zur Verfügung und holen Sie die informierte Zustimmung des Sprechers ein.
- Erwerben Sie vorab bezahlte Minuten mit einer kleinen Menge an nicht sensiblen Proben oder wenden Sie sich an den Verkauf, um ein Angebot anzufordern.
- Verwenden Sie zunächst die vom Hersteller empfohlene CLI, um die Dateien hochzuladen und das JSON-Ergebnis zu überprüfen.
- Überprüfen Sie, ob die Abtastrate, die Kanäle, der Rausch sowie die Aufnahmeeinrichtung den Anforderungen des Modells entsprechen.
- Durch manuell annotierte Beispiele werden die Leistungen in verschiedenen Sprachen, Akzenten, Altersgruppen und Umgebungen bewertet.
- Nachdem sichergestellt ist, dass die Ausgabe den Anforderungen entspricht, wählt man entweder eine Client-Bibliothek oder eine direkte HTTP-Integration aus.
- Einführung von Prozessen für das erneute Versuchen bei Fehlern, Überwachung der Limits, Löschung von Daten sowie Zugriffskontrolle.
- Vor dem Go-Live müssen eine Bewertung der Privatsphäre, der Arbeitsbeziehungen, des Antidiskriminierungsgesetzes sowie der regionalen Vorschriften durchgeführt werden.
Empfehlungen zur Integration des SDK
- Vergleichen Sie die Verarbeitungsgeschwindigkeit sowie den CPU- und Speicherverbrauch am echten Zielgerät.
- Verwenden Sie die Sprachaktivitätserkennung, um nicht-sprachliche Abschnitte, die nicht analysiert werden müssen, auszuschließen.
- Gleichzeitig werden ruhige, störende Umgebungen sowie verschiedene Mikrofonbedingungen getestet.
- Man sollte keine hohen Risiken aufgrund eines einzelnen kurzen Audiodateis über eine Person beurteilen.
- Klären, ob die Analyse auf der Geräteebene weiterhin eine Internetverbindung zur Lizenzüberprüfung erfordert.
Vorteile von audEERING
- Fokus auf Audio- und nicht-verbale Sprachanalyse, klar definierte Produktpositionierung.
- Gleichzeitig werden ein SDK für die Geräteseite, eine Cloud-Web-API sowie XR-Plugins bereitgestellt.
- Kann auf Desktop-, Mobil- und eingebetteten Architekturen ausgeführt werden.
- Die Vorab-Zahlung für Web-APIs eignet sich für kleine Tests – es ist keine langfristige Abonnementvereinbarung erforderlich.
- Offiziell wird openSMILE sowie eine Reihe von Audio-Forschungstools gewartet.
- Unterstützung für Clients in verschiedenen Programmiersprachen und direkte HTTP-Aufrufe.
Einsatzbeschränkungen und ethische Risiken
- Die Lautäußerungen entsprechen nicht den wahren Emotionen, Absichten oder der Persönlichkeit einer Person.
- Alter und wahrgenommene Geschlechtszugehörigkeit sind Modellannahmen, die fehlerhaft sein können und Vorurteile verstärken.
- Akzent, Sprache, Kultur, Behinderungen, Ausrüstung und Umgebung können die Ergebnisse beeinflussen.
- Die Bewertungsergebnisse dürfen nicht direkt für hochriskante Entscheidungen wie Einstellung, Entlassung, Versicherung oder Strafverfolgung verwendet werden.
- Stimmen können als biometrische oder gesundheitsbezogene Daten gelten und erfordern eine klare rechtliche Grundlage.
- Gesundheitspräsentationen sind keine medizinischen Produkte und erteilen auch keine medizinischen Ratschläge.
- Die Prepaid-API ist eine Entwickler-Schnittstelle, die keine vollständige visuelle Analysewerkbank enthält.
Preise für die devAIce Web API
Im Folgenden finden Sie die im August 2026 auf der offiziellen Website veröffentlichten Vorauszahlungspläne, die sich für Tests sowie gelegentliche Analysen eignen. Die Zahlungen werden über Stripe abgewickelt; Steuern, Gültigkeitsdauer der Minuten, zusätzliche Module sowie Sonderangebote richten sich nach den Angaben auf der Kaufseite.
| Plan | Einmalpreis | Audio-Minuten | Inhalt | Passende Szenarien |
|---|---|---|---|---|
| Prepaid Entry | 35 Euro | 600 Minuten | Web API, BASE-Paket sowie ein ausgewähltes Modul | Erste Tests und kleine Projekte |
| Prepaid Plus | 250 Euro | 6.000 Minuten | Web API, BASE-Paket sowie ein ausgewähltes Modul | Großskalige Überprüfung und Batch-Analyse |
Die offizielle Website bewirbt derzeit noch die zeitlich begrenzte Verfügbarkeit aller Pakete, doch die Aktion könnte enden. Für Abonnements, SDKs, XR-Plugins, Geschäftslicenzierungen sowie individuelle Beratungen gibt es keine festen Preise – hier muss man sich an den Verkauf wenden, um Klarheit zu erhalten.
Daten und Privatsphäre
Die Datenschutzrichtlinie der Website bezieht sich hauptsächlich auf die Nutzung der Website, Cookies, Kontaktformulare sowie Marketingdaten und legt dar, dass das GDPR eingehalten wird. Die Sprachproben in den Produkten sowie die Inhalte der Kunden unterliegen zudem den Dienstleistungsbedingungen und spezifischen Verträgen; man kann sich daher nicht allein auf die Datenschutzseite der Website verlassen.
Die Dienstbedingungen verlangen, dass der Kunde über die notwendigen Rechte und Zustimmungen für Audio-, Tonproben sowie andere Inhalte verfügt und die Pflichten aus der DSGVO erfüllt. Zudem gewähren die Bedingungen audEERING eine umfassende Genehmigung, die Daten des Kunden zum Erfüllen des Vertrags zu nutzen, zu kopieren, zu ändern und zu präsentieren, sowie die Nutzung von aggregierten, anonymisierten Daten.
Prüfung der Privatsphäre vor dem Bereitstellen
- Bestimmen Sie, welche Zustimmungen für die Aufnahme, den Upload, die Authentifizierung und die Eigenschaftserkennung jeweils erforderlich sind.
- Klären Sie die Aufbewahrungsfristen für das ursprüngliche Audio, die Merkmale, die Transkription und die Ergebnisse der Inferenz.
- Vergleichen Sie den Datenpfad für die Übertragung über Web API und den des SDK am Gerät.
- Einschränkung dessen, wer individuelle Äußerungen und Sprecherattribute einsehen darf.
- Prozesse für den Datenzugriff, die Löschung, Einwände und manuelle Überprüfung einrichten.
Ist audEERING Open Source?
Die Geräte von audEERING, die XR-Plugins sowie das Geschäftsmodell sind keine vollständig open-source-Produkte. Auf GitHub werden openSMILE, die Python-Bindungen, audb, audmodel sowie weitere Forschungstools veröffentlicht, doch für jedes Projekt muss man die jeweilige Lizenz prüfen.
Die Quellcode von openSMILE steht für private Zwecke sowie für Forschung und Bildung – also für nicht-kommerzielle Anwendungen – zur Verfügung. Zudem ist seine Nutzung in Rahmen kommerzieller Forschungsprojekte unter bestimmten Bedingungen erlaubt. Die Verwendung des Codes, von abgeleiteten Versionen oder der daraus gewonnenen Funktionen in kommerziellen Produkten erfordert in der Regel eine eigene kommerzielle Lizenz. Es kann nicht einfach davon ausgegangen werden, dass der Code aufgrund seiner Veröffentlichung im öffentlichen Repository uneingeschränkt als Open Source genutzt werden darf.
Häufige Fragen
Was macht audEERING hauptsächlich?
Es konzentriert sich auf Sprach- und Audio-KI und analysiert mithilfe von devAIce Sprachaktivitäten, Ausdrucksweisen, Eigenschaften der Sprecher, Audioqualität, akustische Ereignisse und Szenarien.
Kann devAIce offline laufen?
Das SDK kann auf lokalen Geräten ausgeführt werden; in der Regel ist es nicht notwendig, die analysierten Audiodaten ständig in die Cloud hochzuladen. Allerdings müssen die Lizenzanforderungen sowie die genauen Einsatzbedingungen bei den Herstellern abgeklärt werden.
Wie viel kostet die devAIce Web API?
Die öffentlichen Vorauszahlungspakete kosten 35 Euro für 600 Minuten und 250 Euro für 6.000 Minuten; für Abonnements, SDKs, XR- Lösungen sowie Unternehmenslizenzen ist eine Anfrage erforderlich.
Kann die Erkennung von Stimme-Emotionen echte Gefühle bestimmen?
Nein. Die Modellanalyse befasst sich mit den Merkmalen der sprachlichen Ausdrucksweise. Die Ergebnisse hängen von Sprache, Kultur, Akzent und Umweltfaktoren ab und sollten daher nicht als Aussage über die wahren Emotionen oder Absichten einer Person angesehen werden.
Kann openSMILE kostenlos für kommerzielle Zwecke genutzt werden?
In der Regel ist das nicht möglich. Die öffentliche Version ist hauptsächlich für nicht-kommerzielle Zwecke sowie für Forschung und Bildung vorgesehen. Für kommerzielle Produkte oder damit verbundene Ableitungen ist in der Regel eine kommerzielle Lizenz erforderlich.
Ist audEERING ein Open-Source-Unternehmen?
Nein. Das Unternehmen stellt mehrere Forschungstools öffentlich zur Verfügung, doch die Kernprodukte für den Geschäftsbetrieb – devAIce sowie Modelle und Dienste – werden weiterhin unter kommerziellen Lizenzen angeboten.
Guigong-Netzwerk-Sicherheitsnummer: 45132202000164