Hamming AI
Hamming AI – ein intelligentes Tool, das sich auf KI-gestütztes Audio konzentriert.
Tags:KI-Audio-ToolsEine kurze Beschreibung
Hamming AI ist eine plattformbasierte Qualitäts sicherheitslösung für Unternehmensumgebungen, die Vor-Produkt-Tests, Produktüberwachung, Sicherheitstests durch „Red Teams“ sowie Regressionstests für Sprach- und Chat-Intelligenzen bietet.
Einführung in die Tools
Die Hauptaufgabe von Hamming besteht nicht darin, für Unternehmen Kundenservice-Roboter zu entwickeln, sondern darin zu überprüfen, ob vorhandene KI-Systeme präzise, natürlich, zuverlässig und sicher sind sowie die Geschäftsziele erfüllen. Das Team kann bestehende Sprachplattformen oder eigene Systeme nutzen, um automatisch Testszenarien zu erstellen, diese anschließend über echte Kommunikationskanäle auszuführen und zu bewerten.
Die Plattform verbindet Tests, Überwachung und Fehlerbehebung zu einem Kreislauf. Fehler, die bei Produktivanrufen auftreten, können in wiederverwendbare Regressionstests umgewandelt werden, die nach Updates von Anweisungen, Modellen oder der Infrastruktur erneut ausgeführt werden, um zu verhindern, dass ähnliche Probleme erneut auftreten.
Produktpositionierung
| Fähigkeitsniveau | Lösung der Probleme | Typische Nutzungsschritte | Hauptausgabe |
|---|---|---|---|
| Simulationsprüfung | Können Agenten in echten Gesprächen versagen? | Entwicklung und Voreilassung | Szenen, Aufnahmen, Transkripte, Bewertungen und Beweise für Misserfolge |
| Regressionstest | Verursacht ein Versionsupdate eine Beeinträchtigung der ursprünglichen Funktionen? | Jede Änderung der Prompt-Worte, des Modells oder des Codes | Versionenvergleich und Veröffentlichungskontrolle |
| Stresstests | Ist das System stabil, wenn die Konkurrenz zunimmt? | Kapazitätsplanung vor der großen Einführung | Verzögerungen, Fehler, Durchsatz und Endindikatoren |
| Sicheres Red Team | Kann es zu einem Ausbruch aus dem System kommen, oder werden Daten eingeschleust bzw. dazu gebracht, preisgegeben zu werden? | Sicherheitsprüfung und kontinuierliche Überprüfung | Risikoidentifikation und reproduzierbare Use-Cases |
| Produktionsüberwachung | Gibt es bei echten Kundenanrufen Probleme hinsichtlich Qualität oder Konformität? | Phase des regulären Betriebs | Alarme, Trends, Überprüfungsqueue und Beweise |
| Produktion von Wiedergaben | Löst die Reparatur das tatsächliche Versagen? | Unfallanalyse und Überprüfung der Reparatur | Tests zur Beibehaltung von Stimme, Zeitablauf und beabsichtigtem Zweck |
Hauptfunktionen
Automatische Erstellung von Testszenarien
Das Team kann Systemanweisungen für Agenten einfügen oder bestehende Plattformen nutzen, damit Hamming eine große Anzahl an normalen Pfaden, Grenzsituationen, feindlichen Eingaben sowie Szenarien mit Akzenten und Rauschen erzeugt. Die Ergebnisse müssen dennoch von Fachleuten überprüft werden, um die Abdeckung und die erwarteten Antworten zu überprüfen.
Audio-Original-Bewertung
Hamming analysiert nicht nur den transkribierten Text, sondern prüft auch direkt auf der Audio-Ebene Aspekte wie Pausen, Unterbrechungen, Stillephasen, lange Monologe eines Sprechers, die Klarheit der Sprache sowie die Stimmung. Dadurch können Probleme festgestellt werden, bei denen der Text zwar korrekt erscheint, aber beim Anhören schlecht klingt.
Mehrfache Dialoge und Prozesse zwischen Anrufen
Die Tests können mehrere Kontexte abdecken und auch Sequenzen erstellen, bei denen derselbe Nutzer über mehrere Anrufe hinweg Termine vereinbart, verschiebt oder storniert. Diese Fähigkeit eignet sich zur Überprüfung der Zustandsbeibehaltung sowie von Prozessen im Rahmen mehrerer Interaktionen.
Erstellung von Use Cases für die Rückkehr zu Anrufen
Das Team kann fehlgeschlagene Anrufe mit einem Klick in wiedergibbare Tests umwandeln und dabei den Audioinhalt des Anrufers, den durch Spracherkennung erzeugten Text, die Zeitachse sowie die beabsichtigte Absicht beibehalten. Nach der Behebung kann man unter denselben Bedingungen erneut testen – das ist einfacher zu überprüfen als ein neues Skript zu schreiben.
Sicherheits- und Konformitäts-Red Team
Die voreingestellten „Red-Team“-Szenarien umfassen Risiken wie Angriffe durch das Einfügen von Hinweisen, Jailbreaking, Sozialengineering, Datenleckagen, den Einsatz von Tools zur Umgehung von Sicherheitsmaßnahmen sowie Handlungen, die gegen die Richtlinien verstoßen. Unternehmen können außerdem Branchenspezifische Skripte definieren, Inhalte festlegen, die offengelegt werden müssen, sowie Fragen, auf die keine Antwort gegeben werden darf.
IVR- und DTMF-Tests
Hamming kann traditionelle Telefonmenüs simulieren, DTMF-Tastenklänge senden und überprüfen, ob der Agent den IVR-Prozess korrekt durchläuft. Zudem unterstützt es eingehende, ausgehende Anrufe sowie direkte WebRTC-Verbindungen.
Herstellung von Gesundheitsuntersuchungen
Die Plattform kann alle paar Minuten eine Gruppe von „Gold-Anrufen“ abspielen, um Veränderungen im Modell, Infrastrukturprobleme oder Rückfälle bei den Eingabedaten zu erkennen. Wenn die Kennzahlen einen Schwellenwert überschreiten, kann das Team per E-Mail, Slack oder über andere Alarmkanäle benachrichtigt werden.
Testbedingungen und Rollensimulationen
- Sprachen, Akzente und Dialekte in verschiedenen Regionen.
- Büros, Straßen, Menschenmengen und andere Hintergrundgeräusche.
- Schnelles oder langsames Sprechen, lange Pausen und unerwartete Eingaben.
- Der Benutzer unterbricht mitten im Gespräch, unterbricht die anderen und der Agent spricht zu lange.
- Ältere Anrufer, emotional aufgeregte und beleidigende Situationen.
- API-Timeout, niedrige Zuverlässigkeit der Spracherkennung und Verlust des Kontexts.
- Prozesse wie Terminvereinbarung, Zahlung, Authentifizierung, Weiterleitung an einen Mitarbeiter und Stornierung.
- Anleitungen zur Injektion, zum Jailbreak, zum Extrahieren sensibler Daten und zum Umgehen von Richtlinien.
Bewertungskriterien
Hamming bewirbt derzeit mehr als 50 integrierte Indikatoren und ermöglicht es, spezielle Bewertungskriterien für das eigene Geschäft in natürlicher Sprache zu definieren. Die Bewertung erfolgt in drei Kategorien: Qualität des Dialogs, erwartete Ergebnisse und Konformitätsrichtlinien – man sollte sich nicht nur auf einen durchschnittlichen Wert konzentrieren.
| Kategorie der Indikatoren | Repräsentative Indikatoren | Mögliche Probleme |
|---|---|---|
| Genauigkeit und Relevanz | Faktengenauigkeit, Absichtserkennung, Relevanz und Illusionen | Falsche Antworten, Missverständnisse bezüglich der Anforderungen oder erfundene Informationen |
| Aufgabe erledigt | Ziele erreicht, Felder erfasst und Toolaufrufe erfolgreich | Mündliche Zusage zur Erfüllung, doch die Hintergrundaktionen scheitern. |
| Verzögerung | Erstes Wort: Zeit, Rundenverzögerung, p50, p90 und p99 | Der Durchschnitt ist in Ordnung, aber kurze Anrufe sind sehr langsam. |
| Dialogfluss | Anzahl der Runden, Unterbrechungen, Stille, Wiederholungen und Monologe | Mechanisches Gefühl, Unterbrechung oder der Nutzer kann nicht eingreifen |
| Sprache und Audio | Klarheit, Rauschen, Akzent und Transkriptionsqualität | Rückgang der Leistung bei bestimmten Personengruppen oder in bestimmten Umgebungen |
| Emotionen | Stimmungs- und Trendniveaus im Sprachbereich | Kundenfrust oder negative Eskalation |
| Konformität | Skript, Einhaltung, Offenlegung, PII, PHI und Zahlungsinformationen | Politische oder regulatorische Risiken |
| Benutzerdefinierte Bewertung | Unternehmensregeln und Branchenschwellenwerte | Unternehmensanforderungen, die mit allgemeinen Indikatoren nicht abgedeckt werden können |
End-zu-Ende-Latenzzerlegung
Die Verzögerungsanalyse umfasst den gesamten Prozess – von der Erkennung von Sprachaktivitäten über die automatische Spracherkennung bis hin zur Verarbeitung durch LLMs sowie der Text-zu-Sprache-Übersetzung. Das Team kann so den Beitrag der einzelnen Komponenten vergleichen, anstatt nur die gesamte Wartezeit zu betrachten, die der Benutzer wahrnimmt.
KI-Bewertung und manuelle Kalibrierung
Hamming verwendet KI, um Absichten und die Gesamtergebnisse zu bewerten, und gibt an, dass die Übereinstimmung zwischen der Bewertung auf Basis des Audiomaterials und der manuellen Beurteilung bei etwa 95 % bis 96 % liegt. Dies sind Werte, die vom Hersteller ermittelt werden; Unternehmen sollten dennoch Blindtests durchführen und die Ergebnisse manuell überprüfen, unter Berücksichtigung ihrer eigenen Sprache, ihres Fachgebiets sowie des Risikoniveaus.
Unterschied zwischen Test- und Produktionsüberwachung
| Projekt | Vor dem Go-Live-Testen | Produktionsüberwachung |
|---|---|---|
| Daten | Künstliche Charaktere und kontrollierte Szenarien | Echte Kundengespräche oder Produktionsbelege |
| Ziel | Bevor es veröffentlicht wird, wurde ein reproduzierbares Problem festgestellt. | Entdeckung von Drift, Unfällen und unbekannten Fehlern |
| Risiken | Nebenwirkungen können im Sandbox-Modus isoliert werden. | Es kommt zu Kontakten mit echten persönlichen und geschäftlichen Daten. |
| Arbeitsweise | Nach Plan, Version oder CI auslösen | Regelmäßige oder wiederkehrende Gesundheitsuntersuchungen |
| Ergebnis | Erfolg, Misserfolg, Indikatoren und Rückgangsunterschiede | Trends, Alarme, Überprüfungen und Beweise für Unfälle |
| Nachfolgende Aktionen | Nach der Reparatur erneut ausführen und entscheiden, ob veröffentlicht werden soll. | In Regressionstests umwandeln und Alarme anpassen |
Beide benötigen gemeinsame Kennzahlen und Anwendungsfälle, können sich jedoch nicht ersetzen. Simulationstests können das gesamte tatsächliche Verhalten nicht abdecken, und die Überwachung in der Produktion sollte kein Vorwand sein, um bei echten Kunden Fehler zu machen.
Unterstützte Sprachen und Akzente
Hamming gibt derzeit an, mehr als 65 Sprachen zu unterstützen, darunter Englisch, Spanisch, Portugiesisch, Französisch, Deutsch, Arabisch, Hindi, Tamil, Japanisch, Koreanisch und Chinesisch.
| Sprache oder Region | Offen aufgelistete Akzente oder Varianten | Testempfehlungen |
|---|---|---|
| Englisch | USA, Großbritannien, Australien, Indien und Neuseeland | Hinzufügen von lokalen Slang-Begriffen, Namen und Nummerformaten |
| Spanisch | Lateinamerika, Europa und Spanischsprachige Länder in den USA | Setzen Sie die Erwartungen je nach Zielmarkt individuell fest. |
| Arabisch | Moderne Standards, Golfregion, Levante, Ägypten und Maghreb | Testen der Dialektwechsel und gemischten Sprachen |
| Chinesisch | Kantonesisch, Traditionelles Chinesisch und Kantonesisch | Getrennte Bewertung von Erkennung, Sprachausdruck und numerischer Darstellung |
| Tamilisch | Indische und srilankanische Varianten | Hinzufügen von regionalen Akzenten und Mischsprache aus Englisch |
| Portugiesisch | Brasilien und portugiesischsprachige Länder in Europa | Verwenden Sie nicht unterschiedliche Bewertungsbasen. |
| Japanisch und Koreanisch | Standards und regionale Varianten | Testen von Höflichkeitsformulierungen, Pausen und Eigennamen |
Die Anzahl der Sprachen bedeutet nicht, dass jede Sprache die gleiche Aussprache, den gleichen Akzentumfang sowie die gleiche Bewertungsgenauigkeit aufweist. Vor dem Veröffentlichen sollten für jeden Zielmarkt eine eigene Gruppe von Sprechern, ein Fachwortschatz sowie manuelle Referenzwerte erstellt werden.
Integrationstauglichkeit
| Plattform oder Protokoll | Anschlussmöglichkeiten | Aktuelle offene Fähigkeiten |
|---|---|---|
| SIP | Rufen Sie die Testnummer an oder lassen Sie sich von der Plattform anrufen. | Eingangstests, Ausgangstests, IVR-Tests und DTMF-Tests |
| LiveKit | API-Schlüssel oder direktes WebRTC | Synchronisierte Agenten, Ausführung von Tests und Überwachung |
| Pipecat | Direkte WebRTC- oder Plattformverbindung | Testen einer benutzerdefinierten Sprachpipeline |
| Daily | WebRTC-Verbindung | Test von Sprach-Agenten für Webseiten |
| ElevenLabs | Verbinden von Konten oder API-Schlüsseln | Importieren von Agenten und Durchführen von Bewertungen |
| Retell | API-Schlüssel und Regionseinstellungen | Automatische Synchronisierung von Agenten, Aufnahmen und Toolaufrufen alle 5 Minuten |
| Vapi | Plattformverbindung | Intelligente Agenten importieren und konsistente Kennzahlen bewerten |
| Bland | Plattformverbindung | Automatische Testung bestehender Sprachagenten |
| Selbstentwickeltes System | SIP, WebRTC oder REST API | Passt sich jeder Kombination aus LLM, ASR und TTS an |
| OpenTelemetry | Importieren von Traces, Spans und Logs | Verknüpfung von Anrufen, Komponenten und Infrastrukturbelegen |
Beispiel für die Retell-Integration
Retell-Verbindungen ermöglichen die Einbindung von Agenten, Bereichen, Toolaufrufen, Transkriptionen und Aufnahmen, wobei standardmäßig alle 5 Minuten eine Synchronisierung stattfindet. Bei Tests sollten eigene Projekte oder Testkonten verwendet werden, um zu vermeiden, dass Lasten und Nebeneffekte in den regulären Geschäftsbetrieb übertragen werden.
Anleitung zur Verwendung
Erste Testung des sprachbasierten Intelligenz-Agenten abgeschlossen
- Erstellen Sie einen Hamming-Arbeitsbereich oder vereinbaren Sie eine Demonstration und überprüfen Sie die Anzahl der Tests sowie die Datenregeln für den aktuellen Plan.
- Wählen Sie LiveKit, Pipecat, ElevenLabs, Retell, Vapi, Bland, SIP oder eine eigene Anbindung.
- Verbinden Sie den Agent mit einem für Tests bestimmten Schlüssel und beschränken Sie die zugänglichen Projekte und Umgebungen.
- Importieren Sie Systemanweisungen, Tool-Definitionen und notwendige Dokumente, damit die Plattform eine erste Szenario erstellen kann.
- Szenarien, erwartete Ergebnisse und Risikostufen werden von Produkt-, QA- und Vertriebsmitarbeitern überprüft.
- Führen Sie zunächst Tests mit kleinen Mengen durch, um zu überprüfen, ob die Anrufe durchgestellt werden können, die Aufnahmen vollständig sind und die Bewertungen korrekt ausfallen.
- Erweiterung auf Akzente, Störgeräusche, Unterbrechungen, fehlerhafte Grenzen und konfrontative Szenarien.
- Prüfen Sie die fehlgeschlagenen Aufnahmen, Transkripte, Tools als Beweismittel sowie Verzögerungen bei den Komponenten und führen Sie die Aktion nach der Behebung erneut aus.
Einführung einer CI/CD-Regressionssperre
- Ordnen Sie die stabilen Normalpfade, die Schlüsselgrenzen und die historischen Unfälle zu versionierten Testmengen zusammen.
- Verwenden Sie die REST-API, um vor jedem Aufruf von Prompten, Tools, Modellen oder der Bereitstellung von Code Tests auszulösen.
- Legen Sie Mindestschwellenwerte für die Aufgabenerfüllung, Genauigkeit, Konformität, Verzögerungen und Schlüsselanwendungen fest.
- Verknüpfen Sie die Testausführungen mit der konkreten Agentenversion, dem Prompt-Hash und dem Deployment-Submission.
- Verhindern Sie die Veröffentlichung, wenn die Schlüsselindikatoren sinken oder Sicherheitsfallbeispiele fehlschlagen.
- Im Bericht sollen Aufnahmen, Transkripte, Aufrufe von Tools sowie Begründungen für die Bewertung zur manuellen Überprüfung aufbewahrt werden.
- Für zufällige Fehlschläge werden Wiederholungslaufe und Kalibrierungen durchgeführt; man sollte die Probleme nicht einfach dadurch verschleiern, indem man die Schwellenwerte senkt.
- Nach dem Go-Live werden neue Produktionsfehler in eine dauerhafte Rückkehr abgewandelt.
Konfiguration der Produktionsüberwachung
- Ermitteln, ob alle Anrufe importiert werden sollen, nur ausgewählte Anrufe oder nur außergewöhnliche Ereignisse.
- Definieren Sie die Berechtigungen für Audio, ursprüngliche Transkripte, maskierte Transkripte, Toolaufrufe und Metadaten.
- Legen Sie Schwellenwerte für Genauigkeit, Konformität, Verzögerung, Emotionen und Aufgabenabschluss fest.
- Schicken Sie technische Probleme an den technischen Kanal, Compliance-Probleme an den Kanal mit eingeschränkter Überprüfung.
- Verwenden Sie den Gold-Call für regelmäßige Gesundheitsuntersuchungen und zur Erfassung der Baseline-Daten.
- Einführung von Prozessen für manuelle Überprüfung, Kennzeichnung, Abdeckung und Kalibrierung.
- Schwere Fehlschläge in Regressionstests umwandeln und einen Verantwortlichen für die Behebung festlegen.
- Regelmäßig überprüfen Sie den Alarmlärm, die Datenspeicherung sowie die Zugriffsrechte der Benutzer.
Erstellung von Wiedergaben und Abschluss des Unfallprozesses
Traditionelle Methoden schreiben oft eine ähnliche Szene auf der Grundlage der Transkription neu, wodurch die ursprüngliche Sprache, Pausen, Störgeräusche und zeitliche Abfolgen leicht verloren gehen. Hamming’s Produktionswiedergabe behält diese Bedingungen bei und verwendet dieselben Fehlerbelege, um neue Versionen zu testen.
- Markieren Sie Produktionsanrufe, die einen Einfluss auf Kunden oder ein hohes Risiko darstellen.
- Überprüfen Sie, ob Aufnahmen, Transkripte, Toolaufrufe und die beabsichtigten Absichten vollständig sind.
- Unnötige personenbezogene Daten entfernen oder in einem kontrollierten Umfeld verwenden.
- Übertragen Sie den Anruf in einen Rückruf-Use Case mit Version- und Verantwortlichkeitsinformationen.
- Führen Sie die gleiche Szene vor und nach der Reparatur aus und vergleichen Sie die Ergebnisse.
- Fügen Sie die Beweise für die Reparatur den Veröffentlichungsprüfungen und Unfallberichten hinzu.
- Überprüfen Sie regelmäßig, ob historische Vorfälle weiterhin umgesetzt werden.
Druck- und Konkurrenztests
Unternehmenslastaktivitäten können mehr als 50.000 parallele Testanrufe durchführen, wobei sowohl eingehende als auch ausgehende Anrufe sowie direkte WebRTC-Verbindungen abgedeckt sind. In einer normalen Arbeitsumgebung liegt die Standardzahl der parallelen Verbindungen bei etwa 50; diese kann auf mehr als 100 erhöht werden. Die genaue Obergrenze hängt vom Konzept sowie von der Kapazität der getesteten Plattform ab.
| Testdimensionen | Indikatoren, die beobachtet werden sollten | Häufige Misserfolge |
|---|---|---|
| Anruf herstellen | Verbindungsrate, Verbindungszeit und Fehlercodes | Nummern-, SIP- oder Regionalbeschränkungen |
| Spracherkennung | WER, Verzögerungen und Prozentsatz der geringen Zuverlässigkeit | Warteschlangen unter Konkurrenz oder Frame-Verluste |
| LLM | Erster Token, Fertigstellungszeit und Fehlerrate | Lieferanteneinschränkungen oder Kontextüberlastung |
| Sprachsynthese | Erster Audio-Stream, Unterbrechungen und Fehlerquote | Unzureichende Audio-Warteschlange oder Quoten |
| Toolaufruf | Erfolg, Zeitüberschreitung, Wiederholung und Idempotenz | Wiederholte Terminvereinbarungen oder wiederholte Schreibvorgänge |
| Gesamtdialog | p50, p90, p99 und Aufgabenabschluss | Im Durchschnitt normal, aber Kollaps am Ende |
| Kosten | Kosten pro Anruf, pro Minute und Kosten des Anbieters | Die Testgröße führt zu unerwarteten Kosten. |
Lasttests verbrauchen gleichzeitig die Quoten für Hamming, Telefonie, Sprache, Modelle sowie Business-APIs. Das Team muss eine maximale Konkurrenzanzahl, Budgets, Sandbox-Umgebungen sowie Mechanismen zur sofortigen Abbruch der Tests festlegen, um die Systeme der Produktionskunden nicht direkt zu beeinträchtigen.
Preise und Pakete
Stand zum 23. August 2026 hat Hamming keine offiziellen Preise für feste Pakete bekannt gegeben. Die Preise richten sich hauptsächlich nach dem Umfang der Tests sowie der Nutzung in der Produktion – und nicht nach der Anzahl der Mitglieder. Die genauen Mengen und Preise werden im Rahmen von Demonstrationen und Einführungsprozessen mitgeteilt.
| Plan oder Phase | Offener Preis | Berechnungsgrundlage | Teamplätze | Hauptanteile |
|---|---|---|---|---|
| Personalisierte Präsentation | Kostenlos | Etwa 25 Minuten Präsentation, kein kostenloses Produkttesten | Nicht anwendbar | Kombinierte Darstellung von realen Agenten und Szenarien |
| Startup-Lösung | Kontaktieren Sie den Verkauf | Hunderte von Testfällen oder tatsächliche Anforderungen | Hauptsächlich wird nicht nach Sitzplätzen berechnet. | Umfang von Tests, Überwachung und Teamzusammenarbeit gemäß Angebot |
| Wachstum oder herkömmliches Team | Kontaktieren Sie den Verkauf | Testmenge, Anzahl der Agenten und Produktionsaufrufe | Man kann das ganze Team einladen. | Höhere Testmenge, Integration und Support |
| Enterprise | Individuelle Kostenschätzung | Großskalige Tests, Produktionsanrufe und vertragliche Anforderungen | Der Sitzplatz ist nicht die Hauptgröße für die Berechnung. | Mengenrabatte, maßgeschneiderte Integration, exklusiver Erfolgsupport und SLA |
Gibt es eine kostenlose Testversion?
Die aktuellen FAQ geben klar an, dass kein herkömmlicher, kostenloser Selbstversuch angeboten wird, sondern dass Teams durch personalisierte Demonstrationen und Einführungen die Möglichkeit erhalten, die eigenen Agenten auszuprobieren. Auf einigen Seiten des Webseiten finden sich weiterhin die alten Schaltflächen „Kostenloser Versuch starten“, wodurch keine Garantie für einen aktuellen kostenlosen Zugang gegeben werden kann.
Vor der Kostenermittlung sollte bestätigt werden.
- Anzahl der Tests pro Monat, Minuten, Konkurrenzanrufe sowie Überwachung der Produktivität.
- Wer trägt die Kosten für Telefonie, Sprache, Modelle und Drittanbieterplattformen?
- Ob die automatische Erstellung von Szenarien, Bewertungswerkzeuge sowie wiederholte Ausführungen separat abgerechnet werden.
- Ob die Speicherung von Daten, die Exportierung sowie die Einrichtung für einen einzelnen Mieter oder in einer bestimmten Region zusätzliche Gebühren verursachen.
- Ob API, MCP, Webhooks, OpenTelemetry und CI/CD enthalten sind.
- Preise für Übermengen, kürzeste Vertragsdauer, Verlängerung, Stornierungs- und Rückerstattungsregeln.
- Wie wird die Schwere des Unternehmensunterstützungsbedarfs mit einer Reaktionszeit von 10 Minuten bis 4 Stunden in Einklang gebracht?
- Einzelpreise und Anforderungen an die Vorkapazität für 50.000 gleichzeitige Lastaktivitäten.
Unterstützung und Service
| Unterstützungsformen | Anwendungsgebiet | Offizielle Erklärung |
|---|---|---|
| E-Mail-Unterstützung | Alle Kunden | Alltägliche Probleme und Anfragen |
| Online-Chat | Alle Kunden | Schnelle Unterstützung im Produkt |
| Exklusiv für Slack | Neukunden | Kontaktieren Sie das Engineering-Team direkt. |
| Integrierte Unterstützung | Alle Kunden, Unternehmen tiefer eingebunden | Unterstützung bei SIP-, WebRTC-, Plattform- und API-Verbindungen |
| Unternehmens-SLA | Enterprise | Reaktionszeit je nach Schweregrad von etwa 10 Minuten bis 4 Stunden |
| Maßgeschneiderte Integration | Enterprise | Entwicklung und Wartung nach Bedarf |
| Kundenerfolgsmanagement | Enterprise | Regelmäßige Überprüfungen, Schulungen und Optimierung |
API, MCP und Entwicklungswerkzeuge
Hamming bietet eine REST-API an, mit der Tests geplant, Ergebnisse abgerufen, Agenten konfiguriert, Testfälle verwaltet sowie Überwachungsdaten eingesehen werden können. Es kann mit GitHub Actions, Jenkins und anderen CI/CD-Pipelines verbunden werden und wird über Webhooks zur Automatisierung genutzt.
Der vollständige Dokumentationstext erfordert einen Zugangscode und ist hauptsächlich für Kunden nach der Einführungsphase zugänglich. In den öffentlichen Marketingmaterialien wird außerdem auf SDKs, MCP-Server sowie die Einbindung von OpenTelemetry hingewiesen; doch Stabilität der Schnittstellen, Berechtigungen und Versionen richten sich nach den Dokumentationen innerhalb des Arbeitsbereichs.
| Entwicklungsfähigkeit | Aktueller Zustand | Hauptverwendungszweck | Hinweise |
|---|---|---|---|
| REST API | Offiziell zur Verfügung gestellt, Dokumente eingeschränkt | Testausführung, Verwaltung von Fallbeispielen und Auslesen der Überwachung | Kundenkonto und Zugangsdaten erforderlich |
| Webhooks | Offizielle Bereitstellung | Verbinden Sie die Testergebnisse und Alarme mit externen Prozessen. | Die Ereignissignatur und das Wiederholen hängen von den Kundenunterlagen ab. |
| CI/CD | Unterstützung | Führen Sie vor jeder Veröffentlichung eine Qualitätsprüfung durch. | Es sind stabile Testsets sowie eine Zuordnung der Versionen erforderlich. |
| OpenTelemetry | Unterstützung | Importieren von Traces, Spans und Logs | Sensible Eigenschaften und die Probenahme sollten kontrolliert werden. |
| MCP-Server | Offizielle Quellen geben an, dass es diese zur Verfügung stellt. | Teste ausführen, Anrufe abrufen und Transkripte suchen | Offizielle Installationsdokumentation ist begrenzt. |
| Python SDK | Die letzte Aktualisierung des öffentlichen Pakets erfolgte im Jahr 2024. | Aufruf der frühen Hamming-Plattform | Version 0.0.17, Kompatibilität mit der aktuellen API muss überprüft werden. |
| JavaScript SDK | Die letzte Aktualisierung des öffentlichen Pakets erfolgte vor längerer Zeit. | Frühe Evals-Frameworks | Kann nicht als Garantie für die Aktivität der aktuellen Hauptverbindung angesehen werden. |
GitHub und Open Source
Die Hamming-Plattform selbst ist ein kommerzielles, geschlossenes Produkt. Auf der offiziellen Website werden weder der vollständige Produktcode noch die Bewertungsmodelle als Open-Source-Projekte veröffentlicht. In öffentlichen Paketverwaltern finden sich frühere SDKs unter Verwendung der MIT- oder ISC-Lizenz, doch diese umfassen nur den Client-Code.
| Projekt | Offener Status | Lizenz oder Wartung | Fazit |
|---|---|---|---|
| Hamming-Handelsplattform | Unveröffentlichter vollständiger Quellcode | Wirtschaftsdienstleistungen | Nicht open source |
| Bewertung von Modellen und Betriebssystemen | Nicht veröffentlicht | Nicht offengelegt | Es handelt sich nicht um ein Projekt mit offenen Gewichten. |
| Hamming-sdk-Python-Paket | Öffentlich | MIT, 0.0.17, Aktualisierung im September 2024 | Frühe SDKs bedeuten nicht, dass die Plattform offen ist. |
| Hamming-SDK JavaScript-Paket | Öffentlich | ISC, 1.0.27, aktualisiert vor etwa zwei Jahren | Frühe SDKs – der Wartungszustand muss überprüft werden. |
| Drittanbieter-C#-SDK | Öffentlich, aber von tryAGI gewartet | MIT | Es handelt sich nicht um den offiziellen Produktcode von Hamming. |
Bei der neuen Integration sollten vorrangig die aktuellen REST-API-Dokumente aus der Kundenarbeitsumgebung verwendet werden, anstatt ausschließlich auf alte SDK-Pakete zurückzugreifen. Bei der Beschaffung sollten klare Angaben zu den unterstützten API-Versionen, zu Benachrichtigungen bei Einstellung der Unterstützung, zum weiteren Entwicklungsverlauf des SDKs sowie zu den Möglichkeiten zur Exportierung gefordert werden.
Datenschutzrichtlinie
Die rechtliche Geschäftseinheit von Hamming ist Forward Inc. Die aktuelle, öffentlich zugängliche Datenschutzrichtlinie wurde zuletzt am 14. Dezember 2024 aktualisiert. Die Richtlinie gilt für Websites, Konten, Verkäufe, Marketing sowie verwandte Dienstleistungen.
| Daten oder Regeln | Aktuelle Politik |
|---|---|
| Konto und Kontaktdaten | Name, Telefonnummer, E-Mail-Adresse, Adresse, Beruf, Benutzernamen und Passwort usw. |
| Zahlung | Die Informationen zu den Zahlungsmitteln werden von Stripe gespeichert. |
| Automatische Erfassung | IP, Browser, Gerät, Nutzungsdauer, Cookies und Analysedaten |
| Sensible Informationen | Erst nach Unterzeichnung eines BAA mit dem Kunden wird verarbeitet. |
| Kundendaten-Training | Wird weder für Schulungen noch zum Vorteil anderer Kunden verwendet. |
| Verkauf von von Nutzern erstellten Daten | Nicht zum Verkauf |
| Webanalyse | Verwendung von Google Analytics |
| Allgemeine Aufbewahrung | Solang das Konto gültig ist und es für die geschäftlichen Zwecke benötigt wird – gesetzliche Vorgaben können eine längere Aufbewahrung erfordern. |
| Backups, die nicht sofort gelöscht werden können | Sichere Trennung, bis sie gelöscht werden können |
| Minderjährige | Keine aktive Sammlung oder Vermarktung an Nutzer unter 18 Jahren |
Die Datenschutzrichtlinien legen keine einheitlichen, festgelegten Aufbewahrungsfristen für alle Aufnahmen, Transkripte und Beweismittel fest. In den FAQ wird erklärt, dass die Testaufnahmen verschlüsselt aufbewahrt werden und dass die Aufbewahrungsfrist nach den Wünschen des Kunden festgelegt werden kann. Vor der Produktion und Verwendung müssen die genauen Werte im Auftrag oder in der DPA festgelegt werden.
Datenrechte
- Eignete Benutzer können die Anfrage stellen, auf persönliche Daten zuzugreifen, diese auszuspielen, zu korrigieren oder zu löschen.
- In einigen Gebieten können Nutzer die Verwendung sensibler Informationen einschränken oder sich gegen eine bestimmte Verarbeitung wehren.
- Die Nutzer können sich von den Werbemails abmelden und die entsprechenden Einwilligungen zurückziehen.
- Nach der Beendigung des Kontos löscht die Plattform oder deaktiviert die Informationen in der aktiven Datenbank.
- Zur Prävention von Betrug, zur Untersuchung sowie zur Durchsetzung von Bedingungen oder gesetzlichen Anforderungen können bestimmte Aufzeichnungen weiterhin aufbewahrt werden.
- Anfragen und Beschwerden bezüglich der Privatsphäre werden über die offizielle E-Mail-Adresse bearbeitet.
Sicherheit und Konformität
Hamming hat im Dezember 2025 die SOC 2-Prüfung abgeschlossen; auf der offiziellen Website wird der Status SOC 2 Type II angegeben. Medizinische Kunden können einen BAA-Vertrag abschließen, um die HIPAA-Vorgaben einzuhalten. Die Plattform bietet zudem Optionen für die Speicherung von Daten in den USA, der EU und im Vereinigten Königreich sowie für die Nutzung als Einzelmieter-Lösung.
| Kontrolle oder Fähigkeit | Aktueller Offenheitsstatus | Einkaufskontrolle |
|---|---|---|
| SOC 2 Type II | Abgeschlossen und auf der offiziellen Website veröffentlicht | Aktueller Bericht, Zeitraum, Umfang und Ausnahmen anfordern |
| HIPAA | Ein BAA kann unterzeichnet werden. | Die Unterzeichnung muss vor dem Eingang jeglicher PHI in die Plattform erfolgen. |
| Verschlüsselung | Verschlüsselung von Aufnahmen und Daten bei Übertragung sowie im Ruhezustand | Bestätigung von Algorithmus, Schlüssel und Backup-Bereich |
| RBAC | Unterstützung | Testen nach ingenieurtechnischen, produktspezifischen, QA- und managementbezogenen Rollen |
| SSO | Unterstützung für Unternehmensidentitätsdienste wie Okta | Bestätigung von SAML oder OIDC, verpflichtende Reichweite und Entzug der Berechtigungen bei Kündigung |
| Prüfprotokoll | Unterstützt und kann in SIEM exportiert werden | Bestätigung der Ereignisabdeckung und Aufbewahrungsfrist |
| Datenverweilung | Optionen für die USA, die EU und das Vereinigte Königreich | Überprüfung aller Zulieferer sowie von Backups und Unterstützungsdaten |
| Einzelmieter | Unternehmensoptionen | Überprüfung der Netzwerkverbindungen, Schlüssel, Updates sowie Trennung der Verwaltungsebenen |
| PII-Überprüfung | Testen und Überwachen des Leckrisikos | Kann die vollständige Desensibilisierung und Zugriffskontrolle nicht ersetzen. |
SOC 2 und BAA bedeuten nicht, dass die Systeme des Kunden automatisch allen Vorschriften entsprechen. Die Einwilligung zur Aufzeichnung von Gesprächen, Kreditkarten, medizinische Informationen, Datenübertragungen in andere Regionen, Marketinganrufe sowie die Haftungsfragen müssen weiterhin vom Kunden konfiguriert, getestet und ständig überwacht werden.
Empfehlungen zur Sicherheit von Produktionsdaten
- Zuerst wird der grundlegende POC mit vollständig synthetisierten Daten durchgeführt, ohne echte Kundenaufnahmen hochzuladen.
- Überprüfung des SOC 2-Anwendungsbereichs, DPA, BAA, Zulieferer, Datenflüsse und Ereignisreaktion.
- Für Audio, die ursprüngliche Transkription, die maskierte Transkription, Metadaten sowie Tool-Evidenzen werden jeweils unterschiedliche Aufbewahrungsfristen festgelegt.
- Konfigurieren Sie SSO, MFA, RBAC und Mindestberechtigungen sowie überprüfen Sie die Zugriffe regelmäßig.
- Entfernen Sie vor der Importierung unerwünschte PII, PHI, Zahlungskarten und Zugangsdaten.
- Bedingungen und Prüfungen, die den Zugang von Personal für manuelle Unterstützung zu echten Produktionsbelegen einschränken.
- Überprüfen Sie die Prozesse für Export, Löschung, Backup von Ablaufdaten und Vertragsbeendigung.
- Jedes Mal, wenn ein neues Modell, eine neue Plattform, ein neuer Markt oder ein neuer Auftragnehmer hinzugefügt wird, muss die Risikobewertung erneut durchgeführt werden.
Für welche Benutzer geeignet
- Team für Sprach-AI-Entwicklung: Überprüfung von Prompten, Modellen, ASR, TTS, Tools und Verzögerungen.
- QA-Team: Erstellung von Automatisierungs-Szenarien, Regressionssätzen und Release-Gates.
- Produktmanager: Definition des Geschäftserfolgs und Vergleich verschiedener Agenten-Versionen.
- Kundenservice und Betrieb: Identifizierung von Fehlern in den Produktionsanrufen sowie der Schmerzpunkte der Kunden.
- Sicherheitsteam: Durchführung von Prompt-Injection-, Jailbreak-, PII-Leckage- und Tool-Übergriffstests.
- Compliance-Team: Überprüfung von Skripten, Authentifizierung, Offenlegung und Prüfungsbelegen.
- Medizinische und Finanzinstitutionen: Überwachen von hochriskanten Sprachprozessen nach Unterzeichnung des geltenden Vertrags.
- Plattformhersteller und Systemintegratoren: Einheitliche Kennzahlen für mehrere Sprachanbieter.
Typische Anwendungsszenarien
- Vor dem Go-Live des Terminroboters wird die Erstellung, Änderung, Stornierung sowie das Schreiben von Tools überprüft.
- Vergleichen Sie nach dem Austausch von LLM, ASR oder TTS Qualität, Verzögerung und Kosten.
- Es wird eine historische Regression auf neue Prompt-Wörter durchgeführt, um zu verhindern, dass alte Probleme erneut auftreten.
- Prüfung von Akzenten, Störgeräuschen, Unterbrechungen und komplexen Gesprächen mit mehr als 70 Runden.
- Die maximale Kapazität eines Unternehmens wird anhand von mehr als 50.000 gleichzeitigen Aktivitäten bewertet.
- In der Produktionsumgebung werden kontinuierlich Halluzinationen, Abweichungen vom Skript sowie Datendurchbrüche überwacht.
- Führe die Fehlschläge echter Kunden in die reparierte Version zurück und erzeuge Nachweise für die Veröffentlichung.
- Verbinden Sie die Testergebnisse mit CI, Slack, SIEM und OpenTelemetry.
Vorteile des Produkts
- Vollständiger Lebenszyklus für Tests, Überwachung, Red Team, Wiedergabe und Regressionstests.
- Durch die direkte Analyse des Audios lassen sich Interaktionsprobleme erkennen, die im transkribierten Text nicht sichtbar sind.
- Erstellt automatisch zahlreiche Szenarien auf der Grundlage von Prompten und senkt so die Kosten für manuelle Erstellung.
- Unterstützung für mehr als 65 Sprachen, regionale Akzente, Störgeräusche und verschiedene Sprechverhaltensweisen.
- Es bietet Anschlüsse an verschiedene führende Sprachplattformen sowie Unterstützung für SIP, WebRTC und eigene entwickelte Systeme.
- Mehr als 50 integrierte Indikatoren sowie eine unbegrenzte Anzahl an benutzerdefinierten Bewertungsmethoden.
- Unterstützung für CI/CD, REST API, Webhooks und OpenTelemetry.
- Die parallele Last einer Unternehmensanwendung kann auf über 50.000 Verbindungen erweitert werden.
- SOC 2 Typ II, BAA, Datenaufbewahrung, SSO und Single Tenant erfüllen die Anforderungen der Unternehmen bei der Beschaffung.
- Die Abrechnung erfolgt hauptsächlich nach der Menge der Tests und nicht nach der Anzahl der Plätze; bei der Zusammenarbeit zwischen Teams entstehen keine zusätzlichen Kosten für weitere Plätze.
Hauptbeschränkungen
- Es gibt keine offiziell festgelegten Paketpreise; das Budget muss durch eine Präsentation und ein Angebot ermittelt werden.
- Es wird kein traditionelles kostenloses Selbstversuch-Angebot bereitgestellt, wodurch die Hürden für einzelne Entwickler recht hoch sind.
- Offene Dokumente erfordern einen Zugriffscode; API-Endpunkte und Berechtigungen können vor dem Kauf nicht vollständig eingesehen werden.
- Die alten Python- und JavaScript-SDKs wurden seit etwa zwei Jahren nicht mehr aktualisiert, weshalb die Kompatibilität überprüft werden muss.
- Auch wenn die von KI ermittelten Bewertungen mit denen von Menschen übereinstimmen, können sie in neuen Sprachen oder Bereichen Abweichungen aufweisen.
- Tests mit hoher Konkurrenz belasten gleichzeitig die Kosten für Telefonie, Sprachdienste, Modelle sowie Business-APIs.
- Die Produktionsüberwachung befasst sich mit echten Aufnahmen, Transkripten und Tool-Evidenzen und erfordert eine strenge Datenverwaltung.
- Die von den Herstellern angegebenen Werte von 95 % Genauigkeit bei den Prognosen, 95 % bis 96 % Übereinstimmung bei manuellen Überprüfungen sowie 90 % Erfolgsrate gegenüber Konkurrenzprodukten müssen in eigenen Tests überprüft werden.
- Die Plattform dient der Qualitätssicherung in Unternehmen und ist nicht dazu bestimmt, eine vollständige Laufzeitumgebung für Sprachintelligenzen zu erstellen.
Unterstützungsplattformen
| Plattform oder Methode | Unterstützungszustand | Hauptverwendungszweck |
|---|---|---|
| Web-Konsole | Unterstützung | Konfigurationstests, Anschauen von Aufnahmen, Berichte, Trends und Überwachung |
| SIP-Telefonie | Unterstützung | Eingehende Anrufe, ausgehende Anrufe, IVR, DTMF sowie herkömmliche Telefonverbindungen |
| WebRTC | Unterstützung | LiveKit, Pipecat, Daily und Web-Agenten |
| REST API | Unterstützung, Kundendokumentation eingeschränkt | Automatisierte Tests, Ergebnisse und Überwachung |
| Webhooks | Unterstützung | Verbindung von Pipelines, Alarmen und externen Systemen |
| CI/CD | Unterstützung | GitHub Actions, Jenkins und andere Systeme |
| OpenTelemetry | Unterstützung | Einführung von Tracking, Abständen und Protokollen |
| MCP | Offizielle Quellen geben Unterstützung an | Anrufe abfragen, Qualität analysieren und Tests durchführen |
| Native Mobile-Apps | Nicht gefunden | Hauptsächlich über Webseiten genutzt |
| Browser-Erweiterungen | Nicht gefunden | Keine offenen Erweiterungen |
Grundlegende Informationen
| Projekt | Inhalt |
|---|---|
| Name des Tools | Hamming AI |
| Rechtliche Person | Forward Inc |
| Gründungsdatum | 2024 |
| Gründer und CEO | Sumanyu Sharma |
| Beschleuniger | Y Combinator S24 |
| Produkttyp | Testen, Überwachen und Sicherheitsbewertung von Sprach- und Chat-Assistenten |
| Hauptkunden | Sprach-AI-Team, Kundenservice für Unternehmen, Gesundheitswesen, Finanzwesen und hochwachsende Unternehmen |
| Sprache | Mehr als 65 Arten |
| Integrierte Indikatoren | Mehr als 50 |
| Unternehmenslast | Mehr als 50.000 gleichzeitige Testanrufe |
| Preisgestaltung | Individuelle Kostenvoranschläge, hauptsächlich abhängig von der Menge an Tests und der Nutzung. |
| Traditionelle kostenlose Testversion | Nicht angeboten, stattdessen individuelle Demonstration und Einführung |
| API | Ja, der vollständige Dokument ist für Kunden einsehbar. |
| SDK | Es gibt frühe Python- und JavaScript-Pakete; die aktuelle Wartung muss überprüft werden. |
| Ob Open Source | Das Produkt ist nicht open source, einige alte Client-SDKs sind jedoch open source. |
| SOC 2 | Type II |
| HIPAA | Unterstützung bei der Unterzeichnung eines BAA |
| Datenverweilung | Optionen für die USA, die EU und das Vereinigte Königreich |
| Prüfdatum | 23. August 2026 |
Empfehlungswert
Empfehlungswert: 4,7 / 5. Hamming bietet eine umfassende Lösung für die Bewertung von Audiodaten in ihrer ursprünglichen Form, die Simulation realer Szenarien, die Überwachung der Produktion sowie die Wiedergabe von Audiodaten – zudem ist es möglich, es mit CI-Zugangssystemen zu verbinden. Es eignet sich besonders für Teams, die bereits Sprachintelligenzsysteme in der Produktion einsetzen.
Die Preise sowie die vollständigen Dokumente sind nicht öffentlich zugänglich. Zudem beinhaltet die Überwachung der Produktion hochsensible Daten. Daher eignet sich diese Lösung eher für Organisationen mit formalen Einkaufs-, Sicherheits- und QA-Prozessen – und nicht für einzelne Nutzer, die nur kostenlose Tests mit einigen Telefonrobotern durchführen möchten.
Häufige Fragen
Was ist Hamming AI?
Hamming AI ist eine Plattform zur Testung und Überwachung von Sprach- und Chat-Agenten, die zur automatischen Simulation von Gesprächen, zur Bewertung der Qualität, zur Durchführung von Red-Team-Tests, zur Überwachung von Produktionsgesprächen sowie zur Umwandlung von Fehlern in Regressionstests dient.
Wird Hamming mir helfen, einen Sprachroboter zu erstellen?
Seine Hauptfunktion besteht nicht darin, intelligente Agenten zu erstellen, sondern diese bereits vorhandenen Agenten miteinander zu verbinden und zu bewerten. Die Benutzer müssen zunächst über Vapi, Retell, ElevenLabs, LiveKit, Pipecat oder ein eigenentwickeltes Sprachsystem verfügen.
Wie viel kostet Hamming AI?
Die offizielle Website gibt keinen festen Betrag an. Die Preise richten sich hauptsächlich nach dem Umfang der Tests sowie der Nutzung in der Produktion – und nicht nach der Anzahl der Teammitglieder.
Gibt es eine kostenlose Testversion von Hamming?
Laut den aktuellen FAQ gibt es keine traditionelle, kostenlose Selbstversuchsmöglichkeit. Das Team kann individuelle Demonstrationen vereinbaren und im Einstieg seine eigenen Agenten sowie Szenarien ausprobieren.
Unterstützt Hamming Chinesisch?
Chinesische Tests werden unterstützt, wobei Varianten wie Simpliziertes Chinesisch, Traditionelles Chinesisch und Kantonesisch angeboten werden. Die tatsächliche Erkennung, die Audio-Bewertung sowie die Behandlung von Fachbegriffen müssen weiterhin durch einheimische Sprecher kalibriert werden.
Wie testet Hamming Unterbrechungen und Verzögerungen?
Die Plattform simuliert das Unterbrechen des Sprechens, längeres Schweigen, unterschiedliche Sprechgeschwindigkeiten sowie andere echte Verhaltensweisen und unterteilt die Verzögerung in VAD, ASR, LLM und TTS, wobei gleichzeitig p50, p90 und p99 angezeigt werden.
Unterstützt Hamming die Produktüberwachung?
Unterstützung. Es kann echte Anrufe kontinuierlich bewerten, bei Überschreitung von Schwellenwerten Alarme auslösen, wichtige Anrufe wiedergeben und Produktionsfehler in dauerhafte Regressionstests umwandeln.
Kann Hamming eigene Sprachintelligenzen testen?
Ja. Eigenentwickelte Systeme können über SIP, WebRTC oder REST-APIs angeschlossen werden – ohne dass man auf bestimmte Anbieter für LLMs, Spracherkennung oder Sprachsynthese angewiesen ist.
Erfüllt Hamming die HIPAA-Vorgaben?
Hamming kann mit medizinischen Kunden einen BAA abschließen und entsprechende Sicherheitsmaßnahmen bereitstellen. Zunächst muss ein BAA sowie eine Überprüfung der Daten abgeschlossen werden; PHI darf nicht ohne Unterzeichnung hochgeladen werden.
Wird Hamming Modelle mit Kundendaten trainieren?
Die offizielle Datenschutzerklärung besagt ausdrücklich, dass Kundendaten weder zur Schulung verwendet noch zu Vorteil anderer Kunden genutzt werden, und dass Nutzererstellte Daten nicht verkauft werden.
Ist Hamming Open Source?
Die vollständige Plattform ist nicht open source. Die frühen Python- und JavaScript-SDKs verfügten über offene Lizenzen, doch die Open-Source-Natur der Client-Pakete bedeutet nicht, dass die Bewertungsplattform, die Modelle oder das Betriebssystem ebenfalls open source sind.
Unterstützt Hamming MCP?
Die offiziellen Angaben für das Jahr 2026 geben an, dass Hamming MCP-Server zur Verfügung stehen, mit denen Tests durchgeführt, Anrufe abgerufen sowie Transkripte gesucht werden können. Es gibt nur begrenzte öffentliche Installationsanleitungen; die genauen Berechtigungen müssen in den Kundenunterlagen überprüft werden.
Zusammenfassung
Hamming eignet sich dazu, Sprachagenten von „gelegentlichen manuellen Anrufen“ zu einem nachhaltigen Qualitätsmanagement-System zu entwickeln. Es kann Szenarien automatisch erstellen, Audio direkt abspielen, reale Störungen simulieren, Versionen vergleichen und Produktionsfehler in Rückgabetests umwandeln.
Vor dem Kauf sollten Preisangebote, Testmengen, Kosten für Anrufe bei Dritten, API-Versionen, Datenspeicherung sowie Unternehmensverträge überprüft werden. Eine gute Praxis nach dem Go-Live ist es, automatische Bewertungen mit manueller Überprüfung zu kombinieren und jeden hochriskanten Fehler in eine langfristige Freigabestufe umzuwandeln.
Guigong-Netzwerk-Sicherheitsnummer: 45132202000164