Hamming AI
Valeur ajoutée gratuite
Guide complet des outils d’IA Outils audio IA

Hamming AI

Hamming AI, outil intelligent spécialisé dans l’audio IA

Étiquettes :

Une phrase pour présenter

Hamming AI est une plateforme de garantie de qualité au niveau entreprise qui offre des tests avant mise en ligne, un suivi en production, des attaques de type red team pour la sécurité, ainsi que des contrôles de régression pour les agents vocaux et de chat.

Présentation des outils

Le travail principal de Hamming n’est pas de créer des robots de service client pour les entreprises, mais de vérifier si les agents intelligents existants sont précis, naturels, stables, sécurisés et atteignent les objectifs commerciaux. L’équipe peut se connecter à des plateformes vocales existantes ou à des systèmes développés en interne, générer automatiquement des scénarios de test, puis les exécuter via des liaisons de conversation réelles pour les évaluer.

La plateforme relie les tests, la surveillance et la correction des problèmes en un cycle. Les échecs détectés lors des appels en production peuvent être transformés en cas de régression reproductibles, à exécuter à nouveau après mise à jour des prompts, du modèle ou de l’infrastructure, afin d’éviter que des problèmes similaires ne réapparaissent en ligne.

Positionnement du produit

Niveau de compétenceProblèmes résolusPhase d’utilisation typiqueSortie principale
Test de simulationUn agent intelligent échoue-t-il dans une conversation réelle ?Développement et pré-lancementScènes, enregistrements, transcription, notation et preuves d’échec
Test de régressionUne mise à jour de version détruit-elle les capacités existantes ?Chaque modification du prompt, du modèle ou du codeComparaison des versions et contrôle d’accès aux publications
Test de résistanceLe système reste-t-il stable avec une augmentation de la concurrencePlanification de la capacité et avant un lancement majeurRetards, erreurs, débit et indicateurs de queue
Équipe rouge de sécuritéY a-t-il un risque d’évasion, d’injection ou de fuite de données induite ?Acceptation de sécurité et vérification continueDécouverte des risques et cas réutilisables
Surveillance de la productionY a-t-il eu des problèmes de qualité ou de conformité lors des appels avec des clients réels ?Phase de mise en service officielleAlertes, tendances, file d’inspection et preuves
Production de replayLa correction résout-elle un échec réel ?Analyse de l’accident et vérification de la correctionTest conservant la voix, le déroulement temporel et l’intention prévue

Fonction principale

Génération automatique de scénarios de test

L’équipe peut coller des prompts pour le système d’agents intelligents ou se connecter à des plateformes existantes afin que Hamming génère un grand nombre de chemins normaux, de cas limites, d’entrées adverses, ainsi que des scénarios de accents et de bruit. Les résultats générés doivent néanmoins être vérifiés par les professionnels du domaine pour s’assurer de la couverture et des réponses attendues.

Évaluation native audio

Hamming analyse non seulement le texte transcrit, mais vérifie également directement au niveau audio les pauses, les interruptions, le silence, les longs monologues, la clarté de la voix et l’émotion. Cela permet de détecter des problèmes où le texte semble correct mais a un son médiocre en réalité.

Dialogues multiples et flux inter-appels

Les tests peuvent couvrir plusieurs tours de contexte, et permettre également de créer des séquences où le même personnage effectue des appels successifs pour prendre un rendez-vous, le modifier ou l’annuler. Cette capacité est adaptée à la vérification du maintien de l’état et des processus métier transversaux aux interactions.

Cas d’utilisation de production pour le routage des appels

L’équipe peut transformer en un clic une conversation ayant réellement échoué en un test reproductible, tout en conservant l’audio de l’appelant, le texte généré par la reconnaissance vocale, le chronogramme et l’intention prévue. L’exécution à nouveau sous les mêmes conditions après correction permet une vérification plus facile que la réécriture d’un script similaire.

Équipe rouge de sécurité et de conformité

Les scénarios prédéfinis pour l’équipe rouge couvrent des risques tels que l’injection de suggestions, la fugue de prisonnier, l’ingénierie sociale, la fuite d’informations sensibles, l’appel à des outils hors autorisation et le dépassement des politiques. Les entreprises peuvent également définir des scripts sectoriels, du contenu à divulguer obligatoirement et des réponses interdites.

Tests IVR et DTMF

Hamming peut simuler les menus téléphoniques traditionnels, envoyer des sons de touches DTMF et vérifier si l’agent parvient correctement à passer par l’IVR. Il prend en charge en même temps les appels entrants, les appels sortants et les chemins WebRTC directs.

Contrôle de santé de production

La plateforme peut rejouer un ensemble d’appels clés toutes les quelques minutes afin de détecter des changements dans le modèle, des pannes d’infrastructure ou des régressions dans les prompts. Lorsque les indicateurs dépassent les seuils, l’équipe peut être avertie par e-mail, Slack ou d’autres canaux d’alerte.

Conditions de test et simulation de rôle

  • Langues, accents et dialectes selon les régions.
  • Bureaux, rues, foules et autres bruits de fond.
  • Parler rapidement ou lentement, longs silences et saisies inattendues.
  • Les utilisateurs interrompent en cours de conversation, prennent la parole à leur tour et les intermédiaires parlent trop longtemps.
  • Appelants âgés, scènes d’émotion intense et d’insultes.
  • Délai d’attente API, faible confiance de la reconnaissance vocale et perte de contexte.
  • Processus métier tels que la réservation, le paiement, l’authentification, le transfert à un agent humain et l’annulation.
  • Injection de suggestions, jailbreak, extraction de données sensibles et contournement des politiques.

Indicateurs d’évaluation

Hamming affirme actuellement proposer plus de 50 indicateurs intégrés, et permet de définir des évaluateurs personnalisés en langage naturel. Les évaluations se divisent en trois catégories : la qualité de la conversation, les résultats attendus et les garde-fous de conformité ; il ne faut pas se baser uniquement sur une moyenne unique.

Catégorie d’indicateurIndicateurs représentatifsProblèmes pouvant être identifiés
Précision et pertinenceExactitude des faits, reconnaissance des intentions, pertinence et illusionsRéponse incorrecte, mauvaise compréhension des besoins ou fabrication d’informations
Tâche terminéeObjectif atteint, collecte des champs et appel d’outils réussisPromesse orale de réalisation, mais action en arrière-plan échouée
RetardTemps du premier mot, retard de tour, p50, p90 et p99La moyenne est normale, mais les appels en petite quantité sont très lents.
Flux de dialogueNombre de tours, interruptions, silences, répétitions et monologuesSentiment mécanique, interruption ou impossibilité pour l’utilisateur de s’insérer
Voix et audioClarté, bruit, accent et qualité de transcriptionDéclin des performances chez certains groupes de personnes ou dans certains environnements
ÉmotionsÉmotions et tendances au niveau vocalFrustration du client ou escalade négative
ConformitéScripts, divulgation, PII, PHI et informations de paiementRisques politiques ou réglementaires
Évaluation personnaliséeRègles de l’entreprise et seuils sectorielsExigences métier que les indicateurs généraux ne peuvent pas couvrir

Décomposition du retard bout en bout

L’analyse des délais couvre l’ensemble du processus, y compris la détection de l’activité vocale, la reconnaissance vocale automatique, le traitement par des LLM et la synthèse vocale. L’équipe peut comparer la contribution de chaque composant, au lieu de ne se concentrer que sur le temps d’attente global perçu par l’utilisateur.

Évaluation par l’IA et calibration manuelle

Hamming utilise l’IA pour évaluer les intentions et les résultats globaux, et affirme que la concordance entre l’évaluation native audio et le jugement humain est d’environ 95 % à 96 %. Il s’agit d’indicateurs mesurés par le fabricant ; les entreprises doivent néanmoins effectuer des tests aveugles et une calibration manuelle dans leur propre langue, domaine et niveau de risque.

Différences entre le test et la surveillance en production

ProjetTest avant mise en ligneSurveillance de la production
DonnéesPersonnages synthétiques et scénarios contrôlésAppels réels avec des clients ou preuves de production
ObjectifDécouverte d’un problème réplicable avant la publicationDétecter les dérives, les accidents et les pannes inconnues
RisqueIsoler les effets secondaires dans un environnement sandboxIl y aura un accès à des données personnelles et commerciales réelles.
Mode de fonctionnementDéclenchement par plan, version ou CIVérifications médicales continues ou régulières
RésultatRéussite, échec, indicateurs et écarts de régressionTendances, alertes, examens et preuves d’incidents
Actions suivantesRelancer après correction et décider s’il faut le publierTransformer en cas d’utilisation de régression et ajuster les alertes

Les deux nécessitent d’utiliser des indicateurs et des cas d’usage communs, mais ne peuvent se substituer l’un à l’autre. Les tests de simulation ne peuvent pas couvrir tous les comportements réels, et la surveillance en production ne doit pas servir d’excuse pour expérimenter sur des clients réels.

Langues et accents pris en charge

Hamming affirme actuellement soutenir plus de 65 langues, dont l’anglais, l’espagnol, le portugais, le français, l’allemand, l’arabe, l’hindi, le tamoul, le japonais, le coréen et le chinois.

Langue ou régionAccents ou variantes listés publiquementRecommandations de test
anglaisÉtats-Unis, Royaume-Uni, Australie, Inde et Nouvelle-ZélandeAjouter le jargon local, les noms et les formats de numéros
espagnolAmérique latine, Europe et États-Unis hispanophonesDéfinir des attentes distinctes pour chaque marché cible
arabeNormes modernes, Golfe, Levant, Égypte et MaghrebTester le changement de dialecte et le mélange des langues
chinoisMandarin simplifié, mandarin traditionnel et cantonaisÉvaluer séparément la reconnaissance, la parole et l’expression numérique
tamoulVariantes de l’Inde et du Sri LankaAjouter un accent régional et un mélange d’anglais
portugaisLe Brésil et l’Europe lusophoneNe mélangez pas les lignes de référence de notation
Le japonais et le coréenNormes et variantes régionalesTester les formules de politesse, les pauses et les noms propres

Le nombre de langues ne signifie pas que chaque langue dispose du même timbre vocal, de la même couverture des accents et d’une même précision d’évaluation. Avant le lancement, il convient de créer pour chaque marché cible un ensemble de locuteurs indépendant, un vocabulaire sectoriel et des références manuelles.

Capacité d’intégration

Plateforme ou protocoleMode d’accèsCapacité actuellement publique
SIPAppeler un numéro de test ou être appelé par la plateformeTests d’entrée, de sortie, IVR et DTMF
LiveKitClé API ou WebRTC directAgents synchronisés, exécution de tests et surveillance
PipecatConnexion directe WebRTC ou plateformeTester la chaîne de traitement vocal personnalisée
DailyConnexion WebRTCTest de l’agent vocal pour les pages web
ElevenLabsConnecter un compte ou une clé APIImporter des agents et exécuter les évaluations
RetellClé API et paramètres régionauxSynchronisation automatique tous les 5 minutes des agents, des enregistrements et des appels d’outils
VapiConnexion de la plateformeImporter l’agent et exécuter l’évaluation des indicateurs de cohérence
BlandConnexion de la plateformeTest automatique des agents vocaux existants
Système développé en interneSIP, WebRTC ou API RESTCompatible avec n’importe quelle combinaison de LLM, ASR et TTS
OpenTelemetryImporter les traces, les intervalles et les journauxLier les appels, les composants et les preuves d’infrastructure

Exemple d’intégration Retell

Retell permet d’importer des agents, des régions, des appels d’outils, des transcriptions et des enregistrements, et se synchronise par défaut toutes les 5 minutes. Lors des tests, il convient d’utiliser un projet indépendant ou un compte de test, afin d’éviter que la charge et les effets secondaires ne se répercutent sur le service en production.

Tutoriel d'utilisation

Terminer le premier test de l’agent vocal intelligent

  1. Créez un espace de travail Hamming ou prenez un rendez-vous pour une démonstration, et confirmez le volume de tests et les règles de données du plan actuel.
  2. Choisissez LiveKit, Pipecat, ElevenLabs, Retell, Vapi, Bland, SIP ou une intégration personnalisée.
  3. Utilisez une clé dédiée aux tests pour se connecter à l’agent, et restreignez les projets et environnements accessibles.
  4. Importer les prompts système, les définitions d’outils et les documents nécessaires pour permettre à la plateforme de générer une scène initiale.
  5. Les scénarios, les résultats attendus et le niveau de risque sont examinés par les équipes produits, QA et commerciales.
  6. Commencez par effectuer des tests en petits lots pour vérifier que les appels se connectent, que l’enregistrement est complet et que l’évaluation est correcte.
  7. Étendre aux accents, au bruit, aux interruptions, aux limites d’erreur et aux scénarios de confrontation.
  8. Vérifier les enregistrements de tentatives échouées, les transcriptions, les preuves fournies par les outils et les retards des composants, puis exécuter à nouveau après correction.

Mettre en place un contrôle de regression CI/CD

  1. Organiser les chemins normaux stables, les limites clés et les incidents historiques en ensembles de test versionnés.
  2. Utiliser l’API REST pour déclencher des tests avant chaque déploiement de prompt, d’outil, de modèle ou de code.
  3. Définir les seuils minimums pour l’achèvement des tâches, le taux de précision, la conformité, les retards et les cas d’usage clés.
  4. Associer les exécutions de test à une version spécifique d’agent, au hash du prompt et à la soumission de déploiement.
  5. Empêcher la publication lorsque les indicateurs clés chutent ou que les cas d’utilisation de sécurité échouent.
  6. Conserver dans le rapport l’enregistrement audio, la transcription, les appels d’outils et les raisons de notation pour une révision manuelle.
  7. Pour les échecs sporadiques, effectuez des exécutions répétées et de la calibration, sans baisser directement le seuil pour masquer le problème.
  8. Une fois en ligne, les échecs de production nouveaux seront convertis en couverture de retour permanent.

Configurer la surveillance de la production

  1. Décider s’il est nécessaire d’importer toutes les conversations, des conversations aléatoires ou uniquement les événements anormaux.
  2. Définir les permissions pour l’audio, la transcription brute, la transcription masquée, les appels d’outils et les métadonnées.
  3. Définir des seuils hiérarchisés pour la précision, la conformité, le retard, l’émotion et l’achèvement des tâches.
  4. Envoyez les problèmes techniques sur le canal technique, et les problèmes de conformité sur le canal à examen restreint.
  5. Utilisez les appels en or pour effectuer des examens de santé réguliers et enregistrer la ligne de base.
  6. Mettre en place des processus de révision manuelle, d’étiquetage, de couverture et de calibration.
  7. Transformer l’échec grave en tests de régression et désigner la personne responsable de la correction.
  8. Vérifier régulièrement le bruit des alertes, la sauvegarde des données et les droits d’accès des utilisateurs.

Production de rediffusions et boucle fermée des accidents

Les méthodes traditionnelles réécrivent souvent une scène similaire en se basant sur une transcription, ce qui risque de perdre le son original, les pauses, le bruit et la chronologie. La restitution de production de Hamming conserve ces conditions, en utilisant les mêmes preuves d’échec pour tester de nouvelles versions.

  • Marquer les appels de production ayant un impact sur les clients ou présentant un risque élevé.
  • Vérifier que l’enregistrement, la transcription, les appels d’outils et l’intention souhaitée sont complets.
  • Supprimer les données personnelles non nécessaires ou les utiliser dans un environnement contrôlé.
  • Convertir l’appel en cas d’utilisation de retour avec informations sur la version et le responsable.
  • Exécuter la même scène avant et après la réparation, puis comparer les résultats.
  • Ajouter les preuves de réparation aux examens de publication et aux rapports d’accident.
  • Vérifier périodiquement si les incidents historiques sont toujours mis en œuvre.

Tests de charge et concurrentiels

Les activités de charge d’entreprise peuvent exécuter plus de 50 000 appels de test simultanés, couvrant les appels entrants, sortants et WebRTC directs. Une zone de travail standard offre par défaut environ 50 connexions simultanées, et ce chiffre peut être configuré à plus de 100, selon les spécifications du plan et la capacité de la plateforme testée.

Dimensions de testIndicateurs à observerÉchecs courants
Établissement de l’appelTaux de connexion, temps de mise en réseau et codes d’erreurLimitation par numéro, SIP ou région
Reconnaissance vocaleWER, retards et proportion de faible confianceFile d’attente en parallèle ou perte de frames
LLMPremier token, temps d’exécution et taux d’erreursLimite de débit du fournisseur ou surcharge de contexte
Synthèse vocalePremier audio, lag et taux d’échecFile d’attente audio ou quota insuffisant
Appel d’outilSuccès, délai d’attente, tentative de réessai et isotropieRéservation répétée ou écriture répétée
Dialogue globalp50, p90, p99 et achèvement de la tâcheMoyennement normal mais effondrement de la queue
CoûtCoût par appel, par minute et par fournisseurL’ampleur des tests entraîne des coûts inattendus

Les tests de charge consomment en même temps les quotas de Hamming, de téléphone, de voix, de modèles et d’API métier. L’équipe doit définir une limite maximale de concurrence, un budget, un environnement de sandbox ainsi qu’un mécanisme d’arrêt d’urgence, afin de ne pas affecter directement les systèmes des clients en production.

Prix et forfaits

Au 23 août 2026, Hamming n’a pas communiqué de montant fixe pour les forfaits. La tarification est principalement basée sur le volume de tests et d’utilisation en production, et non sur le nombre de membres ; les montants et prix spécifiques sont fournis lors des démonstrations et du processus d’introduction.

Plan ou étapePrix publicBase de facturationPlaces d’équipePrincipaux droits
Présentation personnaliséeGratuitEnviron 25 minutes de démonstration, pas de version d’essai gratuite du produitPas applicablePrésentation combinant des agents intelligents réels et des scénarios
Solution StartupContacter le service des ventesDes centaines d’essais ou des exigences réellesPrincipalement sans frais par siègePortée des tests, du suivi et de la collaboration d’équipe selon la proposition
Croissance ou équipe conventionnelleContacter le service des ventesVolume de test, nombre d’agents et appels de productionToute l’équipe peut être invitée.Plus de tests, d’intégration et de support
EnterpriseCotation sur mesureTests à grande échelle, appels de production et exigences contractuellesPas de valorisation principale basée sur les siègesRemises en gros, intégration sur mesure, support dédié et SLA

Y a-t-il une version d’essai gratuite ?

La FAQ actuelle indique clairement qu’aucune version d’essai gratuite et autonome traditionnelle n’est proposée, mais que les équipes peuvent découvrir leurs agents intelligents grâce à des démonstrations personnalisées et une introduction. Certains éléments du site présentent encore le bouton ancien « Commencer un essai gratuit », ce qui ne permet pas d’assurer l’existence d’un crédit gratuit actuel.

Vérifier avant de donner un prix

  • Nombre de tests par mois, minutes, appels en parallèle et volume d’appels de surveillance en production.
  • Qui prend en charge les frais de téléphone, de voix, de modèles et de plateformes tierces ?
  • Est-ce que la génération automatique de scénarios, les évaluateurs et les exécutions répétées sont facturés séparément ?
  • Y a-t-il des frais supplémentaires pour le stockage des données, l’exportation, ainsi que le déploiement single-tenant et régional ?
  • Sont-ils inclus : API, MCP, Webhooks, OpenTelemetry et CI/CD ?
  • Prix unitaire en cas de dépassement, durée minimale du contrat, renouvellement, règles d’annulation et de remboursement.
  • Comment la gravité du soutien aux entreprises et le délai de réponse de 10 minutes à 4 heures sont-ils associés ?
  • Cotisation distincte et exigences de capacité préalable pour 50 000 activités de charge simultanées.

Support et services

Mode de soutienChamp d’applicationExplication publique
Support par e-mailTous les clientsProblèmes quotidiens et tickets de service
Chat en ligneTous les clientsAide rapide intégrée au produit
Slack exclusifClients débutantsContacter directement l’équipe d’ingénierie
Soutien intégréTous les clients, les entreprises plus en profondeurAider aux connexions SIP, WebRTC, plateformes et API
SLA d’entrepriseEnterpriseRéponse en environ 10 minutes à 4 heures selon la gravité
Intégration sur mesureEnterpriseDéveloppement et maintenance sur demande
Gestion du succès clientEnterpriseVérifications régulières, formation et optimisation

API, MCP et outils de développement

Hamming propose une API REST qui permet de planifier des tests, d’obtenir des résultats, de configurer des agents, de gérer des cas de test et de lire des données de surveillance. Il peut s’intégrer à GitHub Actions, Jenkins et d’autres pipelines CI/CD, et être utilisé pour l’automatisation via des Webhooks.

Le document complet actuel nécessite un code d’accès et est principalement destiné aux clients ayant déjà commencé à l’utiliser. Les documents de marketing publics mentionnent également le SDK, les serveurs MCP et l’importation via OpenTelemetry, mais la stabilité des interfaces, les droits d’accès et les versions doivent se référer aux documents internes au workspace.

Capacité de développementÉtat actuelUtilisation principalePrécautions à prendre
REST APIFourni officiellement, documents restreintsExécuter des tests, gérer les cas d’utilisation et lire les métriques de surveillanceCompte client et identifiants requis
WebhooksFournir officiellementRelier les résultats des tests et les alertes à des processus externesLa signature de l’événement et les tentatives de réessai dépendent des documents du client.
CI/CDSoutienExécuter les contrôles de qualité avant chaque publicationIl est nécessaire d’avoir un ensemble de test stable et une association de versions.
OpenTelemetrySoutienImporter les traces, les intervalles et les journauxIl convient de contrôler les attributs sensibles et l’échantillonnage.
Serveur MCPLes ressources officielles affirment qu’elles sont disponiblesExécuter des tests, consulter les appels et rechercher les transcriptionsLes documents d’installation publics sont limités
Python SDKLe paquet public a été mis à jour pour la dernière fois en 2024Appeler la plateforme Hamming initialeVersion 0.0.17, il convient de vérifier la compatibilité avec l’API actuelle.
JavaScript SDKLe paquet public a été mis à jour pour la dernière fois il y a peu.Framework Evals initialNe peut pas être considéré comme une garantie d’activité pour l’interface principale actuelle

GitHub et le monde du logiciel open source

La plateforme Hamming est elle-même un service commercial propriétaire ; le site officiel ne publie pas le code complet du produit ou les modèles d’évaluation en tant que projet open source. Des SDK anciens sous licence MIT ou ISC existent dans les gestionnaires de paquets publics, mais ils ne couvrent que le code client.

ProjetStatut publicLicence ou maintenanceConclusion
Plateforme commerciale HammingCode source complet non divulguéServices commerciauxPas open source
Modèle d’évaluation et système d’exécutionNon divulguéNon divulguéCe n’est pas un projet à pondération ouverte
Paquet Python hamming-sdkPublicMIT, 0.0.17, mise à jour en septembre 2024Les SDK initiaux ne signifient pas que la plateforme est open source.
Paquet JavaScript hamming-sdkPublicISC, 1.0.27, mis à jour il y a environ deux ansSDK initial, l’état de maintenance doit être vérifié
SDK C# de tiersPublic mais maintenu par tryAGIMITCe n’est pas le code produit officiel de Hamming

La nouvelle intégration doit privilégier l’utilisation des documents API REST actuels de l’espace de travail du client, et ne pas se baser uniquement sur les anciens paquets SDK. Lors de l’achat, il convient d’exiger des informations claires concernant la compatibilité des versions API, les notifications de désactivation, le parcours SDK et les méthodes d’exportation de sortie.

Politique de confidentialité

L’entité juridique chargée des opérations de Hamming est Forward Inc ; la politique de confidentialité publique en vigueur a été mise à jour pour la dernière fois le 14 décembre 2024. Cette politique s’applique aux sites web, aux comptes, aux ventes, au marketing et aux services connexes.

Données ou règlesPolitique actuelle
Compte et coordonnéesNom, numéro de téléphone, adresse e-mail, adresse, poste, nom d’utilisateur et mot de passe, etc.
PaiementLes informations sur les outils de paiement sont stockées par Stripe.
Collecte automatiqueIP, navigateur, appareil, durée d’utilisation, cookies et données d’analyse
Informations sensiblesNe traiter qu’après avoir signé un BAA avec le client
Entraînement sur les données des clientsPas utilisé pour la formation, ni pour bénéficier aux autres clients
Vente de données générées par les utilisateursNon à la vente
Analyse de site webUtiliser Google Analytics
Conservation généraleConserver tant que le compte est valide et que cela est nécessaire aux fins commerciales ; la loi peut imposer une durée plus longue.
Sauvegardes qui ne peuvent pas être supprimées immédiatementIsolation de sécurité, jusqu’à ce qu’il soit possible de le supprimer
MineursNe pas collecter ni commercialiser activement auprès d’utilisateurs de moins de 18 ans

La politique de confidentialité ne fixe pas de durée de conservation uniforme et permanente pour toutes les enregistrements, transcriptions et preuves de test. Les FAQ indiquent que les enregistrements de test sont stockés de manière chiffrée et que la durée peut être définie selon les exigences du client ; les valeurs spécifiques doivent être précisées dans la commande ou le DPA avant utilisation en production.

Droits sur les données

  • Les utilisateurs qui remplissent les conditions peuvent demander à accéder, exporter, corriger ou supprimer leurs informations personnelles.
  • Dans certaines régions, les utilisateurs peuvent limiter l’utilisation d’informations sensibles ou s’opposer à un traitement spécifique.
  • Les utilisateurs peuvent se désinscrire des emails marketing et révoquer les consentements applicables.
  • Lors de la clôture du compte, la plateforme supprimera ou désactivera les informations dans la base de données active.
  • Afin de prévenir la fraude, mener des enquêtes, appliquer les conditions ou répondre à des exigences légales, certains enregistrements peuvent être conservés.
  • Les demandes et les réclamations relatives à la vie privée sont traitées par l’adresse e-mail de contact officielle.

Sécurité et conformité

Hamming a achevé l’audit SOC 2 en décembre 2025, et le site officiel indique actuellement SOC 2 Type II. Les clients du secteur de la santé peuvent signer un BAA pour soutenir les workflows HIPAA ; la plateforme propose également des options de stockage des données aux États-Unis, dans l’UE et au Royaume-Uni, ainsi que des solutions single-tenant.

Contrôle ou capacitéStatut public actuelVérification des achats
SOC 2 Type IITerminé et affiché sur le site officielDemander le rapport actuel, la période, la portée et les exceptions
HIPAAPeut signer un BAAFinaliser la signature avant que toute PHI n’entre sur la plateforme
ChiffrementChiffrement des enregistrements et des données en transmission et en état statiqueVérifier l'algorithme, la clé et la portée de la sauvegarde
RBACSoutienTester par rôle : ingénierie, produit, QA et gestion
SSOPrend en charge les services d’identité d’entreprise tels qu’OktaVérifier SAML ou OIDC, champ obligatoire et révocation en cas de départ
Journal d’auditSoutenu et exportable vers un SIEMVérifier la couverture des événements et la durée de conservation
Résidence des donnéesOptions États-Unis, Union européenne et Royaume-UniVérifier tous les sous-traitants, les données de sauvegarde et de support
Un seul locataireOptions d’entrepriseVérification de l’isolation du réseau, des clés, des mises à niveau et de la face de gestion
Détection de PIITester et surveiller les risques de fuiteNe peut pas remplacer la désensibilisation complète et le contrôle d’accès

SOC 2 et BAA ne signifient pas que les agents du client sont automatiquement conformes à toutes les réglementations. L’acceptation par enregistrement, les cartes de paiement, les informations médicales, le transfert régional, les appels marketing et la responsabilité de conservation doivent encore être configurés, testés et surveillés en continu par le client.

Recommandations pour la sécurité des données de production

  1. Commencez d’abord par effectuer le POC de base à l’aide de données entièrement synthétiques, sans télécharger d’enregistrements réels de clients.
  2. Examiner la portée SOC 2, le DPA, le BAA, les sous-traitants, les flux de données et la réponse aux incidents.
  3. Définir des durées de conservation distinctes pour l’audio, la transcription originale, la transcription désanonymisée, les métadonnées et les preuves d’outil.
  4. Configurer le SSO, la MFA, le RBAC et les principes du moindre privilège, et réviser régulièrement les accès.
  5. Supprimez les PII, PHI, cartes de paiement et identifiants non nécessaires avant l’importation.
  6. Conditions et audits limitant l’accès du personnel de support humain aux preuves de production réelle.
  7. Vérifier les processus d’exportation, de suppression, de sauvegarde des données obsolètes et de résiliation des contrats.
  8. Réexécuter l’analyse des risques après chaque ajout de modèle, de plateforme, de région ou de sous-traitant.

À qui s’adresse-t-il

  • Équipe d’ingénierie de l’IA vocale : validation des prompts, des modèles, de l’ASR, du TTS, des outils et des délais.
  • Équipe QA : Création de scénarios automatisés, de jeux de tests de régression et de contrôles de déploiement.
  • Chef de produit : Définir le succès commercial et comparer les différentes versions de l’agent.
  • Service client et opérations : Identifier les échecs lors des appels de production et les points douloureux pour les clients.
  • Équipe de sécurité : exécution de tests d’injection de suggestions, de jailbreak, de fuite de PII et de dépassement de droits des outils.
  • Équipe de conformité : Vérification des scripts, de l’authentification, de la divulgation et des preuves d’audit.
  • Institutions médicales et financières : Surveiller les processus vocaux à haut risque après la signature des contrats applicables.
  • Fournisseurs de plateformes et intégrateurs de systèmes : application d’indicateurs unifiés pour plusieurs fournisseurs de voix.

Scénarios d'utilisation typiques

  • Vérifier la création, le report, l’annulation et l’écriture d’outils avant le lancement du robot de réservation.
  • Comparer la qualité, le délai et le coût après le remplacement de l’LLM, de l’ASR ou du TTS.
  • Mettre en œuvre une régression historique sur les nouvelles instructions pour éviter que les anciens problèmes ne réapparaissent.
  • Tester les accents, le bruit, les interruptions et des appels complexes de plus de 70 tours.
  • Évaluer la capacité maximale de l’entreprise en utilisant plus de 50 000 activités simultanées.
  • Vérifier en continu dans l’environnement de production les hallucinations, les déviations par rapport au script et les fuites de données privées.
  • Replacer les échecs des clients réels dans la version corrigée et générer des preuves de publication.
  • Connecter les résultats des tests à CI, Slack, SIEM et OpenTelemetry.

Avantages du produit

  • Couvre le cycle de vie complet : tests, surveillance, équipe rouge, replay et régression.
  • En analysant directement l’audio, on peut détecter des problèmes d’interaction qui ne sont pas visibles dans le texte transcrit.
  • Génère automatiquement un grand nombre de scénarios en fonction des prompts, réduisant ainsi les coûts de rédaction manuelle.
  • Prend en charge plus de 65 langues, accents régionaux, bruit et différents comportements de parole.
  • Connexion native à plusieurs plateformes de voix majeures, ainsi que prise en charge de SIP, WebRTC et de systèmes développés en interne.
  • Plus de 50 indicateurs intégrés et un nombre illimité d’évaluateurs personnalisés.
  • Prend en charge CI/CD, REST API, Webhooks et OpenTelemetry.
  • La charge concurrentielle de l’entreprise peut être étendue à plus de 50 000 circuits.
  • SOC 2 Type II, BAA, hébergement des données, SSO et architecture monotenant répondent aux exigences des achats d’entreprise.
  • La facturation se base principalement sur le volume de tests et non sur le nombre de postes ; la collaboration entre équipes n’entraîne pas d’augmentation supplémentaire des frais liés aux postes principaux.

Principales restrictions

  • Aucun montant fixe pour forfait n’est divulgué ; le budget doit faire l’objet d’une démonstration et d’une proposition de prix.
  • Aucune version d’essai gratuite et auto-service traditionnelle n’est proposée, ce qui rend l’accès difficile pour les développeurs individuels.
  • Les documents publics nécessitent un code d’accès ; les points d’API et les permissions ne peuvent pas être consultés en totalité avant l’achat.
  • Les anciens SDK Python et JavaScript n’ont pas été mis à jour depuis environ deux ans, et leur compatibilité doit être vérifiée.
  • Même si les scores de l’IA sont cohérents avec ceux des évaluations manuelles, ils peuvent présenter des écarts dans de nouvelles langues ou domaines.
  • Les tests à forte concurrence entraînent simultanément des frais pour les appels, la voix, les modèles et les API métier.
  • La surveillance de la production traite des enregistrements audio réels, des transcriptions et des preuves issues d’outils, ce qui exige une gestion rigoureuse des données.
  • Les prévisions de 95 % annoncées par le fabricant, ainsi que le degré de concordance manuelle de 95 % à 96 % et le taux de victoire de 90 % face aux concurrents doivent tous être vérifiés dans un contexte propre.
  • La plateforme est destinée à la garantie de la qualité au sein des entreprises, et non à constituer un environnement de exécution complet pour créer directement des agents vocaux intelligents.

Plateforme de support

Plateforme ou méthodeSoutien disponibleUtilisation principale
Console WebSoutienConfiguration des tests, consultation des enregistrements, rapports, tendances et surveillance
Téléphone SIPSoutienAppels entrants, appels sortants, IVR, DTMF et liaisons téléphoniques traditionnelles
WebRTCSoutienLiveKit, Pipecat, Daily et les agents web intelligents
REST APISoutien, documentation client limitéeTests automatisés, résultats et surveillance
WebhooksSoutienConnecter les pipelines, les alertes et les systèmes externes
CI/CDSoutienGitHub Actions, Jenkins et autres systèmes
OpenTelemetrySoutienImporter le suivi, l’échelle et les journaux
MCPLes ressources officielles affirment qu’elles offrent un soutienVérifier les appels, analyser la qualité et effectuer des tests de fonctionnement
Application native mobileAucun résultat trouvéPrincipalement utilisé via des pages web
Extension de navigateurAucun résultat trouvéPas d’extension publique

Informations de base

ProjetContenu
Nom de l’outilHamming AI
Entité juridiqueForward Inc
Date de création2024
Fondateur et PDGSumanyu Sharma
AccélérateurY Combinator S24
Type de produitTest, surveillance et évaluation de la sécurité des agents vocaux et de chat
Clients principauxÉquipes d’IA vocale, service client d’entreprise, santé, finance et entreprises à forte croissance
languePlus de 65 espèces
Indicateurs intégrésPlus de 50
Charge d’entreprisePlus de 50 000 appels de test simultanés
PrixTarif sur mesure, principalement en fonction du volume de tests et d’utilisation
Essai gratuit traditionnelNon fourni, remplacé par une démonstration personnalisée et un guide d’introduction
APIOui, le document complet est visible pour les clients.
SDKIl existe des paquets Python et JavaScript anciens, la maintenance actuelle doit être vérifiée.
Est-ce open sourceLe produit n’est pas open source, mais certains SDK pour anciens clients le sont.
SOC 2Type II
HIPAASoutien à la signature d’un BAA
Résidence des donnéesOptions États-Unis, Union européenne et Royaume-Uni
Date de vérification23 août 2026

Indice de recommandation

Indice de recommandation : 4,7 / 5. Hamming combine de manière complète l’évaluation native audio, la simulation de scénarios réels, le suivi de la production, la lecture en arrière et la connexion aux systèmes d’accès CI, ce qui le rend particulièrement adapté aux équipes déjà en train d’exploiter des agents intelligents vocaux en production.

Les prix et les documents complets ne sont pas divulgués, et la surveillance de la production implique des données hautement sensibles ; par conséquent, il convient mieux aux organisations disposant de processus formels d’achat, de sécurité et de contrôle qualité, plutôt qu’aux utilisateurs individuels qui souhaitent simplement essayer quelques robots téléphoniques gratuitement.

Questions fréquentes

Qu’est-ce que Hamming AI ?

Hamming AI est une plateforme de test et de surveillance pour les agents vocaux et de chat, utilisée pour simuler automatiquement des conversations, évaluer la qualité, mener des attaques de type « red team », surveiller les appels en production et transformer les échecs en cas d’essai de régression.

Hamming va-t-il m’aider à créer un robot vocal ?

Sa fonction principale n’est pas d’être un constructeur d’agents intelligents, mais de relier et d’évaluer des agents existants. L’utilisateur doit déjà disposer de Vapi, Retell, ElevenLabs, LiveKit, Pipecat ou d’un système vocal développé en interne.

Combien coûte Hamming AI ?

Le site officiel ne divulgue pas de montant fixe. Les tarifs sont principalement calculés en fonction du volume de tests et de l’utilisation en production, et non en fonction du nombre de membres de l’équipe.

Y a-t-il une version d’essai gratuite de Hamming ?

La FAQ actuelle indique qu’il n’y a pas de version d’essai gratuite et autonome traditionnelle. L’équipe peut prendre rendez-vous pour une démonstration personnalisée et expérimenter ses propres agents et scénarios lors de l’introduction.

Hamming prend-il en charge le chinois ?

Prend en charge les tests en chinois et liste les variantes telles que le mandarin simplifié, le mandarin traditionnel et le cantonais. La reconnaissance réelle, l’évaluation audio et la performance avec des termes professionnels nécessitent encore une calibration par des locuteurs natifs.

Comment Hamming teste-t-il les interruptions et les retards ?

La plateforme simule l’interrompement, le silence prolongé, le rythme de parole rapide ou lent ainsi que d’autres comportements réels, et décompose le retard en VAD, ASR, LLM et TTS, tout en affichant les valeurs p50, p90 et p99.

Hamming prend-il en charge la surveillance de la production ?

Soutien. Il peut évaluer en continu les appels réels, déclencher des alertes selon des seuils, rejouer les appels importants, et transformer les échecs en production en tests de retour permanent.

Hamming peut-il tester des agents vocaux développés en interne ?

Oui. Les systèmes développés en interne peuvent être connectés via SIP, WebRTC ou une API REST, sans dépendre d’un fournisseur de LLM, de reconnaissance vocale ou de synthèse vocale fixe.

Hamming est-il conforme à HIPAA ?

Hamming peut signer un BAA avec les clients du secteur médical et fournir les contrôles de sécurité correspondants. Il est nécessaire de finaliser d’abord le BAA et l’examen des données ; il n’est pas possible de télécharger des PHI sans avoir signé ce document.

Hamming utilisera-t-il les données des clients pour entraîner le modèle ?

La politique de confidentialité publique indique clairement que les données des clients ne sont pas utilisées pour l’entraînement, ni pour bénéficier d’autres clients, et que les données générées par les utilisateurs ne sont pas vendues.

Hamming est-il open source ?

La plateforme complète n’est pas open source. Les SDK initiaux pour Python et JavaScript utilisaient des licences ouvertes, mais le fait que les paquets clients soient open source ne signifie pas que la plateforme d’évaluation, les modèles ou le système de mise en œuvre le soient également.

Hamming prend-il en charge MCP ?

La documentation officielle pour 2026 mentionne un serveur Hamming MCP permettant d’exécuter des tests, de consulter les appels et de rechercher les transcriptions. Les informations d’installation publiques sont limitées ; les droits spécifiques doivent être confirmés dans la documentation client.

Résumé

Hamming permet d’évoluer des agents vocaux de « quelques appels manuels occasionnels » vers un système de qualité de projet durable. Il peut générer automatiquement des scénarios, écouter directement l’audio, simuler des perturbations réelles, comparer les versions et transformer les incidents de production en tests de régression.

Avant l’achat, il convient de confirmer le devis, le volume de test, les coûts d’appel vers des tiers, la version API, le stockage des données, la conservation et le contrat entreprise. La meilleure pratique après le déploiement est de combiner une évaluation automatique et une calibration manuelle, et de transformer chaque échec à haut risque en un verrouillage de publication à long terme.

©️Droit d’auteur : Sauf indication contraire, tous les articles de ce site sont protégés par le droit d’auteur.Partage d’outils d’IATous les droits d’auteur sont réservés. Sans autorisation, aucune personne, média, site web ou groupe ne peut reproduire, copier ou diffuser de quelque manière que ce soit le contenu de ce site, ni créer de mirror sur des serveurs qui ne lui appartiennent pas. Dans le cas contraire, notre site se réserve le droit de poursuivre en justice les responsables conformément à la loi.

Outils similaires à Hamming AI