Hamming AI
Hamming AI, outil intelligent spécialisé dans l’audio IA
Étiquettes :Outils audio IAUne phrase pour présenter
Hamming AI est une plateforme de garantie de qualité au niveau entreprise qui offre des tests avant mise en ligne, un suivi en production, des attaques de type red team pour la sécurité, ainsi que des contrôles de régression pour les agents vocaux et de chat.
Présentation des outils
Le travail principal de Hamming n’est pas de créer des robots de service client pour les entreprises, mais de vérifier si les agents intelligents existants sont précis, naturels, stables, sécurisés et atteignent les objectifs commerciaux. L’équipe peut se connecter à des plateformes vocales existantes ou à des systèmes développés en interne, générer automatiquement des scénarios de test, puis les exécuter via des liaisons de conversation réelles pour les évaluer.
La plateforme relie les tests, la surveillance et la correction des problèmes en un cycle. Les échecs détectés lors des appels en production peuvent être transformés en cas de régression reproductibles, à exécuter à nouveau après mise à jour des prompts, du modèle ou de l’infrastructure, afin d’éviter que des problèmes similaires ne réapparaissent en ligne.
Positionnement du produit
| Niveau de compétence | Problèmes résolus | Phase d’utilisation typique | Sortie principale |
|---|---|---|---|
| Test de simulation | Un agent intelligent échoue-t-il dans une conversation réelle ? | Développement et pré-lancement | Scènes, enregistrements, transcription, notation et preuves d’échec |
| Test de régression | Une mise à jour de version détruit-elle les capacités existantes ? | Chaque modification du prompt, du modèle ou du code | Comparaison des versions et contrôle d’accès aux publications |
| Test de résistance | Le système reste-t-il stable avec une augmentation de la concurrence | Planification de la capacité et avant un lancement majeur | Retards, erreurs, débit et indicateurs de queue |
| Équipe rouge de sécurité | Y a-t-il un risque d’évasion, d’injection ou de fuite de données induite ? | Acceptation de sécurité et vérification continue | Découverte des risques et cas réutilisables |
| Surveillance de la production | Y a-t-il eu des problèmes de qualité ou de conformité lors des appels avec des clients réels ? | Phase de mise en service officielle | Alertes, tendances, file d’inspection et preuves |
| Production de replay | La correction résout-elle un échec réel ? | Analyse de l’accident et vérification de la correction | Test conservant la voix, le déroulement temporel et l’intention prévue |
Fonction principale
Génération automatique de scénarios de test
L’équipe peut coller des prompts pour le système d’agents intelligents ou se connecter à des plateformes existantes afin que Hamming génère un grand nombre de chemins normaux, de cas limites, d’entrées adverses, ainsi que des scénarios de accents et de bruit. Les résultats générés doivent néanmoins être vérifiés par les professionnels du domaine pour s’assurer de la couverture et des réponses attendues.
Évaluation native audio
Hamming analyse non seulement le texte transcrit, mais vérifie également directement au niveau audio les pauses, les interruptions, le silence, les longs monologues, la clarté de la voix et l’émotion. Cela permet de détecter des problèmes où le texte semble correct mais a un son médiocre en réalité.
Dialogues multiples et flux inter-appels
Les tests peuvent couvrir plusieurs tours de contexte, et permettre également de créer des séquences où le même personnage effectue des appels successifs pour prendre un rendez-vous, le modifier ou l’annuler. Cette capacité est adaptée à la vérification du maintien de l’état et des processus métier transversaux aux interactions.
Cas d’utilisation de production pour le routage des appels
L’équipe peut transformer en un clic une conversation ayant réellement échoué en un test reproductible, tout en conservant l’audio de l’appelant, le texte généré par la reconnaissance vocale, le chronogramme et l’intention prévue. L’exécution à nouveau sous les mêmes conditions après correction permet une vérification plus facile que la réécriture d’un script similaire.
Équipe rouge de sécurité et de conformité
Les scénarios prédéfinis pour l’équipe rouge couvrent des risques tels que l’injection de suggestions, la fugue de prisonnier, l’ingénierie sociale, la fuite d’informations sensibles, l’appel à des outils hors autorisation et le dépassement des politiques. Les entreprises peuvent également définir des scripts sectoriels, du contenu à divulguer obligatoirement et des réponses interdites.
Tests IVR et DTMF
Hamming peut simuler les menus téléphoniques traditionnels, envoyer des sons de touches DTMF et vérifier si l’agent parvient correctement à passer par l’IVR. Il prend en charge en même temps les appels entrants, les appels sortants et les chemins WebRTC directs.
Contrôle de santé de production
La plateforme peut rejouer un ensemble d’appels clés toutes les quelques minutes afin de détecter des changements dans le modèle, des pannes d’infrastructure ou des régressions dans les prompts. Lorsque les indicateurs dépassent les seuils, l’équipe peut être avertie par e-mail, Slack ou d’autres canaux d’alerte.
Conditions de test et simulation de rôle
- Langues, accents et dialectes selon les régions.
- Bureaux, rues, foules et autres bruits de fond.
- Parler rapidement ou lentement, longs silences et saisies inattendues.
- Les utilisateurs interrompent en cours de conversation, prennent la parole à leur tour et les intermédiaires parlent trop longtemps.
- Appelants âgés, scènes d’émotion intense et d’insultes.
- Délai d’attente API, faible confiance de la reconnaissance vocale et perte de contexte.
- Processus métier tels que la réservation, le paiement, l’authentification, le transfert à un agent humain et l’annulation.
- Injection de suggestions, jailbreak, extraction de données sensibles et contournement des politiques.
Indicateurs d’évaluation
Hamming affirme actuellement proposer plus de 50 indicateurs intégrés, et permet de définir des évaluateurs personnalisés en langage naturel. Les évaluations se divisent en trois catégories : la qualité de la conversation, les résultats attendus et les garde-fous de conformité ; il ne faut pas se baser uniquement sur une moyenne unique.
| Catégorie d’indicateur | Indicateurs représentatifs | Problèmes pouvant être identifiés |
|---|---|---|
| Précision et pertinence | Exactitude des faits, reconnaissance des intentions, pertinence et illusions | Réponse incorrecte, mauvaise compréhension des besoins ou fabrication d’informations |
| Tâche terminée | Objectif atteint, collecte des champs et appel d’outils réussis | Promesse orale de réalisation, mais action en arrière-plan échouée |
| Retard | Temps du premier mot, retard de tour, p50, p90 et p99 | La moyenne est normale, mais les appels en petite quantité sont très lents. |
| Flux de dialogue | Nombre de tours, interruptions, silences, répétitions et monologues | Sentiment mécanique, interruption ou impossibilité pour l’utilisateur de s’insérer |
| Voix et audio | Clarté, bruit, accent et qualité de transcription | Déclin des performances chez certains groupes de personnes ou dans certains environnements |
| Émotions | Émotions et tendances au niveau vocal | Frustration du client ou escalade négative |
| Conformité | Scripts, divulgation, PII, PHI et informations de paiement | Risques politiques ou réglementaires |
| Évaluation personnalisée | Règles de l’entreprise et seuils sectoriels | Exigences métier que les indicateurs généraux ne peuvent pas couvrir |
Décomposition du retard bout en bout
L’analyse des délais couvre l’ensemble du processus, y compris la détection de l’activité vocale, la reconnaissance vocale automatique, le traitement par des LLM et la synthèse vocale. L’équipe peut comparer la contribution de chaque composant, au lieu de ne se concentrer que sur le temps d’attente global perçu par l’utilisateur.
Évaluation par l’IA et calibration manuelle
Hamming utilise l’IA pour évaluer les intentions et les résultats globaux, et affirme que la concordance entre l’évaluation native audio et le jugement humain est d’environ 95 % à 96 %. Il s’agit d’indicateurs mesurés par le fabricant ; les entreprises doivent néanmoins effectuer des tests aveugles et une calibration manuelle dans leur propre langue, domaine et niveau de risque.
Différences entre le test et la surveillance en production
| Projet | Test avant mise en ligne | Surveillance de la production |
|---|---|---|
| Données | Personnages synthétiques et scénarios contrôlés | Appels réels avec des clients ou preuves de production |
| Objectif | Découverte d’un problème réplicable avant la publication | Détecter les dérives, les accidents et les pannes inconnues |
| Risque | Isoler les effets secondaires dans un environnement sandbox | Il y aura un accès à des données personnelles et commerciales réelles. |
| Mode de fonctionnement | Déclenchement par plan, version ou CI | Vérifications médicales continues ou régulières |
| Résultat | Réussite, échec, indicateurs et écarts de régression | Tendances, alertes, examens et preuves d’incidents |
| Actions suivantes | Relancer après correction et décider s’il faut le publier | Transformer en cas d’utilisation de régression et ajuster les alertes |
Les deux nécessitent d’utiliser des indicateurs et des cas d’usage communs, mais ne peuvent se substituer l’un à l’autre. Les tests de simulation ne peuvent pas couvrir tous les comportements réels, et la surveillance en production ne doit pas servir d’excuse pour expérimenter sur des clients réels.
Langues et accents pris en charge
Hamming affirme actuellement soutenir plus de 65 langues, dont l’anglais, l’espagnol, le portugais, le français, l’allemand, l’arabe, l’hindi, le tamoul, le japonais, le coréen et le chinois.
| Langue ou région | Accents ou variantes listés publiquement | Recommandations de test |
|---|---|---|
| anglais | États-Unis, Royaume-Uni, Australie, Inde et Nouvelle-Zélande | Ajouter le jargon local, les noms et les formats de numéros |
| espagnol | Amérique latine, Europe et États-Unis hispanophones | Définir des attentes distinctes pour chaque marché cible |
| arabe | Normes modernes, Golfe, Levant, Égypte et Maghreb | Tester le changement de dialecte et le mélange des langues |
| chinois | Mandarin simplifié, mandarin traditionnel et cantonais | Évaluer séparément la reconnaissance, la parole et l’expression numérique |
| tamoul | Variantes de l’Inde et du Sri Lanka | Ajouter un accent régional et un mélange d’anglais |
| portugais | Le Brésil et l’Europe lusophone | Ne mélangez pas les lignes de référence de notation |
| Le japonais et le coréen | Normes et variantes régionales | Tester les formules de politesse, les pauses et les noms propres |
Le nombre de langues ne signifie pas que chaque langue dispose du même timbre vocal, de la même couverture des accents et d’une même précision d’évaluation. Avant le lancement, il convient de créer pour chaque marché cible un ensemble de locuteurs indépendant, un vocabulaire sectoriel et des références manuelles.
Capacité d’intégration
| Plateforme ou protocole | Mode d’accès | Capacité actuellement publique |
|---|---|---|
| SIP | Appeler un numéro de test ou être appelé par la plateforme | Tests d’entrée, de sortie, IVR et DTMF |
| LiveKit | Clé API ou WebRTC direct | Agents synchronisés, exécution de tests et surveillance |
| Pipecat | Connexion directe WebRTC ou plateforme | Tester la chaîne de traitement vocal personnalisée |
| Daily | Connexion WebRTC | Test de l’agent vocal pour les pages web |
| ElevenLabs | Connecter un compte ou une clé API | Importer des agents et exécuter les évaluations |
| Retell | Clé API et paramètres régionaux | Synchronisation automatique tous les 5 minutes des agents, des enregistrements et des appels d’outils |
| Vapi | Connexion de la plateforme | Importer l’agent et exécuter l’évaluation des indicateurs de cohérence |
| Bland | Connexion de la plateforme | Test automatique des agents vocaux existants |
| Système développé en interne | SIP, WebRTC ou API REST | Compatible avec n’importe quelle combinaison de LLM, ASR et TTS |
| OpenTelemetry | Importer les traces, les intervalles et les journaux | Lier les appels, les composants et les preuves d’infrastructure |
Exemple d’intégration Retell
Retell permet d’importer des agents, des régions, des appels d’outils, des transcriptions et des enregistrements, et se synchronise par défaut toutes les 5 minutes. Lors des tests, il convient d’utiliser un projet indépendant ou un compte de test, afin d’éviter que la charge et les effets secondaires ne se répercutent sur le service en production.
Tutoriel d'utilisation
Terminer le premier test de l’agent vocal intelligent
- Créez un espace de travail Hamming ou prenez un rendez-vous pour une démonstration, et confirmez le volume de tests et les règles de données du plan actuel.
- Choisissez LiveKit, Pipecat, ElevenLabs, Retell, Vapi, Bland, SIP ou une intégration personnalisée.
- Utilisez une clé dédiée aux tests pour se connecter à l’agent, et restreignez les projets et environnements accessibles.
- Importer les prompts système, les définitions d’outils et les documents nécessaires pour permettre à la plateforme de générer une scène initiale.
- Les scénarios, les résultats attendus et le niveau de risque sont examinés par les équipes produits, QA et commerciales.
- Commencez par effectuer des tests en petits lots pour vérifier que les appels se connectent, que l’enregistrement est complet et que l’évaluation est correcte.
- Étendre aux accents, au bruit, aux interruptions, aux limites d’erreur et aux scénarios de confrontation.
- Vérifier les enregistrements de tentatives échouées, les transcriptions, les preuves fournies par les outils et les retards des composants, puis exécuter à nouveau après correction.
Mettre en place un contrôle de regression CI/CD
- Organiser les chemins normaux stables, les limites clés et les incidents historiques en ensembles de test versionnés.
- Utiliser l’API REST pour déclencher des tests avant chaque déploiement de prompt, d’outil, de modèle ou de code.
- Définir les seuils minimums pour l’achèvement des tâches, le taux de précision, la conformité, les retards et les cas d’usage clés.
- Associer les exécutions de test à une version spécifique d’agent, au hash du prompt et à la soumission de déploiement.
- Empêcher la publication lorsque les indicateurs clés chutent ou que les cas d’utilisation de sécurité échouent.
- Conserver dans le rapport l’enregistrement audio, la transcription, les appels d’outils et les raisons de notation pour une révision manuelle.
- Pour les échecs sporadiques, effectuez des exécutions répétées et de la calibration, sans baisser directement le seuil pour masquer le problème.
- Une fois en ligne, les échecs de production nouveaux seront convertis en couverture de retour permanent.
Configurer la surveillance de la production
- Décider s’il est nécessaire d’importer toutes les conversations, des conversations aléatoires ou uniquement les événements anormaux.
- Définir les permissions pour l’audio, la transcription brute, la transcription masquée, les appels d’outils et les métadonnées.
- Définir des seuils hiérarchisés pour la précision, la conformité, le retard, l’émotion et l’achèvement des tâches.
- Envoyez les problèmes techniques sur le canal technique, et les problèmes de conformité sur le canal à examen restreint.
- Utilisez les appels en or pour effectuer des examens de santé réguliers et enregistrer la ligne de base.
- Mettre en place des processus de révision manuelle, d’étiquetage, de couverture et de calibration.
- Transformer l’échec grave en tests de régression et désigner la personne responsable de la correction.
- Vérifier régulièrement le bruit des alertes, la sauvegarde des données et les droits d’accès des utilisateurs.
Production de rediffusions et boucle fermée des accidents
Les méthodes traditionnelles réécrivent souvent une scène similaire en se basant sur une transcription, ce qui risque de perdre le son original, les pauses, le bruit et la chronologie. La restitution de production de Hamming conserve ces conditions, en utilisant les mêmes preuves d’échec pour tester de nouvelles versions.
- Marquer les appels de production ayant un impact sur les clients ou présentant un risque élevé.
- Vérifier que l’enregistrement, la transcription, les appels d’outils et l’intention souhaitée sont complets.
- Supprimer les données personnelles non nécessaires ou les utiliser dans un environnement contrôlé.
- Convertir l’appel en cas d’utilisation de retour avec informations sur la version et le responsable.
- Exécuter la même scène avant et après la réparation, puis comparer les résultats.
- Ajouter les preuves de réparation aux examens de publication et aux rapports d’accident.
- Vérifier périodiquement si les incidents historiques sont toujours mis en œuvre.
Tests de charge et concurrentiels
Les activités de charge d’entreprise peuvent exécuter plus de 50 000 appels de test simultanés, couvrant les appels entrants, sortants et WebRTC directs. Une zone de travail standard offre par défaut environ 50 connexions simultanées, et ce chiffre peut être configuré à plus de 100, selon les spécifications du plan et la capacité de la plateforme testée.
| Dimensions de test | Indicateurs à observer | Échecs courants |
|---|---|---|
| Établissement de l’appel | Taux de connexion, temps de mise en réseau et codes d’erreur | Limitation par numéro, SIP ou région |
| Reconnaissance vocale | WER, retards et proportion de faible confiance | File d’attente en parallèle ou perte de frames |
| LLM | Premier token, temps d’exécution et taux d’erreurs | Limite de débit du fournisseur ou surcharge de contexte |
| Synthèse vocale | Premier audio, lag et taux d’échec | File d’attente audio ou quota insuffisant |
| Appel d’outil | Succès, délai d’attente, tentative de réessai et isotropie | Réservation répétée ou écriture répétée |
| Dialogue global | p50, p90, p99 et achèvement de la tâche | Moyennement normal mais effondrement de la queue |
| Coût | Coût par appel, par minute et par fournisseur | L’ampleur des tests entraîne des coûts inattendus |
Les tests de charge consomment en même temps les quotas de Hamming, de téléphone, de voix, de modèles et d’API métier. L’équipe doit définir une limite maximale de concurrence, un budget, un environnement de sandbox ainsi qu’un mécanisme d’arrêt d’urgence, afin de ne pas affecter directement les systèmes des clients en production.
Prix et forfaits
Au 23 août 2026, Hamming n’a pas communiqué de montant fixe pour les forfaits. La tarification est principalement basée sur le volume de tests et d’utilisation en production, et non sur le nombre de membres ; les montants et prix spécifiques sont fournis lors des démonstrations et du processus d’introduction.
| Plan ou étape | Prix public | Base de facturation | Places d’équipe | Principaux droits |
|---|---|---|---|---|
| Présentation personnalisée | Gratuit | Environ 25 minutes de démonstration, pas de version d’essai gratuite du produit | Pas applicable | Présentation combinant des agents intelligents réels et des scénarios |
| Solution Startup | Contacter le service des ventes | Des centaines d’essais ou des exigences réelles | Principalement sans frais par siège | Portée des tests, du suivi et de la collaboration d’équipe selon la proposition |
| Croissance ou équipe conventionnelle | Contacter le service des ventes | Volume de test, nombre d’agents et appels de production | Toute l’équipe peut être invitée. | Plus de tests, d’intégration et de support |
| Enterprise | Cotation sur mesure | Tests à grande échelle, appels de production et exigences contractuelles | Pas de valorisation principale basée sur les sièges | Remises en gros, intégration sur mesure, support dédié et SLA |
Y a-t-il une version d’essai gratuite ?
La FAQ actuelle indique clairement qu’aucune version d’essai gratuite et autonome traditionnelle n’est proposée, mais que les équipes peuvent découvrir leurs agents intelligents grâce à des démonstrations personnalisées et une introduction. Certains éléments du site présentent encore le bouton ancien « Commencer un essai gratuit », ce qui ne permet pas d’assurer l’existence d’un crédit gratuit actuel.
Vérifier avant de donner un prix
- Nombre de tests par mois, minutes, appels en parallèle et volume d’appels de surveillance en production.
- Qui prend en charge les frais de téléphone, de voix, de modèles et de plateformes tierces ?
- Est-ce que la génération automatique de scénarios, les évaluateurs et les exécutions répétées sont facturés séparément ?
- Y a-t-il des frais supplémentaires pour le stockage des données, l’exportation, ainsi que le déploiement single-tenant et régional ?
- Sont-ils inclus : API, MCP, Webhooks, OpenTelemetry et CI/CD ?
- Prix unitaire en cas de dépassement, durée minimale du contrat, renouvellement, règles d’annulation et de remboursement.
- Comment la gravité du soutien aux entreprises et le délai de réponse de 10 minutes à 4 heures sont-ils associés ?
- Cotisation distincte et exigences de capacité préalable pour 50 000 activités de charge simultanées.
Support et services
| Mode de soutien | Champ d’application | Explication publique |
|---|---|---|
| Support par e-mail | Tous les clients | Problèmes quotidiens et tickets de service |
| Chat en ligne | Tous les clients | Aide rapide intégrée au produit |
| Slack exclusif | Clients débutants | Contacter directement l’équipe d’ingénierie |
| Soutien intégré | Tous les clients, les entreprises plus en profondeur | Aider aux connexions SIP, WebRTC, plateformes et API |
| SLA d’entreprise | Enterprise | Réponse en environ 10 minutes à 4 heures selon la gravité |
| Intégration sur mesure | Enterprise | Développement et maintenance sur demande |
| Gestion du succès client | Enterprise | Vérifications régulières, formation et optimisation |
API, MCP et outils de développement
Hamming propose une API REST qui permet de planifier des tests, d’obtenir des résultats, de configurer des agents, de gérer des cas de test et de lire des données de surveillance. Il peut s’intégrer à GitHub Actions, Jenkins et d’autres pipelines CI/CD, et être utilisé pour l’automatisation via des Webhooks.
Le document complet actuel nécessite un code d’accès et est principalement destiné aux clients ayant déjà commencé à l’utiliser. Les documents de marketing publics mentionnent également le SDK, les serveurs MCP et l’importation via OpenTelemetry, mais la stabilité des interfaces, les droits d’accès et les versions doivent se référer aux documents internes au workspace.
| Capacité de développement | État actuel | Utilisation principale | Précautions à prendre |
|---|---|---|---|
| REST API | Fourni officiellement, documents restreints | Exécuter des tests, gérer les cas d’utilisation et lire les métriques de surveillance | Compte client et identifiants requis |
| Webhooks | Fournir officiellement | Relier les résultats des tests et les alertes à des processus externes | La signature de l’événement et les tentatives de réessai dépendent des documents du client. |
| CI/CD | Soutien | Exécuter les contrôles de qualité avant chaque publication | Il est nécessaire d’avoir un ensemble de test stable et une association de versions. |
| OpenTelemetry | Soutien | Importer les traces, les intervalles et les journaux | Il convient de contrôler les attributs sensibles et l’échantillonnage. |
| Serveur MCP | Les ressources officielles affirment qu’elles sont disponibles | Exécuter des tests, consulter les appels et rechercher les transcriptions | Les documents d’installation publics sont limités |
| Python SDK | Le paquet public a été mis à jour pour la dernière fois en 2024 | Appeler la plateforme Hamming initiale | Version 0.0.17, il convient de vérifier la compatibilité avec l’API actuelle. |
| JavaScript SDK | Le paquet public a été mis à jour pour la dernière fois il y a peu. | Framework Evals initial | Ne peut pas être considéré comme une garantie d’activité pour l’interface principale actuelle |
GitHub et le monde du logiciel open source
La plateforme Hamming est elle-même un service commercial propriétaire ; le site officiel ne publie pas le code complet du produit ou les modèles d’évaluation en tant que projet open source. Des SDK anciens sous licence MIT ou ISC existent dans les gestionnaires de paquets publics, mais ils ne couvrent que le code client.
| Projet | Statut public | Licence ou maintenance | Conclusion |
|---|---|---|---|
| Plateforme commerciale Hamming | Code source complet non divulgué | Services commerciaux | Pas open source |
| Modèle d’évaluation et système d’exécution | Non divulgué | Non divulgué | Ce n’est pas un projet à pondération ouverte |
| Paquet Python hamming-sdk | Public | MIT, 0.0.17, mise à jour en septembre 2024 | Les SDK initiaux ne signifient pas que la plateforme est open source. |
| Paquet JavaScript hamming-sdk | Public | ISC, 1.0.27, mis à jour il y a environ deux ans | SDK initial, l’état de maintenance doit être vérifié |
| SDK C# de tiers | Public mais maintenu par tryAGI | MIT | Ce n’est pas le code produit officiel de Hamming |
La nouvelle intégration doit privilégier l’utilisation des documents API REST actuels de l’espace de travail du client, et ne pas se baser uniquement sur les anciens paquets SDK. Lors de l’achat, il convient d’exiger des informations claires concernant la compatibilité des versions API, les notifications de désactivation, le parcours SDK et les méthodes d’exportation de sortie.
Politique de confidentialité
L’entité juridique chargée des opérations de Hamming est Forward Inc ; la politique de confidentialité publique en vigueur a été mise à jour pour la dernière fois le 14 décembre 2024. Cette politique s’applique aux sites web, aux comptes, aux ventes, au marketing et aux services connexes.
| Données ou règles | Politique actuelle |
|---|---|
| Compte et coordonnées | Nom, numéro de téléphone, adresse e-mail, adresse, poste, nom d’utilisateur et mot de passe, etc. |
| Paiement | Les informations sur les outils de paiement sont stockées par Stripe. |
| Collecte automatique | IP, navigateur, appareil, durée d’utilisation, cookies et données d’analyse |
| Informations sensibles | Ne traiter qu’après avoir signé un BAA avec le client |
| Entraînement sur les données des clients | Pas utilisé pour la formation, ni pour bénéficier aux autres clients |
| Vente de données générées par les utilisateurs | Non à la vente |
| Analyse de site web | Utiliser Google Analytics |
| Conservation générale | Conserver tant que le compte est valide et que cela est nécessaire aux fins commerciales ; la loi peut imposer une durée plus longue. |
| Sauvegardes qui ne peuvent pas être supprimées immédiatement | Isolation de sécurité, jusqu’à ce qu’il soit possible de le supprimer |
| Mineurs | Ne pas collecter ni commercialiser activement auprès d’utilisateurs de moins de 18 ans |
La politique de confidentialité ne fixe pas de durée de conservation uniforme et permanente pour toutes les enregistrements, transcriptions et preuves de test. Les FAQ indiquent que les enregistrements de test sont stockés de manière chiffrée et que la durée peut être définie selon les exigences du client ; les valeurs spécifiques doivent être précisées dans la commande ou le DPA avant utilisation en production.
Droits sur les données
- Les utilisateurs qui remplissent les conditions peuvent demander à accéder, exporter, corriger ou supprimer leurs informations personnelles.
- Dans certaines régions, les utilisateurs peuvent limiter l’utilisation d’informations sensibles ou s’opposer à un traitement spécifique.
- Les utilisateurs peuvent se désinscrire des emails marketing et révoquer les consentements applicables.
- Lors de la clôture du compte, la plateforme supprimera ou désactivera les informations dans la base de données active.
- Afin de prévenir la fraude, mener des enquêtes, appliquer les conditions ou répondre à des exigences légales, certains enregistrements peuvent être conservés.
- Les demandes et les réclamations relatives à la vie privée sont traitées par l’adresse e-mail de contact officielle.
Sécurité et conformité
Hamming a achevé l’audit SOC 2 en décembre 2025, et le site officiel indique actuellement SOC 2 Type II. Les clients du secteur de la santé peuvent signer un BAA pour soutenir les workflows HIPAA ; la plateforme propose également des options de stockage des données aux États-Unis, dans l’UE et au Royaume-Uni, ainsi que des solutions single-tenant.
| Contrôle ou capacité | Statut public actuel | Vérification des achats |
|---|---|---|
| SOC 2 Type II | Terminé et affiché sur le site officiel | Demander le rapport actuel, la période, la portée et les exceptions |
| HIPAA | Peut signer un BAA | Finaliser la signature avant que toute PHI n’entre sur la plateforme |
| Chiffrement | Chiffrement des enregistrements et des données en transmission et en état statique | Vérifier l'algorithme, la clé et la portée de la sauvegarde |
| RBAC | Soutien | Tester par rôle : ingénierie, produit, QA et gestion |
| SSO | Prend en charge les services d’identité d’entreprise tels qu’Okta | Vérifier SAML ou OIDC, champ obligatoire et révocation en cas de départ |
| Journal d’audit | Soutenu et exportable vers un SIEM | Vérifier la couverture des événements et la durée de conservation |
| Résidence des données | Options États-Unis, Union européenne et Royaume-Uni | Vérifier tous les sous-traitants, les données de sauvegarde et de support |
| Un seul locataire | Options d’entreprise | Vérification de l’isolation du réseau, des clés, des mises à niveau et de la face de gestion |
| Détection de PII | Tester et surveiller les risques de fuite | Ne peut pas remplacer la désensibilisation complète et le contrôle d’accès |
SOC 2 et BAA ne signifient pas que les agents du client sont automatiquement conformes à toutes les réglementations. L’acceptation par enregistrement, les cartes de paiement, les informations médicales, le transfert régional, les appels marketing et la responsabilité de conservation doivent encore être configurés, testés et surveillés en continu par le client.
Recommandations pour la sécurité des données de production
- Commencez d’abord par effectuer le POC de base à l’aide de données entièrement synthétiques, sans télécharger d’enregistrements réels de clients.
- Examiner la portée SOC 2, le DPA, le BAA, les sous-traitants, les flux de données et la réponse aux incidents.
- Définir des durées de conservation distinctes pour l’audio, la transcription originale, la transcription désanonymisée, les métadonnées et les preuves d’outil.
- Configurer le SSO, la MFA, le RBAC et les principes du moindre privilège, et réviser régulièrement les accès.
- Supprimez les PII, PHI, cartes de paiement et identifiants non nécessaires avant l’importation.
- Conditions et audits limitant l’accès du personnel de support humain aux preuves de production réelle.
- Vérifier les processus d’exportation, de suppression, de sauvegarde des données obsolètes et de résiliation des contrats.
- Réexécuter l’analyse des risques après chaque ajout de modèle, de plateforme, de région ou de sous-traitant.
À qui s’adresse-t-il
- Équipe d’ingénierie de l’IA vocale : validation des prompts, des modèles, de l’ASR, du TTS, des outils et des délais.
- Équipe QA : Création de scénarios automatisés, de jeux de tests de régression et de contrôles de déploiement.
- Chef de produit : Définir le succès commercial et comparer les différentes versions de l’agent.
- Service client et opérations : Identifier les échecs lors des appels de production et les points douloureux pour les clients.
- Équipe de sécurité : exécution de tests d’injection de suggestions, de jailbreak, de fuite de PII et de dépassement de droits des outils.
- Équipe de conformité : Vérification des scripts, de l’authentification, de la divulgation et des preuves d’audit.
- Institutions médicales et financières : Surveiller les processus vocaux à haut risque après la signature des contrats applicables.
- Fournisseurs de plateformes et intégrateurs de systèmes : application d’indicateurs unifiés pour plusieurs fournisseurs de voix.
Scénarios d'utilisation typiques
- Vérifier la création, le report, l’annulation et l’écriture d’outils avant le lancement du robot de réservation.
- Comparer la qualité, le délai et le coût après le remplacement de l’LLM, de l’ASR ou du TTS.
- Mettre en œuvre une régression historique sur les nouvelles instructions pour éviter que les anciens problèmes ne réapparaissent.
- Tester les accents, le bruit, les interruptions et des appels complexes de plus de 70 tours.
- Évaluer la capacité maximale de l’entreprise en utilisant plus de 50 000 activités simultanées.
- Vérifier en continu dans l’environnement de production les hallucinations, les déviations par rapport au script et les fuites de données privées.
- Replacer les échecs des clients réels dans la version corrigée et générer des preuves de publication.
- Connecter les résultats des tests à CI, Slack, SIEM et OpenTelemetry.
Avantages du produit
- Couvre le cycle de vie complet : tests, surveillance, équipe rouge, replay et régression.
- En analysant directement l’audio, on peut détecter des problèmes d’interaction qui ne sont pas visibles dans le texte transcrit.
- Génère automatiquement un grand nombre de scénarios en fonction des prompts, réduisant ainsi les coûts de rédaction manuelle.
- Prend en charge plus de 65 langues, accents régionaux, bruit et différents comportements de parole.
- Connexion native à plusieurs plateformes de voix majeures, ainsi que prise en charge de SIP, WebRTC et de systèmes développés en interne.
- Plus de 50 indicateurs intégrés et un nombre illimité d’évaluateurs personnalisés.
- Prend en charge CI/CD, REST API, Webhooks et OpenTelemetry.
- La charge concurrentielle de l’entreprise peut être étendue à plus de 50 000 circuits.
- SOC 2 Type II, BAA, hébergement des données, SSO et architecture monotenant répondent aux exigences des achats d’entreprise.
- La facturation se base principalement sur le volume de tests et non sur le nombre de postes ; la collaboration entre équipes n’entraîne pas d’augmentation supplémentaire des frais liés aux postes principaux.
Principales restrictions
- Aucun montant fixe pour forfait n’est divulgué ; le budget doit faire l’objet d’une démonstration et d’une proposition de prix.
- Aucune version d’essai gratuite et auto-service traditionnelle n’est proposée, ce qui rend l’accès difficile pour les développeurs individuels.
- Les documents publics nécessitent un code d’accès ; les points d’API et les permissions ne peuvent pas être consultés en totalité avant l’achat.
- Les anciens SDK Python et JavaScript n’ont pas été mis à jour depuis environ deux ans, et leur compatibilité doit être vérifiée.
- Même si les scores de l’IA sont cohérents avec ceux des évaluations manuelles, ils peuvent présenter des écarts dans de nouvelles langues ou domaines.
- Les tests à forte concurrence entraînent simultanément des frais pour les appels, la voix, les modèles et les API métier.
- La surveillance de la production traite des enregistrements audio réels, des transcriptions et des preuves issues d’outils, ce qui exige une gestion rigoureuse des données.
- Les prévisions de 95 % annoncées par le fabricant, ainsi que le degré de concordance manuelle de 95 % à 96 % et le taux de victoire de 90 % face aux concurrents doivent tous être vérifiés dans un contexte propre.
- La plateforme est destinée à la garantie de la qualité au sein des entreprises, et non à constituer un environnement de exécution complet pour créer directement des agents vocaux intelligents.
Plateforme de support
| Plateforme ou méthode | Soutien disponible | Utilisation principale |
|---|---|---|
| Console Web | Soutien | Configuration des tests, consultation des enregistrements, rapports, tendances et surveillance |
| Téléphone SIP | Soutien | Appels entrants, appels sortants, IVR, DTMF et liaisons téléphoniques traditionnelles |
| WebRTC | Soutien | LiveKit, Pipecat, Daily et les agents web intelligents |
| REST API | Soutien, documentation client limitée | Tests automatisés, résultats et surveillance |
| Webhooks | Soutien | Connecter les pipelines, les alertes et les systèmes externes |
| CI/CD | Soutien | GitHub Actions, Jenkins et autres systèmes |
| OpenTelemetry | Soutien | Importer le suivi, l’échelle et les journaux |
| MCP | Les ressources officielles affirment qu’elles offrent un soutien | Vérifier les appels, analyser la qualité et effectuer des tests de fonctionnement |
| Application native mobile | Aucun résultat trouvé | Principalement utilisé via des pages web |
| Extension de navigateur | Aucun résultat trouvé | Pas d’extension publique |
Informations de base
| Projet | Contenu |
|---|---|
| Nom de l’outil | Hamming AI |
| Entité juridique | Forward Inc |
| Date de création | 2024 |
| Fondateur et PDG | Sumanyu Sharma |
| Accélérateur | Y Combinator S24 |
| Type de produit | Test, surveillance et évaluation de la sécurité des agents vocaux et de chat |
| Clients principaux | Équipes d’IA vocale, service client d’entreprise, santé, finance et entreprises à forte croissance |
| langue | Plus de 65 espèces |
| Indicateurs intégrés | Plus de 50 |
| Charge d’entreprise | Plus de 50 000 appels de test simultanés |
| Prix | Tarif sur mesure, principalement en fonction du volume de tests et d’utilisation |
| Essai gratuit traditionnel | Non fourni, remplacé par une démonstration personnalisée et un guide d’introduction |
| API | Oui, le document complet est visible pour les clients. |
| SDK | Il existe des paquets Python et JavaScript anciens, la maintenance actuelle doit être vérifiée. |
| Est-ce open source | Le produit n’est pas open source, mais certains SDK pour anciens clients le sont. |
| SOC 2 | Type II |
| HIPAA | Soutien à la signature d’un BAA |
| Résidence des données | Options États-Unis, Union européenne et Royaume-Uni |
| Date de vérification | 23 août 2026 |
Indice de recommandation
Indice de recommandation : 4,7 / 5. Hamming combine de manière complète l’évaluation native audio, la simulation de scénarios réels, le suivi de la production, la lecture en arrière et la connexion aux systèmes d’accès CI, ce qui le rend particulièrement adapté aux équipes déjà en train d’exploiter des agents intelligents vocaux en production.
Les prix et les documents complets ne sont pas divulgués, et la surveillance de la production implique des données hautement sensibles ; par conséquent, il convient mieux aux organisations disposant de processus formels d’achat, de sécurité et de contrôle qualité, plutôt qu’aux utilisateurs individuels qui souhaitent simplement essayer quelques robots téléphoniques gratuitement.
Questions fréquentes
Qu’est-ce que Hamming AI ?
Hamming AI est une plateforme de test et de surveillance pour les agents vocaux et de chat, utilisée pour simuler automatiquement des conversations, évaluer la qualité, mener des attaques de type « red team », surveiller les appels en production et transformer les échecs en cas d’essai de régression.
Hamming va-t-il m’aider à créer un robot vocal ?
Sa fonction principale n’est pas d’être un constructeur d’agents intelligents, mais de relier et d’évaluer des agents existants. L’utilisateur doit déjà disposer de Vapi, Retell, ElevenLabs, LiveKit, Pipecat ou d’un système vocal développé en interne.
Combien coûte Hamming AI ?
Le site officiel ne divulgue pas de montant fixe. Les tarifs sont principalement calculés en fonction du volume de tests et de l’utilisation en production, et non en fonction du nombre de membres de l’équipe.
Y a-t-il une version d’essai gratuite de Hamming ?
La FAQ actuelle indique qu’il n’y a pas de version d’essai gratuite et autonome traditionnelle. L’équipe peut prendre rendez-vous pour une démonstration personnalisée et expérimenter ses propres agents et scénarios lors de l’introduction.
Hamming prend-il en charge le chinois ?
Prend en charge les tests en chinois et liste les variantes telles que le mandarin simplifié, le mandarin traditionnel et le cantonais. La reconnaissance réelle, l’évaluation audio et la performance avec des termes professionnels nécessitent encore une calibration par des locuteurs natifs.
Comment Hamming teste-t-il les interruptions et les retards ?
La plateforme simule l’interrompement, le silence prolongé, le rythme de parole rapide ou lent ainsi que d’autres comportements réels, et décompose le retard en VAD, ASR, LLM et TTS, tout en affichant les valeurs p50, p90 et p99.
Hamming prend-il en charge la surveillance de la production ?
Soutien. Il peut évaluer en continu les appels réels, déclencher des alertes selon des seuils, rejouer les appels importants, et transformer les échecs en production en tests de retour permanent.
Hamming peut-il tester des agents vocaux développés en interne ?
Oui. Les systèmes développés en interne peuvent être connectés via SIP, WebRTC ou une API REST, sans dépendre d’un fournisseur de LLM, de reconnaissance vocale ou de synthèse vocale fixe.
Hamming est-il conforme à HIPAA ?
Hamming peut signer un BAA avec les clients du secteur médical et fournir les contrôles de sécurité correspondants. Il est nécessaire de finaliser d’abord le BAA et l’examen des données ; il n’est pas possible de télécharger des PHI sans avoir signé ce document.
Hamming utilisera-t-il les données des clients pour entraîner le modèle ?
La politique de confidentialité publique indique clairement que les données des clients ne sont pas utilisées pour l’entraînement, ni pour bénéficier d’autres clients, et que les données générées par les utilisateurs ne sont pas vendues.
Hamming est-il open source ?
La plateforme complète n’est pas open source. Les SDK initiaux pour Python et JavaScript utilisaient des licences ouvertes, mais le fait que les paquets clients soient open source ne signifie pas que la plateforme d’évaluation, les modèles ou le système de mise en œuvre le soient également.
Hamming prend-il en charge MCP ?
La documentation officielle pour 2026 mentionne un serveur Hamming MCP permettant d’exécuter des tests, de consulter les appels et de rechercher les transcriptions. Les informations d’installation publiques sont limitées ; les droits spécifiques doivent être confirmés dans la documentation client.
Résumé
Hamming permet d’évoluer des agents vocaux de « quelques appels manuels occasionnels » vers un système de qualité de projet durable. Il peut générer automatiquement des scénarios, écouter directement l’audio, simuler des perturbations réelles, comparer les versions et transformer les incidents de production en tests de régression.
Avant l’achat, il convient de confirmer le devis, le volume de test, les coûts d’appel vers des tiers, la version API, le stockage des données, la conservation et le contrat entreprise. La meilleure pratique après le déploiement est de combiner une évaluation automatique et une calibration manuelle, et de transformer chaque échec à haut risque en un verrouillage de publication à long terme.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164