Écoute cérébrale IA
Résumé de transcription de enregistrements AI gratuit
Étiquettes :Outils audio IAQu’est-ce que l’IA cérébrale d’écoute ?
ListenBrain AI est une plateforme d’enregistrement vocal, de transcription de la parole et d’analyse de contenu développée par Shanghai Xiuyu Network Technology.
Il convertit les réunions, les cours, les entretiens ainsi que l’audio et la vidéo en texte, puis génère des comptes rendus, des tâches à effectuer, des cartes mentales et des résultats de questions-réponses.
Fonctionnalités clés
| Fonctionnalité | Rôle principal | Scénarios adaptés |
|---|---|---|
| Transcription en temps réel d’enregistrements audio | Générer un script mot par mot tout en enregistrant | Réunions, cours et entretiens |
| Importation audio et vidéo | Analyser les fichiers locaux et générer du texte | Mise en ordre des enregistrements et matériel de sous-titres |
| Analyse des liens web | Extraire le contenu des vidéos et audios publics | Étude des cours, des vidéos courtes et des programmes |
| Résumé intelligent par l’IA | Extraire les résumés, les conclusions et les actions à entreprendre | Analyse post-reunion et suivi des tâches |
| Mind map | Organiser du contenu long en structure de connaissances | Révision et organisation des thèmes |
| Questions-réponses de la base de connaissances | Recherche et interrogation autour des archives historiques | Réutilisation des connaissances individuelles et d’équipe |
Transcription en temps réel et reconnaissance vocale
L’IA auditif prend en charge la transcription en temps réel et permet de distinguer les interlocuteurs dans les conversations multilatérales.
- Le site officiel indique que le taux de transcription peut atteindre 98 % de précision, mais les résultats réels dépendent des conditions d’enregistrement.
- Prend en charge la reconnaissance ou la traduction en chinois, en anglais, en japonais et en coréen.
- Prend en charge plus de 16 dialectes, la documentation de développement cite le cantonais, le mandarin du Sichuan et le mandarin du Nord-Est, entre autres.
- La reconnaissance de contenu professionnel peut être améliorée par le réduction du bruit, le renforcement de la voix humaine et un lexique personnalisé.
- Les termes techniques, les noms et les abréviations doivent toujours être vérifiés manuellement avant l’exportation.
Importation de fichiers et résolution de liens
Les utilisateurs peuvent télécharger des fichiers audio et vidéo locaux, ainsi que traiter du contenu en ligne public qui répond aux critères.
- Les sources d’importation courantes comprennent les enregistrements de téléphone, les documents de réunion, les enregistrements d’écran et les vidéos de cours.
- La documentation officielle prend en charge les formats MP3, WAV, M4A, MP4, MOV et MKV.
- L’analyse des liens publics peut être utilisée pour extraire les sous-titres vidéo, les connaissances clés et la structure du contenu.
- En raison de l’authentification, des droits d’auteur, des mesures anti-scraping ou de la date d’expiration des liens, une partie du contenu en ligne pourrait ne pas pouvoir être interprétée.
- Avant de télécharger les enregistrements d’autrui, il convient d’obtenir au préalable les autorisations nécessaires pour les enregistrer, les traiter et les diffuser.
Comptes rendus d’IA et organisation des connaissances
Une fois la transcription terminée, le système peut générer des résumés de structures différentes en fonction du contenu et continuer à poser des questions aux enregistrements.
- Extraction automatique de résumés de réunions, de conclusions clés et de tâches à effectuer.
- Organiser les informations telles que le temps, les tâches et les responsables dans un tableau.
- Créer des cartes mentales prêtes à être visualisées et modifiées.
- Plus de 80 modèles sont disponibles, couvrant le bureau, les ventes, l’éducation et la création de contenu.
- Rechercher des archives dans la base de connaissances pour consulter les engagements, les décisions et les informations thématiques.
Exporter, partager et collaborer
L’IA auditive peut utiliser le script mot par mot et les résultats de l’analyse pour la synchronisation d’équipe ou l’archivage des documents.
- La documentation de développement liste les formats de export tels que Word, PDF, Markdown et TXT.
- Le plan de cours montre la capacité à synchroniser avec Lark, DingTalk, Tencent Docs et Notion.
- Les enregistrements peuvent être partagés en ligne, et l’édition entreprise offre également une base de connaissances d’équipe et une collaboration entre les membres.
- L’interface administrative de l’entreprise permet de gérer les membres, les droits, les ressources et la finance.
- Pour les réunions sensibles, il convient d’abord de confirmer les droits de partage, la portée des téléchargements et la stratégie de conservation par l’entreprise.
Guide d'utilisation de l’IA auditive
- Inscrivez-vous et connectez-vous à Tingnao AI, puis choisissez l’enregistrement en temps réel, le téléchargement de fichiers ou l’analyse de liens.
- Testez le micro avant l’enregistrement et informez clairement les participants que l’enregistrement a lieu.
- Vérifier le format, la durée, le volume et la présence d’une voix humaine claire lors de l’importation du fichier.
- Choisissez un modèle de résumé adapté pour une réunion, un cours, des ventes ou autre.
- Après la transcription, corriger le locuteur, les noms propres, les chiffres et les conclusions clés.
- Créer des comptes rendus, des listes de tâches, des tableaux ou des organigrammes, et les compléter grâce à des questions-réponses avec l’IA.
- Exportez ou partagez selon les besoins, tout en définissant des droits d’accès et d’édition appropriés.
- Les décisions importantes se basent sur l’enregistrement original et la version confirmée manuellement.
Prix de la version individuelle
Au 30 août 2026, l’offre officielle de première acquisition a révélé des promotions VIP pour les particuliers ; les avantages habituels doivent encore être vérifiés en se connectant.
| Projet | Prix public | Explication |
|---|---|---|
| Offre VIP pour premier achat | 99 yuans/14 mois | Une seule commande est autorisée pendant la période de l’offre, et aucun remboursement n’est possible après paiement. |
| Heure de l'événement | Du 1er juillet au 30 septembre 2026 | La prolongation en cas de dépassement dépend de la page. |
| Forfait individuel standard | Pas encore entièrement rendu public | Après connexion, vérifier la durée, le nombre de mots et les droits de stockage. |
| Durée de transcription supplémentaire | Selon la page de règlement | Il existe des achats intégrés pour la durée de transcription dans l’application store |
Les règles de promotion, de renouvellement, de crédit et de remboursement peuvent varier ; celles en vigueur sont indiquées sur la page d’achat, la page de paiement et le contrat de membre en cours.
Comparaison des forfaits entreprise
Voici le plan de paiement annuel par siège, publié sur la page officielle de l’entreprise le 30 août 2026.
| forfait | Prix | Durée de transcription annuelle | Nombre de mots par mois | Stockage |
|---|---|---|---|---|
| Édition de base pour entreprises | 478 yuans/personne/an | 1200 heures | 1 million de mots | 200G |
| Édition standard pour entreprises | 728 yuans/personne/an | 2640 heures | 2 millions de mots | 400G |
| Édition avancée pour entreprises | 1098 yuans/personne/an | 6000 heures | 6 millions de mots | 600G |
- Les forfaits de trois niveaux sont disponibles à partir d’une seule personne, et les avantages de place sont attribués conformément aux règles de la page.
- L’édition entreprise offre un panneau de gestion, une gestion des membres, une base de connaissances d’équipe et un règlement unifié.
- Les packs de ressources partagées, les API, le déploiement privé et les services sur mesure peuvent être facturés séparément.
- Le montant indiqué sur la page, allant jusqu’à 0,3 yuan par heure, n’équivaut pas au prix fixe pour tous les forfaits.
Avant l’achat, il convient d’obtenir une confirmation écrite du conseiller concernant la facturation simultanée et excessive, le stockage, la facturation, le renouvellement et les niveaux de service.
Plateforme de support
- Version web : idéale pour télécharger des fichiers, organiser des comptes rendus et gérer une base de connaissances.
- iPhone et iPad : les applications officielles exigent iOS ou iPadOS 15.0 ou ultérieur.
- Mac avec puce Apple : l’App Store indique qu’une version macOS 12.0 ou supérieure est requise.
- Android et mini-programmes : le site officiel propose des liens correspondants ; la version exacte est indiquée sur la page de téléchargement.
- Extension de navigateur : utilisée pour appeler des fonctionnalités liées à l’écoute cérébrale dans le navigateur.
- API et outils en ligne de commande : adaptés à l’intégration d’entreprise et au traitement automatisé.
API et compétences des développeurs
ListenBrain AI a rendu publiques des interfaces de transcription de fichiers hors ligne et de transcription vocale en temps réel ; il est nécessaire de demander une API Key avant de s’y connecter.
| interface | Mode d’accès | Restrictions publiques |
|---|---|---|
| Transcription de fichiers hors ligne | HTTP crée une tâche et pollue les résultats | Le fichier ne doit pas dépasser 6 Go et la durée ne doit pas dépasser 6 heures. |
| Transcription vocale en temps réel | Communication bidirectionnelle WebSocket | PCM monophonique, fréquence d’échantillonnage recommandée : 8 K ou 16 K |
| Créer une tâche hors ligne | Authentification par clé API ou token | Le QPS au niveau de l’utilisateur est de 20 |
| Tâche de recherche | Vérifier l’état de la tâche en boucle | Le QPS au niveau de l’utilisateur est de 30 |
| Connexion en temps réel | Flux audio WSS | Par défaut, 10 concurrents, avec un délai habituel de 200 à 500 millisecondes |
Lorsque des tâches hors ligne utilisent des fichiers du réseau public, l’adresse de téléchargement doit respecter les exigences HTTPS et une durée de validité ; les fichiers sensibles ne doivent pas être rendus publics directement.
GitHub et l’état open source
L’organisation officielle GitHub a rendu publiques les Skills CLI pour l’écoute cérébrale, qui permettent d’intégrer une partie de la transcription et des processus de traitement du savoir dans un Agent ou en ligne de commande.
- Permet de télécharger des vidéos et des audios locaux et de créer des tâches de transcription.
- Prend en charge la soumission de tâches d’analyse de liens web.
- Prend en charge la lecture des détails des enregistrements, du texte original et des procès-verbaux de réunion.
- Permet de mettre à jour le contenu du résumé ou de déclencher manuellement la transcription.
- Pour une exécution locale, Node.js 18 ou supérieur ainsi qu’une clé API valide sont requis.
Le fait que le code des outils officiels soit rendu public ne signifie pas pour autant que la plateforme ListenBrain AI, les modèles de reconnaissance vocale, le code source du serveur ou les poids des modèles soient open source.
Sécurité et déploiement d’entreprise
- La page de l’entreprise indique un chiffrement AES-256 pour la transmission et le stockage.
- La page présente des informations sur la sécurité tels que le niveau de protection 3, le RGPD et ISO 27001.
- Les autorités affirment que les services aux entreprises n’utilisent pas les données des utilisateurs pour entraîner des modèles.
- Les clients entreprises peuvent obtenir des informations sur l’intégration d’identités, le développement sur mesure et le déploiement privé.
- La portée réelle de l’authentification, la localisation des données et le mécanisme de suppression doivent être déterminés selon les documents justificatifs et le contrat.
À qui s’adresse-t-il
- Équipe administrative et produit : organisation des réunions régulières, évaluations et communication inter-services.
- Vendeurs et conseillers : consolider les entretiens avec les clients et extraire les points à suivre.
- Élèves et enseignants : génération de transcriptions en temps réel, de notes et de schémas conceptuels pour la classe.
- Médias et créateurs de contenu : extraction de textes d’interviews, de podcasts et de vidéos.
- Gestionnaire des connaissances d’entreprise : centraliser l’archivage des réunions et créer une base de connaissances partagée.
- Développeur : Automatiser les workflows vocaux via une API ou une CLI officielle.
Restrictions d'utilisation et précautions
- 98 % est le taux de précision maximal indiqué par le site officiel, et cela ne signifie pas que toutes les enregistrements pourront l’atteindre.
- Le bruit, l’accent, le cross-talk et la réception à longue distance diminuent la qualité de reconnaissance.
- Les résumés d’IA peuvent omettre le contexte ou tirer des conclusions erronées ; ils ne peuvent pas remplacer la confirmation par la personne responsable.
- L’enregistrement, le téléchargement et le partage peuvent impliquer des questions de confidentialité, de secrets commerciaux et de conformité aux règles relatives aux données personnelles.
- L’analyse du contenu en ligne doit respecter les règles de la plateforme d’origine ainsi que les exigences relatives aux droits d’auteur.
- Les prix API, la concurrence et l’étendue des services d’entreprise sont déterminés selon la console ou le contrat.
Questions fréquentes
Que peut faire principalement l’IA cérébrale ?
Il peut convertir les enregistrements audio et vidéo en texte, et générer des comptes rendus, des tâches à effectuer, des cartes mentales et des réponses à des questions.
L’IA auditif prend-elle en charge la transcription en temps réel ?
Prend en charge l’enregistrement et la transcription simultanés, ainsi que la distinction des interlocuteurs, le traitement des dialectes et des langues multiples.
L’IA pour l’écoute cérébrale peut-elle être utilisée gratuitement ?
Le site officiel propose un accès gratuit ; la durée de cette gratuité et les restrictions fonctionnelles dépendent de la page de compte après connexion.
Combien coûte l’édition entreprise d’ListenBrain AI ?
La cotisation annuelle publique est de 478, 728 ou 1098 yuans par personne ; les droits spécifiques et les frais supplémentaires sont déterminés selon le règlement et le contrat.
Quels formats de exportation le logiciel d’écoute cérébrale AI prend-il en charge ?
Les documents officiels de développement listent des formats tels que Word, PDF, Markdown et TXT ; l’entrée réelle varie en fonction de la version.
L’IA Auditive Brain propose-t-elle une API ?
Des interfaces de transcription de fichiers HTTP hors ligne et de transcription en temps réel via WebSocket sont mises à disposition et rendues publiques.
Est-ce que ListenBrain AI est un logiciel open source ?
La plateforme et les modèles ne sont pas open source ; seuls le projet d’outil CLI Skills est rendu public par les développeurs, et l’appel nécessite toujours une clé API.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164