Cleanvoice
Valeur ajoutée gratuite
Guide complet des outils d’IA Outils audio IA

Cleanvoice

Outil de post-production pour podcasts qui supprime automatiquement les tics verbaux, les pauses et le bruit

Étiquettes :

Qu’est-ce que Cleanvoice AI ?

Cleanvoice AI est une plateforme de post-traitement par IA destinée aux podcasts, interviews, livres audio, cours, commentaires et programmes vidéo. Une fois que les utilisateurs ont téléchargé un fichier audio ou vidéo, l’outil peut identifier automatiquement et supprimer les tics verbaux, les longs silences, les bruits de salive, les respirations audibles, les bégaiements et le bruit de fond, avant d’effectuer une normalisation du volume, un amélioration de la qualité de la voix, une transcription et un résumé du contenu.

Il se caractérise par la compilation de traitements audio répétitifs en préréglages, sans nécessiter que l’utilisateur cherche les formes d’onde frame par frame. Cleanvoice convient mieux aux contenus à dialogue et n’est pas une station de travail audio numérique complète.

Lorsqu’une mixage musical précis, une conception d’effets sonores, l’automatisation de plugins ou un traitement master est nécessaire, il convient néanmoins d’importer le résultat dans un logiciel professionnel pour une vérification supplémentaire.

Suppression automatique des tics verbaux

Le Removeur de mots de remplissage est utilisé pour identifier des expressions telles que « euh », « ah », « um » ainsi que les mots de remplissage dans différentes langues, et pour supprimer l’audio correspondant. Il permet de réduire les hésitations dans les discours et les interviews, et convient aux présentations en direct, aux cours et au contenu professionnel.

Tous les tics de langage ne doivent pas être supprimés. Certains mots jouent un rôle sur le ton, le rythme ou l’émotion ; en les enlever mécaniquement tous, le dialogue peut paraître précipité, ce qui peut également créer des sauts entre les mots.

Il est recommandé de conserver le fichier original et d’écouter l’allure typique de parole de chaque interlocuteur.

Silence prolongé et nettoyage des pauses

Silence Remover réduit les espaces vides excessifs et les périodes sans contenu, diminuant ainsi les temps d’attente, de réflexion et les segments sans information dus au changement d’appareil. Pour les podcasts longs, il permet de raccourcir considérablement le temps nécessaire pour trouver manuellement les pauses.

La respiration normale, le rythme avant et après les rires ainsi que le temps de réflexion pendant l’enseignement ne constituent pas nécessairement du silence superflu. Les émissions d’interviews et de narration devraient adopter des réglages plus conservateurs ;

Si l’on veut exporter une vidéo, il faut également vérifier si les transitions entre les plans sont naturelles.

Gestion des bruits de salive, de la respiration et du bégaiement

La plateforme peut détecter l’ouverture et la fermeture des lèvres, le claquement de langue, les clics, les inspirations marquées ainsi que certaines syllabes répétées, et tente de les silencer ou de les supprimer. Elle est adaptée aux bruits buccaux générés par des microphones à courte distance, ainsi qu’aux petits bruits parasites facilement audibles dans les livres audio et les commentaires.

Ces sons se superposent souvent aux consonnes, aux terminaisons de mots et à la respiration émotionnelle. Un traitement excessif peut étouffer les sons explosifs ou faire perdre au texte son aspect naturel.

Avant la publication officielle, il convient de vérifier la liste statistique et les points clés de montage ; on ne doit pas considérer le nettoyage automatique comme une maquette prête à l’emploi sans besoin d’écoute.

Suppression du bruit de fond

Le réducteur de bruit de fond est utilisé pour atténuer le bruit des ventilateurs, de la climatisation, des ordinateurs, du bruit de fond dans la pièce ainsi que les sons ambiantstablest. L’utilisateur peut activer uniquement la réduction de bruit ou la combiner avec des expressions répétées, des bruits de salive et un nettoyage silencieux pour créer son propre modèle de traitement.

Lorsque les bruits de circulation, la musique, la foule et les autres voix se superposent à la voix cible, l’algorithme peut produire un effet d’immersion sous-marine ou des résidus. Le clipping sévère et les enregistrements à longue distance ne peuvent pas être entièrement restaurés par le réduction de bruit ; il convient donc de contrôler l’environnement, la distance du micro et le niveau d’entrée pendant la phase d’enregistrement.

Audio Enhancer et Studio Sound

Audio Enhancer améliore la clarté des dialogues, tandis que Studio Sound permet de rapprocher les enregistrements ordinaires du son stéréolementé d’un studio. La normalisation de la luminosité uniformise les niveaux entre différents interlocuteurs et segments, et permet aux développeurs de définir un LUFS cible via l’API.

Les podcasts utilisent souvent environ -16 LUFS comme référence stéréo, mais les différentes plateformes, les programmes monophoniques et les spécifications des clients peuvent varier. La normalisation ne traite que du niveau global de volume et ne signifie pas l’élimination de tous les pics instantanés, des conflits de fréquence et des problèmes de dynamique.

Édition de podcasts audio et vidéo

Cleanvoice peut traiter directement l’audio et la vidéo. Le mode vidéo nettoie les dialogues tout en conservant la sortie multimédia, ce qui le rend adapté aux vidéos d’interviews, aux cours en ligne, aux enregistrements de réunions et aux vidéos courtes.

Il est possible d’importer des éléments depuis des appareils locaux, des adresses de fichiers, des enregistrements ou des captures d’écran.

La suppression de mots, de phrases et de pauses modifie en même temps la timeline. Les projets vidéo peuvent présenter des sauts d’image, des sous-titres décalés ou des mouvements des lèvres incohérents ; il est donc nécessaire de visionner l’intégralité du film après l’exportation, et non seulement d’écouter la piste audio.

Export de projets multicouches et de chronologies

La plateforme prend en charge le flux de travail à plusieurs pistes pour les podcasts. Les pistes séparées du présentateur et des invités peuvent être téléchargées et traitées ensemble. Selon les informations de facturation actuellement publiques, les fichiers à plusieurs pistes ne sont pas facturés supplémentairement pour l’instant, mais les autorités indiquent clairement que cette règle pourrait changer à l’avenir.

L’export de chronologie permet de transférer les décisions de montage automatiquement identifiées vers un environnement de montage compatible pour y apporter des ajustements supplémentaires. Les matériaux multipistes doivent conserver le même point de départ, la même fréquence d’échantillonnage et des noms de pistes clairs ; les pistes brutes non traitées doivent également être conservées avant le téléchargement.

Transcription, résumé et chapitres

Cleanvoice peut restituer une transcription complète, des informations temporelles au niveau des paragraphes et des mots, et générer des titres d’émission, des résumés, des chapitres, des points d’apprentissage clés ainsi que des descriptions d’émission. Il est adapté à la création de notes de spectacle, de notes de cours et à la recherche de contenu.

La transcription automatique peut être affectée par l’accent, les noms propres, les conversations simultanées et le bruit ; les résumés peuvent également omettre des conditions ou présenter des opinions comme des faits.

Les noms de personnes, les données, les déclarations publicitaires, le contenu juridique médical et les citations directes doivent être vérifiés manuellement.

Génération de contenu social

L’API et le flux de contenu actuel peuvent également générer des newsletters, des posts sociaux et du contenu pour les plateformes de réseaux professionnels, afin d’aider à décomposer un épisode en matériel de promotion. La sortie doit être considérée comme un brouillon ; avant publication, il est nécessaire d’ajuster le ton de la marque, les faits, la longueur et les règles de la plateforme.

Formats pris en charge

Les formats audio listés dans le SDK officiel Python comprennent WAV, MP3, OGG, FLAC, M4A, AIFF et AAC, tandis que les formats vidéo incluent MP4, MOV, WebM, AVI et MKV. Pour l’export, il est possible de choisir une correspondance automatique, MP3, WAV, FLAC ou M4A.

Le fait que le format soit lisible ne signifie pas que tous les encodages, les fréquences d’image variables et les fichiers endommagés puissent être traités correctement. Une échec de téléchargement n’entraîne aucune déduction du quota.

En cas d’anomalie, vous pouvez d’abord le convertir en WAV ou MP4 standard, puis vérifier si le fichier peut être joué complètement localement.

Essai gratuit

Cleanvoice propose une période d’essai gratuite sans carte de crédit, idéale pour télécharger d’abord de petits échantillons afin de comparer les résultats avant et après le traitement. La page des prix officielle ne décrit pas cette période d’essai comme un forfait gratuit permanent, et le texte public actuel ne garantit pas non plus un nombre de minutes d’essai inchangé à long terme.

Par conséquent, le catalogue classe les types de prix en essai gratuit, paiement à l’usage, abonnement et personnalisation d’entreprise. Les utilisateurs qui ont besoin de créer des contenus de manière continue doivent choisir le mode de paiement en fonction de la durée réelle des matériaux mensuels.

Comparaison des prix et des versions

Forfait ou versionPrix, plafonds et avantages clés
Prix payant à l’usagePay as You Go convient aux projets ponctuels et à une utilisation peu fréquente. Les prix en dollars actuellement affichés sont les suivants : 5 heures pour 11 dollars, soit environ 2,20 dollars de l’heure ; 10 heures pour 20 dollars, soit environ 2 dollars de l’heure ; 30 heures pour 45 dollars, soit environ 1,50 dollar de l’heure. Les crédits payants restent valides pendant 2 ans à partir de la date d’achat. Tous les forfaits affichés incluent des expressions répétitives, du bruit, du silence, de la vidéo, des sons de salive et des effets de nettoyage de la respiration, Studio Sound, l’exportation de la timeline, la transcription et un résumé, sans nécessité d’effectuer des mises à niveau pour chaque fonction individuelle.
Prix de l’abonnement mensuelL’abonnement mensuel convient aux programmes mis à jour chaque semaine ou de manière régulière. Les prix en dollars américains actuels sont les suivants : 11 dollars pour 10 heures, soit environ 1,10 dollar de l’heure ; 30 dollars pour 30 heures, soit environ 1 dollar de l’heure ; 90 dollars pour 100 heures, soit environ 0,90 dollar de l’heure. Le site officiel permet également de choisir un paiement annuel ; le rabais réel est indiqué sur la page de paiement. Les heures non utilisées de l’abonnement peuvent être reportées pendant la durée de l’abonnement, jusqu’à trois fois la quantité autorisée par le forfait mensuel. Par exemple, pour un forfait de 10 heures par mois, il est possible de reporter jusqu’à 30 heures accumulées des mois précédents et d’obtenir en plus les nouvelles heures du mois en cours.
Règles de facturation des créditsLa facturation est calculée en fonction de la durée du média téléchargé, avec une unité minimale de 1 minute, arrondie à l’unité supérieure. Par exemple, 10 minutes et 20 secondes seront facturées comme 11 minutes. Aucun frais n’est prélevé en cas d’échec du téléchargement ; si l’utilisateur dispose à la fois d’une abonnement et de crédits payants, le système utilise d’abord les crédits de l’abonnement, puis les crédits payants en cas de besoin. Après résiliation de l’abonnement, les crédits non utilisés ne peuvent être employés que jusqu’à la fin du cycle de facturation en cours ; les crédits payants conservent une validité de 2 ans à partir de la date d’achat initiale. Le prix affiché ne comprend pas la TVA ; les taxes sur les ventes ou la TVA varient en fonction du pays.

Prix payant à l’usage

Pay as You Go convient aux projets ponctuels et à une utilisation peu fréquente. Les prix actuels en dollars sont les suivants : 5 heures pour 11 dollars, soit environ 2,20 dollar de l’heure ; 10 heures pour 20 dollars, soit environ 2 dollars de l’heure.

30 heures pour 45 dollars, soit environ 1,50 dollar de l’heure.

Les crédits à la consommation sont valables 2 ans à partir de la date d’achat. Tous les forfaits publics incluent des tics verbaux, du bruit, du silence, de la vidéo, des sons de salive et de nettoyage de la respiration, Studio Sound, l’exportation de la timeline, la transcription et un résumé, sans nécessité de mise à niveau pour chaque fonction individuelle.

Prix de l’abonnement mensuel

L’abonnement mensuel convient aux programmes mis à jour chaque semaine ou de manière régulière. Le prix public actuel en dollars est de : 11 dollars pour 10 heures, soit environ 1,10 dollar par heure ; 30 dollars pour 30 heures, soit environ 1 dollar par heure.

100 heures pour 90 dollars, soit environ 0,90 dollar par heure. Le site officiel permet également de choisir le paiement annuel ; le rabais réel est indiqué sur la page de paiement.

Le solde inutilisé de l’abonnement peut être reporté pendant la durée de l’abonnement, jusqu’à trois fois le montant du forfait mensuel. Par exemple, pour un forfait de 10 heures/mois, il est possible de reporter jusqu’à 30 heures accumulées des mois précédents et de continuer à bénéficier du nouveau solde du mois en cours.

Règles de facturation des crédits

La facturation se base sur la durée du média entrant, avec une unité minimale de 1 minute, arrondie à l’unité supérieure. Par exemple, 10 minutes et 20 secondes seront facturées comme 11 minutes.

Aucun frais n’est facturé en cas d’échec du téléchargement ; si l’on dispose à la fois d’une abonnement et de crédits payants, le système utilise d’abord les crédits de l’abonnement, puis les crédits payants en cas de besoin.

Après l’annulation de l’abonnement, les crédits non utilisés ne peuvent être employés qu jusqu’à la fin du cycle de facturation en cours ; les crédits payants conservent une validité de 2 ans à partir de la date d’achat initiale.

Le prix affiché ne comprend pas la TVA ; la taxe de vente ou la TVA varie en fonction du pays.

Entreprises et forfaits à forte consommation

Les organisations qui traitent plus de 200 heures par mois, ont besoin d’extrémités API sur mesure, requièrent un soutien prioritaire ou des conditions de facturation spéciales peuvent demander le Plan Custom. Pour les flux de travail en masse de plusieurs milliers d’heures par mois, il est nécessaire de négocier séparément des remises, des paramètres de concurrence, la conservation des fichiers, les garanties de service et les conditions relatives aux données.

Les autorités proposent également des programmes destinés aux startups éligibles, permettant d’obtenir 100 heures de traitement ; les critères d’éligibilité et l’état d’ouverture sont indiqués sur la page de demande.

API

Cleanvoice propose une API officielle qui permet de soumettre des fichiers locaux ou des adresses de médias via une clé API, de choisir les paramètres de nettoyage, de surveiller l’avancement des tâches et de télécharger les résultats. Le forfait public est applicable tant aux applications web qu’à l’API, et les clients à fort volume peuvent demander des endpoints personnalisés.

L’API permet de contrôler les remplissages, les longs silences, les sons de bouche, la respiration, les bégaiements, la suppression du bruit, le son de studio, la normalisation, le LUFS cible, la transcription, le résumé, le contenu social ainsi que les formats d’exportation.

Dans un environnement de production, la clé API doit être stockée du côté serveur, et il faut gérer le téléchargement, la consultation des tâches, les délais d’attente, les soumissions répétées ainsi que l’expiration des liens de téléchargement.

SDK Python et JavaScript

Le SDK officiel Python peut être installé à l’aide du paquet cleanvoice-sdk et prend en charge la synchronisation, l’asynchrone, les opérations par lots, les fichiers locaux, l’audio en mémoire, la polluation automatique et le téléchargement des résultats ; il exige Python 3.8 ou une version ultérieure. Le SDK officiel JavaScript prend en charge Node.js et TypeScript et peut être installé à l’aide des paquets npm correspondants.

GitHub officiel propose également des nœuds de la communauté n8n, qui permettent d’écouter l’achèvement des tâches dans les workflows automatisés et d’associer des services de stockage, de publication et de notification. Le fait que des SDK et des nœuds soient rendus publics ne signifie pas pour autant que le modèle d’IA principal de Cleanvoice soit open source.

Statut open source

La plateforme Cleanvoice, les modèles de traitement du langage vocal, le code d’entraînement et les poids des modèles ne sont pas open source et sont principalement fournis sous forme de services cloud. Le SDK Python officiel est soumis à la licence MIT, tandis que le SDK JavaScript et le code d’intégration permettant d’accéder aux API commerciales doivent faire l’objet d’une consultation respective des licences du dépôt et des conditions de l’API.

Les projets similaires sur GitHub tels que CleanVoice, ClearVoice ou des projets d’amélioration audio peuvent ne pas être liés à l’entreprise Cleanvoice AI et ne doivent pas être considérés comme leur version locale hors ligne.

Enregistrement des fichiers et vie privée

Selon les FAQ relatives aux tarifs actuels, les fichiers originaux et ceux ayant fait l’objet d’une édition sont conservés pendant 7 jours, avant d’être supprimés définitivement. Les utilisateurs doivent néanmoins télécharger eux-mêmes les résultats et conserver une copie locale ; la page de tâche Cleanvoice ne doit pas être considérée comme un stockage cloud à long terme.

Lors du traitement d’entretiens avec des clients, de réunions d’employés, de questions médicales, juridiques et de contenus commerciaux non publiés, il convient de s’assurer que les participants ont donné leur consentement, de déterminer la région de transfert des données, de vérifier la conformité de l’organisation et de respecter les exigences de suppression. Les flux de travail API doivent également limiter les adresses de téléchargement public et les informations sensibles dans les journaux.

Guide d’utilisation de Cleanvoice AI

Terminer une tâche de base

  1. Vérifier l’enregistrement, le son, la musique et l’autorisation des participants ;
  2. Téléchargez ou saisissez un audio clair dans Cleanvoice AI ;
  3. Sélectionner la langue, le locuteur et les paramètres de traitement tels que la suppression automatique des marques de speech, etc. ;
  4. Utiliser le silence prolongé et les pauses pour nettoyer les résultats de transcription, de doublage ou de traitement.
  5. Vérifier par segment le nom, les chiffres, les pauses, le volume et l’émotion ;
  6. Vérifiez le format, le niveau de loudness, les droits d’auteur et les exigences de confidentialité avant d’exporter ;

Créer des flux de travail professionnels réutilisables

  1. Créer un ensemble de test avec du bruit réel, des accents et des extraits multiples ;
  2. Comparer les différences de traitement entre l’élimination automatique des tics verbaux, des silences prolongés et des pauses, d’une part, et le traitement des bruits de salive, de la respiration et du bégaiement, d’autre part ;
  3. Conserver l’enregistrement original et la transcription non modifiée ;
  4. Organiser une audition par un humain avant la publication externe ;
  5. Statistiques sur la durée de traitement, le taux d’erreurs et la consommation de crédit ;
  6. Mettre à jour régulièrement le glossaire, les autorisations sonores et la politique de suppression ;

À qui s’adresse-t-il ?

  • Équipe de podcasteurs qui produit régulièrement des émissions d’interviews et de dialogues ;
  • Créateurs qui nettoient les livres audio, les commentaires, les cours en ligne et les enregistrements de réunions ;
  • Monteurs qui doivent réduire en masse les tics verbaux, les pauses et les bruits buccaux ;
  • Les gestionnaires qui souhaitent une génération automatique de transcriptions, de chapitres, de résumés et de textes promotionnels ;
  • Développeurs qui construisent des flux de traitement audio et vidéo à l’aide d’API, de Python, de JavaScript ou de n8n.

Avantages du produit

  • Combiner plusieurs tâches de nettoyage de dialogues dans le même processus ;
  • Les forfaits publics offrent toutes les fonctionnalités complètes et se distinguent principalement en fonction de la durée de traitement ;
  • Prend en charge simultanément les forfaits à la consommation, les abonnements et les solutions sur mesure pour les entreprises ;
  • Le crédit d’abonnement est transférable, et le crédit payant reste valable pendant 2 ans ;
  • Prend en charge l’audio, la vidéo, les pistes multiples, la timeline et divers formats de sortie ;
  • Fournit une API officielle ainsi que des SDK pour Python et JavaScript.

Restrictions et précautions

  • La suppression automatique peut altérer par erreur les mots intonationnels, les pauses respiratoires, les consonnes et les pauses naturelles ; de plus, la vidéo présente des sauts.
  • La plateforme facture en arrondissant à l’heure entière selon la durée d’entrée, et non selon la durée finalement raccourcie.
  • Les crédits d’abonnement non utilisés après la résiliation ne sont pas conservés sur le long terme.
  • Les résultats dans le cloud ne sont conservés que 7 jours, et le modèle principal ne peut pas être déployé localement.
  • La transcription, le résumé et les textes pour les réseaux sociaux peuvent contenir des erreurs ; les émissions officielles nécessitent néanmoins une écoute manuelle, une vérification des faits, un contrôle du volume et une confirmation des droits d’auteur.

Questions fréquentes

Cleanvoice AI est-il gratuit ?

Une période d’essai gratuite sans carte de crédit est proposée, mais le site officiel ne la décrit pas actuellement comme un forfait gratuit permanent. Pour une utilisation continue, il est nécessaire d’acheter des crédits à l’usage, ainsi que des abonnements mensuels ou annuels.

Combien coûte Cleanvoice AI ?

Les forfaits à la consommation commencent à 11 dollars pour 5 heures ; l’abonnement mensuel commence à 11 dollars pour 10 heures.

Abonnement de 30 heures pour 30 dollars, abonnement de 100 heures pour 90 dollars, tous deux à prix public en dollars, hors TVA.

Le solde inutilisé expire-t-il ?

Après achat d’une quantité déterminée, la validité est de 2 ans. Le crédit de abonnement peut atteindre jusqu’à 3 fois le montant du forfait mensuel en cas de renouvellement continu ;

Une fois annulé, il ne peut être utilisé que jusqu’à la fin du cycle de facturation en cours.

Prend-il en charge les expressions orales en chinois ?

Le produit met l’accent sur la détection des expressions orales multilingues, mais sa précision réelle dépend du mandarin standard, des dialectes, des accents et de la qualité enregistrement. Pour les projets en chinois formel, il convient d’abord de tester avec des échantillons courts et d’effectuer une écoute manuelle.

Cleanvoice a-t-il une API ?

Oui. Les documents API officiels, le SDK Python, le SDK JavaScript et les nœuds n8n sont fournis ; les forfaits web et l’API utilisent tous des Credits en fonction du temps de traitement.

Cleanvoice est-il open source ?

La plateforme principale et les modèles d’IA ne sont pas open source ; le SDK Python officiel est licencié sous la licence MIT, et le SDK ouvert se limite à appeler les services cloud.

©️Droit d’auteur : Sauf indication contraire, tous les articles de ce site sont protégés par le droit d’auteur.Partage d’outils d’IATous les droits d’auteur sont réservés. Sans autorisation, aucune personne, média, site web ou groupe ne peut reproduire, copier ou diffuser de quelque manière que ce soit le contenu de ce site, ni créer de mirror sur des serveurs qui ne lui appartiennent pas. Dans le cas contraire, notre site se réserve le droit de poursuivre en justice les responsables conformément à la loi.

Outils similaires à Cleanvoice