Auphonic
Outil IA pour l’autocomplétion de la loudness, du réduction de bruit, de l’équilibrage et de la publication de podcasts
Étiquettes :Outils audio IAQu’est-ce qu’Auphonic ?
Auphonic est une plateforme automatisée pour le post-traitement audio et l’export de masters de podcasts. Les utilisateurs téléchargent des fichiers audio ou vidéo déjà enregistrés, et le système analyse la voix, la musique et les sons d’arrière-plan pour effectuer automatiquement un équilibrage du volume, une réduction du bruit et du réverbère, du filtrage, de l’AutoEQ, une normalisation de la loudness et une limitation des pics réels, afin de générer des fichiers conformes aux normes des podcasts, de la radiodiffusion, du streaming ou des livres audio.
Ce n’est pas une plateforme d’enregistrement à distance, ni un poste de travail audio numérique axé sur un montage manuel complexe. Auphonic convient mieux comme « dernière étape de post-traitement automatique » dans le processus de production : on termine d’abord le contenu et la structure dans un logiciel d’enregistrement ou de montage, puis on laisse ce dernier uniformiser la qualité sonore, le volume, les métadonnées et le processus de publication.
Fonctionnalités clés d’Auphonic
Intelligent Leveler – Équilibrage intelligent du niveau
Adaptive Leveler identifie les différents interlocuteurs, la musique et les bruits de fond, booste les voix plus faibles et contrôle les segments trop forts, tout en évitant d’amplifier aveuglément les respirations, les bruits de vent et les silences. Il convient aux contenus axés sur la voix tels que les interviews, les podcasts, les cours, les réunions et les commentaires audio, et permet de réduire le travail de compression manuelle et d’ajustement du volume par segment.
Réduction du bruit, suppression de l’écho et réparation de la voix
La réduction du bruit et de la réverbération permet de gérer le bruit de fond continu ainsi que les sons ambiant qui évoluent dans le temps ; l’utilisateur peut également choisir de conserver ou d’atténuer des éléments tels que la musique ou la respiration. Le filtrage, l’AutoEQ et l’extension de bande servent à améliorer l’équilibre des fréquences, les harmoniques désagréables, les sons explosifs et le manque de bande passante.
Le clipping sévère, les échos très forts ou le fait que plusieurs personnes parlent en même temps restent difficiles à corriger complètement ; la qualité d’enregistrement reste toujours limitée.
Normalisation de la loudness et limitation du True Peak
Auphonic permet d’unifier le niveau de loudness moyen des différents fichiers selon des cibles LUFS, RMS et pic réel, et prend en charge les normes courantes telles que EBU R128, ATSC A/85, les podcasts et l’audio mobile, YouTube, Spotify, Netflix, Audible/ACX, etc. Le True Peak Limiter utilise le suréchantillonnage pour éviter les pics entre échantillons, ce qui est idéal pour assurer la cohérence entre plusieurs programmes et plateformes avant la publication.
Suppression automatique des pauses, des tics verbaux et des toux
La plateforme peut identifier et supprimer les silences trop longs, les pauses, les toux ainsi que des mots de remplissage tels que « ah », « euh » dans les langues multiples. Le découpage automatique risque de supprimer par erreur les pauses utilisées pour marquer le rythme ; par conséquent, pour les programmes officiels, il convient d’abord de visualiser le résultat de l’édition et de restaurer les segments si nécessaire.
Mixage automatique multi-pistes
La production multitrack analyse séparément les pistes parallèles du présentateur, des invités, de la musique, etc., puis génère automatiquement le mix final, en prenant en charge le ducking automatique, la porte anti-bruit et le traitement du bruit de micro. Chaque piste doit utiliser un fichier indépendant et commencer au même moment.
Il est préférable qu’un interprète corresponde à une piste, et que la musique soit séparée de la voix.
Il est destiné aux programmes vocaux et n’est pas adapté au mixage créatif de pièces musicales purement instrumentales.
Transcription, Notes de présentation et chapitres
L’utilisateur peut activer Auphonic Whisper ou se connecter à un service externe de reconnaissance vocale pour générer des transcriptions avec des timestamps. Le système peut également organiser automatiquement les résumés, les étiquettes, les shownotes et les chapitres, ainsi que l’ajouter en métadonnées au fichier de sortie.
Les projets multi-canaux permettent d’identifier séparément chaque interlocuteur, réduisant l’impact du bruit de fond sur la précision. Le texte généré automatiquement nécessite néanmoins une vérification manuelle des noms, des chiffres et des termes techniques.
Codage, vidéo, publication et automatisation
Une seule conversion peut générer plusieurs formats tels que MP3, AAC, WAV, FLAC, etc. Il est possible d’ajouter une couverture, des métadonnées et des chapitres, ainsi que de traiter les pistes audio dans une vidéo et de créer un audiogramme. La plateforme prend en charge la connexion aux services de stockage cloud et de publication de podcasts ; en combinaison avec les presets, les dossiers de suivi, le traitement en masse, Zapier, la CLI et l’API REST, elle permet d’automatiser le processus « téléchargement — traitement — publication ».
API et GitHub
Auphonic propose une API simple et une API JSON complète, permettant de créer des tâches mono ou multitrack, d’uploader des fichiers, d’appliquer des préférences prédéfinies, de consulter l’avancement et d’obtenir les résultats à l’aide d’une clé API, d’authentification basique ou d’OAuth 2.0. L’organisation officielle GitHub met à disposition des exemples de code API en Python, JavaScript, PHP et Shell.
Le fait que l’exemple soit open source ne signifie pas que les algorithmes et modèles audio cloud d’Auphonic soient également open source.
Comparaison des prix et forfaits Auphonic
Auphonic déduit des crédits en fonction de la durée de l’audio généré après traitement réussi, avec un minimum de facturation de 3 minutes. L’abonnement mensuel comprend des crédits récurrents fixes, offrant une économie d’environ 20 % pour un paiement annuel.
Les prix en dollars indiqués ci-dessous sont ceux en vigueur au moment de la vérification ; les taxes et les frais de règlement peuvent varier selon la région.
| Plan | Durée de traitement | Monthly / Annuel, moyenne mensuelle | Scénarios adaptés |
|---|---|---|---|
| Auphonic Free | 2 heures/mois | 0 dollar | Tester l'algorithme principal ; sortie gratuite avec jingle Auphonic, pas de cumul des crédits |
| Auphonic S | 9 heures/mois | 13,75 / 11 dollars | Podcasts personnels et mises à jour peu fréquentes |
| Auphonic M | 21 heures/mois | 31,25 / 25 dollars | Émissions hebdomadaires stables ou à plusieurs formats |
| Auphonic L | 45 heures/mois | 65 / 52 dollars | Contenu à haute fréquence et petites équipes de production |
| Auphonic XL | 100 heures/mois | 141,25 / 113 dollars américains | Ateliers, cours et programmes en masse |
| Auphonic XXL | 250 heures/mois | 306,25 / 245 dollars américains | Production audio à grande échelle |
| Business | 1000 heures/mois ou plus | Contacter le service des ventes | Comptes d’équipe, contrats sur mesure, factures manuelles et traitement à grande échelle |
Les Crédits récurrents sont réinitialisés chaque mois, et la partie non utilisée n’est pas reportée. Si la consommation est irrégulière, vous pouvez acheter séparément des Crédits uniques de 5, 10, 25, 50, 100, 250, 500, 1000, 2000 ou 3000 heures ;
Ce type de limite ponctuelle n’expire jamais ; le tarif détaillé est indiqué sur la page d’achat, et il est également possible d’activer un rechargement automatique lorsque le solde est inférieur au nombre d’heures spécifié.
Différences entre la version gratuite et la version payante
| Capacité | Free | Paiement mensuel/unique | Abonnement annuel/Entreprise |
|---|---|---|---|
| Équilibre de base, réduction du bruit, AutoEQ, loudness | Soutien | Soutien | Soutien |
| Production multi-pistes | Moins de 20 minutes par séance | Soutien | Soutien |
| Transcription multilingue, notes explicatives automatiques et chapitres | Sans | Soutien | Soutien |
| Dossier de surveillance et création en masse | Sans | Soutien | Soutien |
| Sortir le jingle | Contient | Aucun | Aucun |
| Compte d’équipe et traitement prioritaire | Sans | Sans | Direction de soutien |
Comment calculer les crédits
- La facturation se fait en fonction de la durée audio de la sortie finale, et non de la durée totale des pistes d’entrée.
- Pour une production multi-pistes de 1 heure sur 4 pistes qui produit un film de 1 heure, cela consomme généralement 1 heure de crédits.
- Ajouter 1 minute d’introduction à un programme de 20 minutes donne 21 minutes, le calcul se fait sur 21 minutes.
- En cas d’échec, aucun crédit n’est déduit ; pour un résultat insatisfaisant, vous pouvez décrire le problème sur la page de la tâche et demander un remboursement.
- L’éditeur officiel permet un retraitement gratuit uniquement lorsqu’on modifie les résultats de l’édition, les métadonnées et les paramètres avant de les appliquer à nouveau, sans changer le fichier d’entrée.
- Utiliser en priorité les abonnements récurrents, puis les abonnements uniques, et en dernier ressort la limite gratuite.
Guide d’utilisation d’Auphonic
- Terminer le montage du contenu :Supprimez d’abord de longs segments d’erreurs dans l’éditeur habituel, afin de vous assurer que la structure du générique d’ouverture, du texte principal et du générique de fin est correcte.
- Créer Production :Téléchargez un seul mix final, ou téléchargez des pistes avec un point de départ synchronisé pour chaque locuteur et pour la musique.
- Définir l’algorithme :Activez Leveler, Réduction du bruit/reverb, AutoEQ et suppression des pauses/marmonnements en fonction des problèmes d’enregistrement.
- Sélectionner le volume :Les podcasts stéréo commencent généralement à -16 LUFS ; pour les monophoniques, les émissions de radio ou les livres audio, il convient de choisir la norme correspondante.
- Configuration de sortie :Sélectionnez le format de fichier, le débit binaire, la couverture, les chapitres et la cible de publication, puis enregistrez-le en Préreglage pour une réutilisation ultérieure dans des programmes.
- Traiter et vérifier :Prêtez une attention particulière aux parties de début, les plus bruyantes et les plus calmes, et vérifiez le découpage, le volume, la transcription et les métadonnées.
Guide d’utilisation d’Auphonic
Créer des flux de travail professionnels réutilisables
- Créer un ensemble de test avec du bruit réel, des accents et des extraits multiples ;
- Comparer les différences de traitement entre Intelligent Leveler pour l’équilibrage du niveau de signal, la réduction du bruit, l’élimination du réverbère et la correction du son, ainsi que la normalisation de la dynamique et la limitation du True Peak ;
- Conserver l’enregistrement original et la transcription non modifiée ;
- Organiser une audition par un humain avant la publication externe ;
- Statistiques sur la durée de traitement, le taux d’erreurs et la consommation de crédit ;
- Mettre à jour régulièrement le glossaire, les autorisations sonores et la politique de suppression ;
À qui s’adresse-t-il
- Créateurs de podcasts qui souhaitent finaliser rapidement les masters d’équilibrage, de réduction du bruit et de niveau sonore ;
- Équipe pédagogique chargée du traitement des enregistrements de conférences, de cours, de réunions et d’interviews ;
- Créateurs de contenu audio qui doivent respecter les normes de loudness pour ACX, la radiodiffusion ou le streaming ;
- Équipes souhaitant automatiser les pipelines de construction en masse via des API, des Watch Folder et des déploiements automatiques ;
- Il existe déjà des logiciels de montage, mais ils sont nécessaires aux utilisateurs de vidéo et d’audio qui ont besoin d’une automatisation fiable pour les étapes finales de traitement.
Questions fréquentes
Auphonic est-il gratuit ?
2 heures de traitement audio par mois gratuitement, la quantité gratuite n’est pas cumulable, et les produits finis des utilisateurs gratuits incluent un jingle Auphonic. Idéal pour les tests ; une publication officielle nécessite généralement des crédits payants.
Auphonic peut-il remplacer Audition ou des logiciels de montage ?
Il ne peut pas être entièrement substitué. Il excelle dans le post-traitement automatique, le volume et la publication, mais il n’est pas adapté au montage de contenus complexes, à la mixage de musique pure ni aux effets créatifs détaillés.
Est-ce que la tarification multicanal est basée sur la durée totale des pistes ?
Non. En général, le tarif est calculé en fonction de la durée totale de la sortie : 4 pistes synchronisées d’une heure chacune sont combinées pour former une vidéo d’une heure, ce qui consomme environ 1 heure de crédits.
Les crédits d’un seul usage expirent-ils ?
Non. Les Crédits Uniques ne pérennissent jamais ;
Les crédits récurrents mensuels sont réinitialisés chaque mois et ne peuvent pas être reportés.
Auphonic a-t-il une API ?
Oui, les utilisateurs gratuits et payants peuvent utiliser l’API REST. L’éditeur fournit également une CLI, Zapier, Watch Folder ainsi que des exemples de code. Pour une intégration à grande échelle ou sous marque blanche, veuillez contacter le service commercial.
Auphonic est-il open source ?
La plateforme de traitement cloud centrale et les algorithmes ne sont pas open source. GitHub officiel fournit des scripts d’exemple d’API, et certains clients communautaires le sont également, mais cela ne signifie pas qu’il est possible de déployer localement un service Auphonic complet.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164