Listnr 2.0
Valeur ajoutée gratuite
Guide complet des outils d’IA Outils audio IA

Listnr 2.0

Listnr 2.0, outil intelligent axé sur l’audio IA

Étiquettes :

Qu’est-ce que Listnr 2.0 ?

Listnr 2.0 est une plateforme de création vocale par IA gérée par Listnr Software Private Limited, qui convertit principalement du texte, des articles ou du contenu PDF en voix synthétique.

Il offre en même temps la clonation de voix, l’ingénierie de plusieurs locuteurs, l’hébergement de podcasts, la doublage vidéo et des API pour développeurs, idéal pour les utilisateurs qui ont besoin de générer des commentaires en masse ou d’intégrer des fonctionnalités vocales dans leurs produits.

Fonction principale

Synthèse vocale et contrôle précis

  • Après avoir saisi ou collé du texte, sélectionnez la langue, l’accent et le timbre pour générer une voix prévisualisable, puis exportez l’audio en MP3 ou WAV.
  • Ajuster la vitesse, le pitch, l’accentuation, les pauses et le style émotionnel, on peut également utiliser des balises SSML pour gérer des aspects rythmiques et phonétiques plus fins.
  • Créer une liste de prononciations personnalisée pour enregistrer la façon de prononcer les noms de marques, les noms propres ou les termes techniques, afin de pouvoir les réutiliser dans des projets ultérieurs.
  • Selon les spécifications officielles, plus de 1000 timbres sonores sont disponibles, couvrant plus de 142 langues et accents ; la gamme réelle disponible peut varier en fonction du forfait et du compte.

Plusieurs interlocuteurs, clonage et création de contenu

  • En assignant des timbres différents à des segments distincts au sein de la même ingénierie audio, il est possible de créer des interviews, des podcasts dialogués, des dialogues pédagogiques ou les voix de personnages de jeu.
  • La clonation de voix nécessite le téléchargement d’échantillons audio pour créer un timbre personnel pouvant être utilisé pour des synthèses ultérieures ; seules les voix de locuteurs pour lesquels une autorisation explicite a été obtenue peuvent être traitées.
  • La plateforme permet d’utiliser du texte et des commentaires audio pour la création de vidéos, ainsi que de créer, héberger et distribuer des podcasts, idéale pour regrouper l’écriture des scénarios et leur publication dans un seul flux de travail.
  • Pour les livres audio, les cours, les vidéos explicatives et les voix off publicitaires, il est possible d’écouter d’abord par paragraphes, puis de générer l’ensemble du projet, afin de réduire le gaspillage de crédits dus à des erreurs de prononciation ou de rythme.

Entrée, sortie et plateforme

TypeContenu pris en chargeUtilisations courantesPrécautions à prendre
Texte et SSMLSaisie manuelle, collage de documents, marques avec pauses et accentsDoublage, cours, livres audioLes différents timbres peuvent offrir un support différent pour les attributs SSML.
Articles et PDFAdresse de l’article ou adresse du fichier PDFAudio des articles, lecture de documentsL’API a besoin de ressources accessibles et consomme des crédits du compte.
Échantillons de voixEnregistrement de l’orateur autoriséCloner les timbres, la voix de la marqueLa voix fait partie des données biométriques sensibles et nécessite un consentement vérifiable.
Audio et vidéoProjets de synthèse vocale, de transcription, de traduction ou de doublagePodcasts, sous-titres, localisation multilingueLe temps de génération, le stockage et le nombre de vidéos sont limités par le forfait.

Pour l’instant, seule l’interface web est clairement utilisable ; aucune page officielle dans l’App Store d’iOS, le Google Play d’Android ou la boutique Chrome correspondant à ce produit IA n’a été confirmée pour l’instant. Avant de télécharger l’application du même nom, il convient de vérifier l’identité du développeur.

Tutoriel d'utilisation

  1. Créez un compte et accédez à l’éditeur audio ; commencez par filtrer les timbres en fonction de la langue du contenu, du public cible et de l’usage.
  2. Coller ou importer le document, le segmenter selon le sens ; attribuer un interlocuteur différent à chaque segment pour les éléments de dialogue.
  3. Définir la vitesse de parole, les pauses, l’accentuation et les règles de prononciation, puis visualiser un paragraphe à la fois pour vérifier la façon de prononcer les noms propres et les termes techniques.
  4. Générer l’audio complet, vérifier la prononciation, l’émotion et la cohérence du volume, puis exporter en MP3 ou WAV selon les besoins de montage ultérieurs.
  5. Lors d’une publication publique ou pour un projet commercial, vérifiez à nouveau les droits commerciaux du forfait utilisé, les autorisations relatives aux éléments visuels et les informations à divulguer concernant le contenu synthétisé requis.

Adapté aux utilisateurs et aux scénarios

  • Créateur de vidéos : Génère en masse des voix off pour des vidéos courtes, des tutoriels, des démonstrations de produits et du contenu narratif.
  • Équipe de podcasts et d’édition : création de dialogues en groupe, d’articles audio ou de livres audio, ainsi que utilisation des capacités d’hébergement et de distribution.
  • Équipes d’éducation et de formation d’entreprise : transformer les documents pédagogiques en audio multilingue pour faciliter l’apprentissage accessible ou les cours transrégionaux.
  • Développeurs et équipes de produits : générer du texte parlé via une API, obtenir des timbres de voix disponibles, consulter des tâches asynchrones ou recevoir des timestamps par mot.

Forfait de prix

Forfait ou versionPrixPériode de facturationDroits ou crédit principalAdéquat pour les utilisateurs
Individual$190Annuel20 000 points par mois, environ 2 heures de communication vocale, 50 GB d’espace de stockage, 50 vidéos par moisCréateur indépendant
Solo$390Annuel50 000 points par mois, environ 5 heures de communication vocale, 100 GB d’espace de stockage, 150 vidéos par moisCréateur ou petit groupe
Agency$990Annuel250 000 points par mois, environ 25 heures de communication vocale, 250 GB d’espace de stockage, 250 vidéos par moisPetites et moyennes entreprises et équipes d’agents

Les trois forfaits annuels comprennent tous les sons, des exportations illimitées, des intégrations audio illimitées ainsi que des droits commerciaux, mais il existe des limites claires en ce qui concerne la durée de l’audio, les points, le stockage et le nombre de vidéos.

L’inscription peut commencer gratuitement, mais les informations sur le montant gratuit stable ne sont pas encore publiées ; en cas d’options de paiement mensuel, de points selon la consommation ou de règlement par région, il convient de se référer à la page de facturation réelle.

Remboursement et annulation

  • Annuler l’abonnement ne fera qu’empêcher le prélèvement pour la prochaine période ; les frais déjà payés ne seront pas remboursés automatiquement.
  • Pour les utilisateurs hors UE, Royaume-Uni ou Inde, un remboursement intégral peut être demandé dans les 7 jours suivant l’achat initial, à condition que la quantité totale ne dépasse pas 1000 mots ou 5 minutes d’audio, et ce à titre discrétionnaire.
  • Les abonnements à durée indéterminée ne sont pas remboursables en principe ; les utilisateurs de l’UE, du Royaume-Uni et de l’Inde sont également soumis aux règles des consommateurs locaux.

État API et open source

  1. Générer une clé API dans l’interface administrative du compte, et la conserver uniquement de manière sécurisée du côté serveur ; ne pas l’intégrer dans le frontend ni dans le code public.
  2. Lors de l’appel de l’interface de conversion texte en voix, on transmet l’identifiant du timbre, le texte SSML ainsi que, facultativement, le style, le rythme de parole, le format et la fréquence d’échantillonnage.
  3. Pour de longs contenus, on peut utiliser des tâches asynchrones, enregistrer l’identifiant de la tâche retournée, puis consulter l’état de traitement et le résultat audio final.
  4. Lorsque l’alignement des sous-titres est nécessaire, on peut demander des timestamps mot par mot ; on peut également consulter la liste des timbres de voix, ou utiliser une interface vocale en flux avec clonage de timbre.

La documentation pour les développeurs et les exemples de requêtes sont publiés dans le répertoire de code de l’équipe, mais le répertoire ne précise pas la licence logicielle ; il ne doit donc pas être considéré comme un SDK open source pouvant être librement réutilisé.

La plateforme Listnr, les modèles sous-jacents et le code des services constituent un logiciel propriétaire ; les descriptions et exemples d’API publiques ne signifient pas que le produit lui-même est open source.

Confidentialité, droits d’auteur et sécurité

  • Les comptes, les appareils, les journaux d’utilisation, les tokens de paiement ainsi que les échantillons de texte, d’audio, de vidéo et de son téléchargés sont traités selon les besoins du service ; l’audio original est conservé par défaut pendant 30 jours avant d’être supprimé ou anonymisé.
  • La plateforme déclare ne pas vendre ni louer les données personnelles, et offre le droit ou la possibilité d’accéder, de corriger, de supprimer, d’exporter et de se désinscrire.
  • Concernant l’utilisation à des fins d’entraînement, les instructions de sécurité indiquent que les données ne sont pas utilisées à cette fin ; les conditions autorisent cependant l’utilisation des données vocales pour l’entraînement de modèles en dehors des conversations, après obtention d’un consentement explicite, et prévoient un mécanisme d’arrêt.
  • L’utilisateur conserve le droit de saisir du contenu ; la plateforme transfère aux utilisateurs les droits sur les résultats générés dans la mesure permise par la loi, mais ne garantit ni l’unicité des résultats ni qu’ils ne portent pas atteinte aux droits de tiers.
  • La clonation de la voix d’autrui sans consentement est interdite, tout comme les contenus illégaux, frauduleux, haineux, harcelants, de deepfake trompeurs et susceptibles de causer un préjudice grave.

Avantages et limites d'utilisation

Avantages principaux

  • Un environnement de montage intégrant des timbres vocaux multilingues, des dialogues à plusieurs personnes, un dictionnaire de prononciation, l’hébergement de podcasts et des API permet de couvrir divers processus, de la rédaction au déploiement.
  • Prend en charge la prévisualisation audio, l’export en MP3 et WAV, les tâches asynchrones et les timestamps par mot, permettant à la fois de créer du contenu directement et d’être utilisé pour une production programmée.

Utiliser les limites

  • La naturalité du timbre, la prononciation et les effets émotionnels varient en fonction de la langue, du timbre, du script et des paramètres ; une écoute humaine reste nécessaire avant une diffusion professionnelle.
  • La voix synthétique peut ressembler à des voix existantes ou aux résultats d’autres utilisateurs ; les utilisateurs commerciaux doivent vérifier eux-mêmes le texte, les droits de personnalité, les marques déposées, les matériaux audio et les règles relatives aux canaux de diffusion.
  • Le forfait annuel conserve des limites de points mensuels, de durée d’appel, d’espace de stockage et de nombre de vidéos, et l’API peut également faire l’objet de restrictions de débit ou de quotas insuffisants.
  • Lorsqu’il s’agit de montants, de plafonds, de délais de paiement, de remboursements ou de paramètres de données, il convient de se référer à la page de règlement réelle, à l’interface d’administration du compte et aux conditions les plus récentes.

Résumé

Listnr 2.0 est adapté aux particuliers et aux équipes qui souhaitent intégrer la génération de voix multilingue, le clonage de timbres vocaux, les podcasts et des API dans un même processus de création de contenu.

Avant de choisir un forfait, il convient de tester la qualité du son dans sa propre langue et avec son propre script, puis de vérifier le quota mensuel, les avantages commerciaux, les autorisations d’utilisation des voix ainsi que les paramètres d’entraînement des données.

©️Droit d’auteur : Sauf indication contraire, tous les articles de ce site sont protégés par le droit d’auteur.Partage d’outils d’IATous les droits d’auteur sont réservés. Sans autorisation, aucune personne, média, site web ou groupe ne peut reproduire, copier ou diffuser de quelque manière que ce soit le contenu de ce site, ni créer de mirror sur des serveurs qui ne lui appartiennent pas. Dans le cas contraire, notre site se réserve le droit de poursuivre en justice les responsables conformément à la loi.

Outils similaires à Listnr 2.0