NaturalReader
NaturalReader, outil intelligent axé sur l’audio IA
Étiquettes :Outils audio IAQu’est-ce que NaturalReader ?
NaturalReader est un produit de conversion texte en voix géré par la société canadienne NaturalSoft Ltd., destiné à trois utilisations : la lecture personnelle, les groupes éducatifs et la doublage commercial.
La version personnelle se concentre sur la lecture à voix haute de documents, de pages web et d’images pour les utilisateurs, tandis que la version commerciale AI Voice Generator transforme les scripts en doublages prêts à être publiés ou redistribués ; les avantages, fonctionnalités et autorisations des deux comptes ne peuvent pas être mixés.
Fonctionnalités principales de la version individuelle
Lecture de documents, de pages web et de scans
- Il est possible de télécharger des fichiers tels que PDF, Word, PowerPoint, TXT, RTF, ODT et EPUB sans DRM, ou bien d’entrer ou de coller du texte directement.
- La fonction d’extraction de pages web permet d’ajouter des articles ordinaires à une base de données et de les lire à haute voix ; les pages dynamiques, le contenu de connexion ou les pages à interaction complexe ne peuvent pas toujours être extraites complètement.
- Les abonnés peuvent utiliser l’OCR pour traiter des PDF, PNG et JPEG scannés ; un PDF scanné peut être converti en maximum 50 pages à la fois, et les fichiers multi-pages peuvent être continués par lots.
- La numérisation par caméra mobile convient aux livres imprimés, aux supports pédagogiques et aux notes ; une image floue, à faible contraste, avec des marges complexes ou une écriture illisible réduit la précision de la reconnaissance et de l’ordre de lecture.
Aide à la lecture et export audio
- Le texte est mis en surbrillance en temps réel lors de la lecture à voix haute, et il est possible d’ajuster la voix, le rythme, le mode d’affichage et les sous-titres ; l’éditeur de prononciation sert à corriger les noms, les abréviations et les termes techniques.
- La fonction de notes permet de marquer le document et d’ajouter des annotations ; lors de l’exportation en PDF avec soulignement, le texte des annotations n’est pas inclus.
- Le filtre intelligent AI permet d’ignorer les numéros de page, les tableaux, les graphiques et autres éléments perturbateurs, mais les mises en page complexes nécessitent encore une vérification manuelle des résultats du filtrage.
- Le plan individuel payant prend en charge la conversion MP3, avec une limite de 50 000 caractères par insertion de texte ; les fichiers générés restent dans la bibliothèque audio pendant 30 jours.
Fonction d’apprentissage de ReadAI
- ReadAI peut générer des podcasts, des résumés, des quiz, des Q&R ou des réponses dialoguées à partir de documents téléchargés, mais il ne fonctionne pas directement avec du texte copié manuellement.
- Podcast et Recap peuvent traiter l’ensemble du document ou des sections sélectionnées, jusqu’à 500 pages par fois ; Podcast ne prend en charge que deux speakers au maximum.
- Ces contenus générés sont destinés à un usage personnel et privé ; l’ajout de résumés, de quiz ou de podcasts ne confère pas le droit de les publier en ligne.
- Les résultats de l’IA peuvent omettre le contexte ou contenir des erreurs factuelles ; les apprenants doivent néanmoins retourner au texte original pour vérifier les citations, les chiffres et les conclusions clés.
Le son et le langage
- Free Voices provient des appareils, systèmes ou navigateurs ; les options réelles varient en fonction de la plateforme ; Lite, Plus et Pro sont des niveaux différents de voix IA.
- Plus couvre le chinois, l’anglais, le japonais, le coréen, l’arabe ainsi que de nombreuses autres langues et accents ; les voix disponibles ne couvrent pas nécessairement toutes les langues de la liste.
- Pro utilise des voix multilingues de qualité supérieure et prend en charge les styles de lecture, mais l’éventail des langues est actuellement plus restreint que celui de Plus.
- Les plans personnels Plus et Pro permettent de cloner jusqu’à deux voix personnelles ; il est nécessaire d’obtenir une autorisation valide avant de télécharger des voix d’autres personnes.
Version commerciale du générateur de voix IA
- En entrant des scripts dans le navigateur, en sélectionnant des sons et en les éditant par paragraphes, il est possible de créer des voix off pour des publicités, des vidéos, des podcasts, des cours, des formations, des présentations et des jeux.
- Actuellement, il intègre des modèles de voix tels que Gemini, OpenAI, Azure et ElevenLabs ; ces différents modèles diffèrent en termes de langue, de contrôle du ton et de consommation d’énergie par caractère.
- Prompt Control permet d’ajuster le ton, le rythme, le style et l’accent à l’aide de prompts ; certains modèles prennent également en charge le Voice Design et les étiquettes intrasentences, les capacités dépendant du modèle choisi.
- Jusqu’à quatre voix clonées par IA peuvent être créées, en utilisant l’éditeur de prononciation et l’assistant de script, avec une exportation en MP3 ou WAV à 44,1 kHz.
- L’audio généré par une abonnement commercial peut être utilisé dans des contextes commerciaux, publics et de redistribution, mais l’utilisateur doit tout de même disposer des droits nécessaires pour les scripts, la musique, les voix des personnages et autres éléments.
Tutoriel d'utilisation
Processus de lecture à voix haute individuelle
- Inscrivez-vous et connectez-vous sur le site web, iOS, Android ou via une extension de navigateur ; le même compte permet de synchroniser la base de données entre différents appareils.
- Vous pouvez télécharger des documents, des photos ou des PDF scannés, coller du texte ou ajouter des pages web ordinaires ; les livres électroniques avec DRM ne peuvent pas être importés.
- Si le système détecte du texte dans l’image, sélectionnez la plage de pages OCR et effectuez la conversion, puis vérifiez si l’ordre des colonnes, les titres et le contenu de la page de pied ont été correctement reconnus.
- Choisissez la voix et l’accent adaptés à la langue, ajustez la vitesse de parole, le filtrage, la prononciation, ainsi que les paramètres des sous-titres et du soulignement, puis commencez à lire à haute voix.
- Pour une écoute hors ligne, utilisez une conversion MP3 payante et téléchargez le fichier avant que la limite ne soit réinitialisée ou que l’audio n’expire.
Processus de doublage commercial
- Testez d’abord la qualité sonore et les fonctionnalités avec un compte professionnel gratuit ; les utilisateurs gratuits peuvent écouter jusqu’à 10 000 caractères par jour, mais ne peuvent pas télécharger l’audio.
- Créez un nouveau projet et collez des scripts propriétaires ou autorisés, divisez les blocs de texte par scène, puis sélectionnez le modèle, la langue et la voix.
- Utilisez les indications, le dictionnaire de prononciation, le rythme et les étiquettes pris en charge par le modèle pour contrôler l’expression ; une nouvelle conversion après modification consommera à nouveau des points.
- Écoutez chaque bloc de texte, vérifiez les noms propres, le changement de langue, les pauses et l’émotion, puis exportez en MP3 ou WAV.
- Enregistrez les données d’autorisation avant la publication, et vérifiez que la voix des personnages, le script ainsi que les éléments de fond sont autorisés pour la plateforme cible, le client et la région concernée.
Prix et forfaits
| Forfait ou version | Prix | Période de facturation | Droits ou crédit principal | Adéquat pour les utilisateurs |
|---|---|---|---|---|
| Version gratuite individuelle | Gratuit | Disponible à long terme | Utilisation des voix gratuites fournies par le dispositif, certaines voix IA et ReadAI sont disponibles uniquement à titre d’essai limité ; pas de OCR payant ni d’export en MP3. | D’abord, une expérience personnelle de lecture à voix haute et de synchronisation entre appareils |
| Personnel Lite | 13,90 dollars, ou 79 dollars par an | Prépaiement mensuel ou annuel | Aucune limite de lecture pour les sons Lite, 1 million de caractères MP3 Lite par mois, avec OCR, annotations, édition de la prononciation, Smart Filter et ReadAI | Nécessite une lecture de scan et une exportation de base des personnes |
| Personnel Plus | 20,90 dollars, ou 119 dollars par an | Prépaiement mensuel ou annuel | 500 000 comptes Plus partagent des caractères lus chaque jour avec des voix clonées, 1 million de caractères MP3 sont partagés chaque mois, et au maximum deux voix peuvent être clonées. | Apprenants ayant besoin de plus de langues et de sons naturels |
| Pro personnel | 25,90 dollars, ou 159 dollars par an | Prépaiement mensuel ou annuel | 500 000 comptes Plus et Pro partagent des caractères de lecture chaque jour, 1 million de comptes Plus, clones et Pro partagent des caractères MP3 chaque mois, y compris les styles de lecture. | Personne qui accorde de l’importance à une qualité sonore élevée et au style d’expression |
| Starter commercial | 29 dollars par mois, ou 198 dollars par an | Un utilisateur, paiement à l’avance par mois ou par an | 500 000 points par mois, licence audio commerciale, quatre voix clonées, assistant de script, MP3 et WAV | Créateurs individuels avec un volume de voix faible à moyen |
| Créateur commercial | 49 dollars par mois, ou 297 dollars par an | Un utilisateur, paiement à l’avance par mois ou par an | 2 millions de points par mois, avec les mêmes fonctionnalités que les autres forfaits professionnels mais un montant plus élevé | Créateurs qui produisent continuellement des vidéos, des cours ou des podcasts |
| Équipe commerciale | 33 dollars par utilisateur et par mois, ou 192 dollars par utilisateur et par an | Au moins deux utilisateurs | 2 millions de points partagés par utilisateur et par mois, soit 4 millions pour deux personnes ; quota de partage pour l’équipe | Équipes nécessitant une collaboration multiple et une autorisation unifiée |
| Groupe EDU | EDU Plus : à partir de 299 dollars par an pour 5 personnes ; Lite EDU : à partir de 599 dollars par an pour 50 personnes | Prépaiement annuel | Gestionnaire, base de données partagée optionnelle et fonction de lecture personnelle ; licence site pour au moins 2 000 utilisateurs, à partir de 3 300 dollars par an | Écoles, bibliothèques et institutions éducatives |
Limites et points d’attention pour le règlement
- Les abonnements personnels comprennent tous un site web, une application mobile et une extension Chrome, mais pas la version professionnelle ; les abonnements professionnels ne comprennent pas non plus l’application de lecture personnelle.
- Les points commerciaux sont déduits par caractère : Gemini, OpenAI et Azure coûtent généralement 1 point par caractère, tandis qu’ElevenLabs Turbo et HD peuvent coûter respectivement 10 et 20 points.
- Les caractères chinois, japonais et coréens sont comptés par deux, et les espaces, les signes de ponctuation, les symboles et les étiquettes sont également pris en compte.
- Les points d’achat supplémentaires commerciaux ne sont disponibles que pour les abonnements valides. Les 4 millions de points indiqués actuellement coûtent 99 dollars et augmentent selon le même ratio ; les points d’achat supplémentaires non utilisés ne perdent pas leur validité, mais ne peuvent pas être utilisés en l’absence d’un abonnement valide.
- Certaines pages d’aide affichent encore des informations relatives aux anciens forfaits ou aux anciennes limites de crédit ; les achats en magasin peuvent également être affectés par la région, les taxes et les commissions de la plateforme ; il convient de se référer à la page de paiement après connexion.
Différences entre licence personnelle et licence commerciale
| Critère de comparaison | Version personnelle et EDU | Édition professionnelle |
|---|---|---|
| Utilisation principale | Lecture à voix haute en privé, apprentissage et écoute personnelle sans redistribution | Création de doublages destinés à être publiés, utilisés en interne ou distribués aux clients |
| Publier sur une vidéo ou une plateforme sociale | Interdit, même avec les abonnements payants Plus, Pro ou EDU | L’audio généré par une abonnement payant peut être publié sous licence. |
| Distribution en classe et en formation interne | Dès qu’on le diffuse ou le partage avec d’autres, il n’est plus à usage personnel. | Autorisation commerciale requise |
| Mode d’entrée | Documents, pages web, images, scans et texte collé | Axé principalement sur l’édition de scripts et de projets, sans fonctionnalités d’aide à la lecture pour version personnelle. |
| Sortie | Lecture à voix haute et écoute personnelle MP3 | MP3 et WAV avec licence commerciale |
L’audio généré dans le cadre d’une abonnement personnel est réservé à l’usage privé de son propriétaire ; le placer dans des vidéos non lucratives, des démonstrations en classe, des formations internes ou l’envoyer à des clients constitue également une forme de partage ou de redistribution.
La licence commerciale couvre l’utilisation de l’audio généré, mais ne résout pas automatiquement les problèmes de droits liés au téléchargement de scripts, à la clonation de sons, de musique ou de marques.
Plateforme, interfaces et statut open source
- La version individuelle est disponible sur le web, iOS et Android, et offre une extension Chrome ; l’extension peut également être utilisée dans Edge.
- L’« installation » sur plateforme desktop consiste à créer une fenêtre indépendante et des raccourcis depuis le navigateur ; elle n’est pas équivalente aux logiciels desktop traditionnels hors ligne, puisque leur fonctionnement dépend principalement de services en ligne.
- La version commerciale est actuellement une application navigateur ; pour cette fois, les API, SDK, restrictions de débit ou prix officiels d’accès destinés aux développeurs en général n’ont pas été confirmés.
- Aucun dépôt de code source des produits publiés par NaturalSoft, ni licence open source n’a été confirmé ; le fait que des projets tiers utilisent le nom NaturalReader ou des interfaces non publiques ne signifie pas que les produits sont open source ou autorisés à des fins commerciales.
Confidentialité, sécurité et conservation des données
- Le service gère les informations de compte, le téléchargement de documents, de pages web, de contenu OCR, de scripts, d’indications, de traductions, de résumés, de quiz, d’audio, de commentaires ainsi que des échantillons audio d’autorisation.
- La politique de confidentialité actuelle stipule clairement que le contenu des clients ou les résultats générés ne sont pas utilisés pour entraîner NaturalSoft ou des modèles d’IA tiers ; seules les informations nécessaires sont transmises aux fournisseurs de services vocaux ou d’IA lorsque des fonctionnalités spécifiques sont proposées.
- Par défaut, les documents personnels et les projets professionnels sont conservés pendant un maximum de deux ans, ceux téléchargés sans inscription pendant un maximum de 36 heures, et les fichiers audio peuvent être téléchargés et conservés pendant 360 jours ; les utilisateurs peuvent supprimer à tout moment le contenu qu’ils souhaitent.
- Après la suppression du compte, les informations d’identification sont immédiatement supprimées du système de l’activité ; les autres données des comptes d’activité sont généralement supprimées dans un délai de 24 heures ; les sauvegardes chiffrées peuvent être conservées pendant 360 jours, à l’exception des archives fiscales, antifraude et juridiques.
- Le système de production principal est situé sur AWS aux États-Unis, et les données peuvent également être traitées au Canada ainsi que dans le pays du fournisseur de services ; la transmission s’effectue via TLS 1.2 ou une version ultérieure, et les données statiques sont chiffrées à l’aide d’AES-256 ou par le fournisseur de services cloud.
- Aucune authentification multifacteur pour les utilisateurs finaux n’est actuellement disponible ; les utilisateurs doivent utiliser un mot de passe fort et distinct, ainsi que protéger leur adresse e-mail associée et leurs comptes Google ou Apple.
- Le produit n’est pas destiné aux données hautement sensibles ou soumises à une réglementation spéciale ; les informations de santé protégées, les données de cartes de paiement, les identifiants gouvernementaux ou les bases de données biométriques ne doivent pas être soumises sans accord écrit.
- Dans certaines régions, les échantillons de voix peuvent être considérés comme des informations sensibles en matière d’identification biologique, de personnalité ou de droit à la vie privée ; il est donc nécessaire d’obtenir une autorisation vérifiable pour cloner la voix d’autrui.
Remboursement et renouvellement
- Pour les abonnements mensuels aux pages personnelles, un remboursement intégral peut être demandé dans les 3 jours suivant l’achat ou la renouvellement, et pour les abonnements annuels, dans les 7 jours ; au-delà de cette période, aucun remboursement n’est accordé en fonction du temps non utilisé.
- Les remboursements pour les achats sur Apple et Google Play sont gérés par leurs propres boutiques, et les conditions ainsi que les procédures peuvent varier.
- En principe, les abonnements commerciaux ne donnent pas lieu à remboursement, ni à un remboursement proportionnel pour la période restante ; dans des cas exceptionnels, c’est NaturalSoft qui décide.
- L’abonnement est renouvelé automatiquement ; en cas d’annulation, il reste valable jusqu’à la fin de la période de facturation en cours. L’utilisateur doit effectuer l’annulation avant le prochain prélèvement.
Résumé
La version personnelle de NaturalReader convient pour convertir des matériaux d’apprentissage, des scans et des pages web en audio pouvant être écouté, tandis que la version professionnelle est destinée aux créateurs de contenu et aux équipes ayant besoin d’une licence claire pour une redistribution.
Avant de choisir, il est essentiel de déterminer d’abord si l’audio sera entendu par d’autres personnes, puis de comparer le niveau du son, la consommation de caractères ou de points, le prix sur la plateforme et le degré de sensibilité des données.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164