Les sous-titres disent
Outils de synthèse vocale en ligne, de sous-titrage et de génération vidéo pour créer des vidéos sans apparaître à l’écran
Étiquettes :Outils audio IALes sous-titres disent quoi
Les sous-titres indiquent qu’il s’agit d’un outil d’alignement audio-texte basé sur l’IA, destiné au post-traitement vidéo, qui permet de créer une timeline de sous-titres SRT à partir d’un audio existant et d’un texte finalisé.
Il résout le problème où « le contenu du texte est déjà défini, mais les points de temps précis pour les sous-titres manquent », et ce n’est pas un outil ordinaire de transcription vocale en texte.
Fonction principale
- Téléchargez l’audio et le texte final correspondant.
- Correspondance automatique entre le texte et la position temporelle de la voix.
- Générer une timeline de sous-titres SRT au niveau du milli-seconde.
- Réduire les erreurs de noms propres et de mots polysyllabiques.
- Prend en charge la création de sous-titres vidéo pour des scripts existants.
- Fournit des méthodes d’alignement telles que le traitement par intervalles.
- Les nouveaux utilisateurs peuvent obtenir des minutes d’essai gratuites.
- Offre de forfaits d’alignement professionnel sur de longues durées.
- Les tâches et les enregistrements des résultats sont stockés dans le compte.
- La fonction de synthèse vocale est en phase de bêta test limitée.
À qui s’adresse-t-il
| utilisateur | Scénarios adaptés | Prérequis |
|---|---|---|
| Créateur de vidéos courtes | Générer des sous-titres pour les commentaires audio et les narrations | Enregistrement basé essentiellement sur la lecture du texte |
| Enseignant du cours | Création de cours et sous-titres payants pour le partage de connaissances | Conserver le texte complet du cours |
| Formateurs en entreprise | Organiser les sous-titres des vidéos de formation | Obtenir l’autorisation d’utiliser des contenus audio et vidéo |
| Monteur de podcasts | Générer une timeline pour des fichiers audio | Il ne faut pas trop de contenu improvisé. |
| Équipe du contenu audio | Associer le texte à l’enregistrement vocal réel | Le son monophonique est clair. |
| Personnel de post-production vidéo | Après l’export en SRT, continuer la mise en page | Des contrôles aléatoires manuels sont encore nécessaires à certains moments. |
Différence entre l’alignement texte-son et la reconnaissance vocale
| Projet | Alignement texte-son | Reconnaissance vocale |
|---|---|---|
| Est-il nécessaire un texte ? | Il est nécessaire un texte final correspondant. | Habituellement, ce n’est pas nécessaire. |
| Tâche principale | Trouver la position dans le temps de chaque segment de texte | Deviner le contenu du texte à partir de la voix |
| Noms propres | Utiliser directement le texte fourni par l’utilisateur | Peut être identifié comme un homophone |
| Contenu improvisé | Un écart trop important peut entraîner un échec de l’alignement. | On peut essayer de transcrire directement. |
| Points clés de la sortie | Timeline des sous-titres | Transcription du texte |
| Matériaux adaptés | Vidéo audio de lecture conforme au texte | Réunions, entretiens et discours libres |
Comment fonctionne l’alignement audio-texte
Le système utilise le texte fourni par l’utilisateur comme référence, cherche dans l’audio les positions de début et de fin des phrases correspondantes, puis génère des blocs de sous-titres.
Ainsi, la précision du texte provient du texte finalisé, tandis que la précision temporelle dépend de la qualité enregistrement, de la cohérence de la lecture et de la ponctuation.
- Préparer le texte final pour la voix off.
- Exporter un audio brut clair.
- Vérifier que l’ordre de l’enregistrement correspond à celui du texte.
- Téléchargez l’audio et collez le texte.
- Sélectionnez les paramètres d’alignement appropriés.
- Soumettez la tâche et attendez son traitement.
- Aperçu du temps des sous-titres et de la ponctuation.
- Corriger les lectures manquantes, les lectures supplémentaires et les positions de pause.
- Exporter un fichier SRT pour le montage.
Comment préparer un audio
| Projet | Recommandation | Il convient d’éviter |
|---|---|---|
| Voix | Maintenir la voix claire et le volume stable | Bruit de souffle, trop bas et réverbération sévère |
| Contexte | Utilisez autant que possible un son sec sans musique d’accompagnement. | La musique couvre les paroles. |
| Nombre de personnes | Il est plus facile d’aligner la lecture continue en solo. | Parler en même temps et parler en superposition |
| Montage | Le texte et l’audio du film doivent rester dans le même ordre | Couper les phrases sans modifier le texte |
| Pause | Conserver les pauses des paragraphes naturels | Longues périodes vides et segments répétitifs |
| document | Utiliser un audio clair et jouable normalement | Fichiers endommagés et recodage à plusieurs reprises à un faible débit |
Comment préparer un texte publicitaire
Plus le texte est proche du contenu lu à voix haute, plus l’alignement est stable ; la ponctuation et la segmentation influencent également le rythme de lecture des blocs de sous-titres.
- Utilisez la version réellement utilisée lors de l’enregistrement.
- Supprimer les titres et annotations non lus.
- Compléter les phrases qui apparaissent réellement dans l’enregistrement.
- Unifier l’écriture des chiffres, des unités et des noms propres.
- Faire des pauses naturelles en fonction du sens et du rythme.
- Ne ajoutez pas de codes temporels ou de notes sans rapport.
- Les textes longs sont d’abord traités par chapitres.
Qu’est-ce que les sous-titres SRT ?
SRT est un format de sous-titres courant, chaque bloc de sous-titres contenant un numéro de séquence, une heure de début, une heure de fin et le texte à afficher.
Une fois généré, il peut être importé dans la plupart des éditeurs de vidéo et lecteurs, mais les polices, les couleurs et les positions doivent généralement être configurées dans le logiciel de montage.
| Éléments de vérification | Pourquoi c’est important | Méthode de traitement |
|---|---|---|
| Heure de début | Les sous-titres ne doivent pas précéder de manière évidente la voix. | Écoutez par paragraphes et ajustez légèrement |
| Heure de fin | Éviter que les sous-titres disparaissent prématurément ou se superposent | Préserver un temps de lecture modéré |
| Longueur d’une ligne | Une longueur excessive peut nuire à la lecture sur mobile. | Découper en phrases courtes selon le sens |
| Nombre de sous-titres | Une trop grande fragmentation provoquera des saccades à l’écran. | Fusionner des phrases continues |
| codage | Un encodage incorrect peut afficher du texte déformé. | Utiliser l’encodage UTF pris en charge par l’éditeur |
Gestion des intervalles et des pauses
Les pauses dans le discours, les inspirations et les espaces entre sections affectent la segmentation des blocs de sous-titres ; il ne suffit pas de se baser uniquement sur la similitude du texte.
- Une courte pause peut être conservée dans le même bloc de sous-titres.
- Le point de fin sémantique est approprié pour créer un nouveau bloc de sous-titres.
- La sous-titre précédente doit être terminée à temps avant une longue pause.
- Les extraits de musique de fond ne doivent pas être forcément en accord avec le texte.
- Les titres de début et de fin peuvent être traités séparément dans un logiciel de montage.
- Après l’export, vérifiez à nouveau la synchronisation à la fréquence d’image finale.
Les sous-titres disent : tutoriel complet d’utilisation
- Cliquez sur « Page officielle » dans les sous-titres.
- Inscrivez-vous et obtenez une crédit d’essai.
- Sélectionnez la fonction d’alignement texte-son.
- Préparer un audio clair sans musique de fond.
- Mettre en forme le texte final conforme à l’enregistrement.
- Supprimer les titres et annotations non lus.
- Téléchargez l’audio et collez le texte intégral.
- Vérifier la durée, les limites de fichiers et de caractères.
- Sélectionnez les paramètres d’alignement ou d’espacement.
- Soumettez la tâche et attendez sa génération.
- Vérifier la synchronisation des sous-titres et de la voix.
- Vérifiez en particulier les pauses et les points de réécriture majeure.
- Téléchargez les sous-titres SRT générés.
- Importer un logiciel de montage vidéo.
- Définir la police, la position et le style des sous-titres.
- Vérifier en visionnant la vidéo finale dans son intégralité.
Forfait gratuit et forfait professionnel
La page d’accueil actuelle offre 100 minutes gratuits pour s’inscrire, et présente un forfait professionnel à 125 yuans pour 30 000 minutes.
| Projet | Prix ou limite | Explication |
|---|---|---|
| Nouvelle expérience utilisateur | 100 minutes | À récupérer après inscription, les règles de l’événement peuvent être modifiées |
| Forfait d’alignement professionnel | 125 yuans | Contient 30 000 minutes |
| Prix de conversion | Environ 0,004 yuan/minute | Estimation selon le prix total du forfait et le nombre de minutes |
| Synthèse vocale | Les nouveaux prix ne sont pas encore annoncés. | Actuellement en bêta limité ou sur le point d’être lancé |
La durée de validité spécifique, les remboursements, les factures et les restrictions d’utilisation sont déterminés selon la page d’achat et les règles de paiement après connexion.
Comment consulter les anciennes règles pour les membres
La page officielle ancienne des membres montre toujours que 100 yuans de rechargement permettent d’obtenir 10 000 points et de devenir membre à vie, ainsi que les avantages historiques tels que la synthèse vocale.
Comme la page d’accueil actuelle indique que la synthèse vocale est en version bêta limitée, les avantages de l’ancienne version ne peuvent pas être considérés comme des engagements permanents pour la nouvelle version.
| Informations | Contenu de la page ancienne | Recommandations d'utilisation actuelles |
|---|---|---|
| Seuil d’adhésion | Recharge unique de 100 yuans ou plus | Vérifiez avant achat si cela est encore valable. |
| Points | Rechargez 100 yuans pour obtenir 10 000 points | Vérifier quelles fonctionnalités actuelles sont disponibles |
| Durée de l'adhésion | La page indique conservation à vie | Vérifier le solde réel du compte |
| Synthèse vocale | A offert de nombreux avantages pour les membres | La page d’accueil actuelle est indiquée comme bêta. |
| Alignement texte-son | Il y avait un quota quotidien et des offres de cadeaux | Selon la page du nouveau forfait |
État actuel de la fonction de synthèse vocale
La page d’accueil du site officiel indique que le TTS est « bientôt disponible » ou en « version bêta limitée », ce qui signifie que les utilisateurs ordinaires ne peuvent pas supposer qu’il est pleinement accessible.
- Ne respectez pas le nombre d’orateurs actuels promis dans les articles anciens.
- Ne rechargez pas d’abord en supposant que vous pourrez utiliser TTS.
- Les qualifications pour la bêta test, la voix et les quotas peuvent varier.
- Pour une utilisation commerciale de la voix off, il est nécessaire de vérifier les conditions d’autorisation en vigueur.
- Les droits du compte existant doivent être vérifiés séparément après connexion.
Comment interpréter « 100 % de précision » ?
L’affirmation selon laquelle le site officiel est 100 % exact relève d’une expression marketing, visant principalement à souligner que le texte des sous-titres utilise le texte final fourni par l’utilisateur.
Il ne garantit pas une précision absolue en ce qui concerne la chronologie, la ponctuation, le traitement des omissions de lecture et toutes les conditions audio ; une vérification manuelle est encore nécessaire avant la publication.
| Situation | Résultats possibles | Points clés de l’inspection |
|---|---|---|
| Lire à haute voix d’après le texte | Généralement, il est plus facile de faire correspondre. | Pause et longueur des blocs de sous-titres |
| Quelques petites erreurs de parole | Alignement tolérant aux erreurs possible | Points temporels avant et après l’erreur |
| Une grande quantité d’improvisation | Mauvaise correspondance ou saut de segment possible | Modifier le texte en utilisant une transcription puis le restructurer |
| Dialogue en groupe | Les rôles et l’ordre peuvent être confus. | Traitement par voie séparée ou par tronçons |
| La musique de fond est trop forte. | La localisation dans le temps peut être affectée. | Soumettre à nouveau en utilisant la voix normale |
Droits d’auteur et vie privée
L’audio, le texte et la vidéo peuvent contenir des informations non publiées ; il convient de vérifier les politiques de la plateforme ainsi que les exigences de confidentialité du projet avant de les télécharger.
- Ne traitez que les enregistrements que vous possédez ou pour lesquels vous avez une autorisation.
- Il faut obtenir l’autorisation pour les voix des personnages et le contenu des interviews.
- Le script ne doit pas contenir d’informations de compte ou d’identité.
- Les cours de commerce doivent vérifier les droits d’auteur des matériaux.
- Pour les projets confidentiels, consultez d’abord les règles de l’unité concernée.
- Gérez les tâches cloud en temps opportun après le téléchargement des résultats.
- Supprimer le contenu des sous-titres sensibles avant la publication externe.
API et open source
Aucun sous-titre indiquant une API publique, un SDK officiel, un dépôt de code source du produit ou un projet GitHub officiel vérifiable n’a été trouvé pour le moment.
| Projet | Situation actuelle | Explication |
|---|---|---|
| Outils de page web | Fourni | Utiliser l’alignement audio-texte après inscription |
| API publique | Pas encore rendu public | Aucun document d’interface pour le développeur trouvé |
| SDK officiel | Pas encore rendu public | Aucun package de développement vérifiable trouvé |
| Code source du produit | Pas open source | Services commerciaux en ligne |
| GitHub officiel | Pas encore confirmé | Un projet du même nom ne peut pas être considéré comme officiel. |
Avantages du produit
- Concentrez-vous sur l’axe temporel des sous-titres pour les audios avec script.
- Réduire les fautes d’orthographe causées par la reconnaissance ordinaire.
- Il est possible d’exporter au format SRT universel.
- L’inscription offre des minutes d’essai gratuites.
- Le prix par forfait pour une longue durée est plus bas.
- Adapté aux cours et aux enregistrements de texte fixes.
Restrictions d'utilisation
- Il faut préparer le texte correspondant à l’enregistrement.
- Une transcription directe n’est pas adaptée aux longs discours improvisés.
- La musique de fond et les conversations en groupe augmentent la difficulté.
- Une précision en marketing ne signifie pas qu’une vérification manuelle n’est pas nécessaire.
- Les règles des abonnés anciennes peuvent différer du produit actuel.
- La synthèse vocale n’est pas encore une fonction entièrement disponible.
- L’API, le SDK et le code open source ne sont pas encore publics.
Questions fréquentes
Que disent les sous-titres sur ce qu’on peut faire principalement ?
Il aligne temporellement l’audio existant avec le texte finalisé, et génère automatiquement un fichier de sous-titres SRT pouvant être importé dans un logiciel de montage.
Les sous-titres disent-ils qu’il s’agit d’un outil de transcription vocale ?
Non, il sert principalement à aligner le son et le texte, et l’utilisateur doit d’abord fournir le texte correspondant ; la parole libre sans texte convient mieux aux outils de reconnaissance vocale.
Les sous-titres disent-ils qu’ils peuvent être utilisés gratuitement ?
Oui, les nouveaux utilisateurs qui s’inscrivent actuellement peuvent obtenir 100 minutes d’essai ; les détails de l’offre et la manière de la recevoir sont indiqués sur la page de leur compte.
Les sous-titres demandent combien coûte le forfait professionnel ?
Le site officiel indique actuellement que 125 yuans couvrent 30 000 minutes, ce qui correspond à environ 0,004 yuans par minute ; la durée de validité exacte est indiquée sur la page de paiement.
Les sous-titres générés sont-ils forcément exacts ?
Les textes basés sur le contenu fourni par l’utilisateur peuvent réduire les erreurs de frappe, mais les chronologies, la ponctuation et les écarts dans le texte peuvent encore causer des problèmes ; une vérification complète est indispensable avant publication.
Les sous-titres disent-ils que la synthèse vocale est maintenant disponible ?
La page d’accueil actuelle indique qu’elle sera bientôt disponible ou en version bêta limitée ; les droits de synthèse vocale de l’ancienne page de membre ne peuvent pas être considérés comme étant directement disponibles pour tous.
Les sous-titres disent-ils qu’une API ou du code open source est fourni ?
Aucune API publique vérifiable, SDK officiel, répertoire de code source du produit ou projet GitHub officiel n’a été trouvé pour le moment.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164