33 sous-titres
Sous-titres vidéo générés par l’IA, traduction de sous-titres par l’IA
Étiquettes :Outils audio IA33 Qu’est-ce que les sous-titres ?
33 Sous-titres est un outil d’IA pour les créateurs de contenu, offrant des sous-titres, une transcription vocale et une traduction de sous-titres.
Il est géré par Guangzhou Budai Information Technology Co., Ltd. et propose à la fois des services en ligne et une application desktop.
33 Que peuvent faire les sous-titres ?
Transcription de vidéo en sous-titres
Lorsque l’utilisateur télécharge des fichiers audio et vidéo, le système peut reconnaître la voix, séparer automatiquement les phrases et générer des sous-titres avec une timeline.
L’éditeur en ligne permet de corriger le texte et d’ajuster le temps ; une fois terminé, il est possible d’exporter ou de compresser en vidéo.
Conversion audio en script mot à mot
Les enregistrements de réunions, d’interviews, de cours et de podcasts peuvent être convertis en documents éditables.
Les fonctionnalités en ligne permettent également de distinguer les différents interlocuteurs, mais les noms et les limites entre eux doivent encore être vérifiés manuellement.
Traduction de sous-titres IA
La plateforme peut traduire les sous-titres en fonction du contexte et générer du contenu bilingue adapté à une diffusion interlingue.
L’intégration de modèles de langage grands auprès du client, ainsi que des méthodes de traduction de Microsoft, Baidu, etc., est disponible selon le projet.
Podcasts et liens vidéo vers des textes
La version web permet d’extraire des podcasts ou des scripts vidéo par lien, et les scénarios officiels incluent Xiaowuyou, Bilibili et REDnote.
La capacité d’analyse des liens est influencée par les règles de la plateforme, les droits d’accès au contenu et les modifications des pages.
Édition et style des sous-titres
Le client offre une chronologie, des formes d’onde audio, des recherches de remplacement, un annulation et un historique.
L’utilisateur peut également définir la police, la taille du texte, la couleur et la position, ainsi que prévisualiser l’affichage des sous-titres.
Résumé IA et extraction de texte
Les vidéos à durée prolongée peuvent générer des résumés du contenu, ce qui facilite la localisation rapide des thèmes et des paragraphes clés.
Pour les voix off et les podcasts, il est possible de sélectionner des extraits par texte, puis de laisser le logiciel effectuer le découpage et le montage.
Quelle est la différence entre la version en ligne et le client ?
- La version en ligne ne nécessite aucune installation et convient à la transcription temporaire, à l’analyse de liens et à la création rapide de sous-titres.
- La reconnaissance en nuage, la traduction et la compression vidéo consomment généralement les ressources de calcul de la plateforme.
- Le client permet d’installer des modèles de reconnaissance sur l’appareil, et la plupart des fonctionnalités locales sont disponibles gratuitement.
- Le mode local ne télécharge pas de médias, ce qui le rend plus adapté aux contenus ordinaires nécessitant une forte protection de la vie privée.
- Le client offre des fonctions plus complètes pour les formes d’onde, l’axe temporel, les styles et les extraits de texte.
- Les versions Windows et macOS sont disponibles pour téléchargement ; un client Linux n’a pas encore été confirmé.
Comment fonctionne la reconnaissance locale
Le client est optimisé sur la base du modèle open source de transcription vocale Whisper, et intègre les moteurs Whisper.cpp et FasterWhisper.
La documentation officielle indique que le mode local prend en charge plus de 50 langues, et que l’installation du modèle ne consomme pas de ressources de traitement par la plateforme.
- Les appareils équipés de puces Apple peuvent être testés en priorité avec Whisper.cpp.
- Les ordinateurs équipés d’une carte graphique NVIDIA peuvent tester l’accélération par GPU.
- FasterWhisper met généralement davantage l’accent sur les effets de chronologie.
- Les modèles plus grands sont généralement plus précis, mais ils consomment également plus d’espace et de ressources de calcul.
- En l’absence d’une GPU adaptée, la reconnaissance locale peut être lente.
- Les sorties du modèle peuvent encore présenter des phrases fantômes, des mots manquants et des écarts dans la chronologie.
Le fait que le modèle Whisper soit open source ne signifie pas que le produit de sous-titres 33 soit également open source ; les licences et les conditions d’implémentation des deux ne doivent pas être confondues.
Quelles langues et formats sont pris en charge
Le site officiel indique actuellement que la reconnaissance en ligne et la traduction automatique couvrent plus de 90 langues, tandis que la reconnaissance locale sur l’application couvre plus de 50 langues.
Les scénarios courants incluent le chinois, l’anglais, le cantonais, le japonais, le coréen, le français, l’allemand et l’espagnol.
- Les tutoriels officiels confirment que les sous-titres SRT peuvent être exportés.
- Le client prend également en charge l’exportation de fichiers ASS et TXT.
- Les sous-titres peuvent être utilisés en tant que fichier ou intégrés directement dans la vidéo.
- Les tâches en lot et l’exportation en lot conviennent pour traiter des éléments similaires.
- Les effets varient en fonction des langues, des accents et des environnements bruyants.
À quels utilisateurs conviennent les sous-titres 33 ?
- Créateurs qui produisent des sous-titres pour des vidéos courtes, des cours et des interviews.
- Équipe chargée d’organiser les réunions, les podcasts et les transcriptions mot pour mot des enregistrements.
- Équipe de création de contenus destinés à l’international, avec sous-titres en chinois, en anglais ou multilingues.
- Utilisateurs individuels qui souhaitent transcrire en gratuit une grande quantité de matériel sur leur propre appareil.
- Monteurs de sous-titres nécessitant une synchronisation de la forme d’onde et de l’axe temporel.
- Celui qui souhaite couper les voix off et les podcasts selon le script.
- Il est nécessaire de protéger les utilisateurs qui traitent localement des contenus audiovisuels non publics.
33 Tutoriel d'utilisation des sous-titres
- Choisissez la version en ligne ou le client en fonction de la confidentialité des données, des performances de l’ordinateur et du volume de travail.
- Lors de l’utilisation du client, installez d’abord un modèle d’identification local compatible avec le dispositif.
- Importez des fichiers audio et vidéo, ou collez un lien vers une plateforme compatible depuis le site web.
- Sélectionnez la langue originale, le moteur de reconnaissance et le type de sous-titres souhaité.
- Soumettre la tâche de reconnaissance et attendre la génération du texte ainsi que de la timeline.
- Vérifier par paragraphes les noms de personnes, les chiffres, les termes techniques, la ponctuation et le locuteur.
- Lorsque des sous-titres bilingues sont nécessaires, choisissez la traduction de la plateforme ou configurez une clé personnelle.
- Vérifier le ton de la traduction, la longueur des sous-titres et la cohérence avec le contexte.
- Utiliser les formes d’onde et l’axe temporel pour corriger les avances, retards et chevauchements.
- Ajuster la police, la couleur, la position et le nombre de caractères par ligne.
- Exporter en SRT, ASS ou TXT, ou compresser les sous-titres sur le client.
- Lancez la version finale pour vérifier le cadrage, la synchronisation et la lisibilité de l’image.
Plafond gratuit et mode de facturation
Jusqu’au 30 août 2026, le site officiel indique qu’une puissance de calcul gratuite de 5000 unités est offerte chaque mois.
La plupart des fonctionnalités locales peuvent être utilisées gratuitement et sans limite, tandis que les tâches cloud consomment des ressources en fonction de leur type.
- La reconnaissance en nuage, la traduction en nuage et la compression vidéo en ligne nécessitent des ressources de calcul.
- La recharge à la demande convient mieux aux utilisateurs qui effectuent occasionnellement de petites tâches.
- La puissance de calcul achetée est valable un an, et la société officielle indique qu’aucun remboursement n’est actuellement possible.
- Ce forfait est destiné aux utilisateurs ayant un volume de tâches important et nécessitant des avantages avancés.
- L’activité d’invitation d’amis offre actuellement à chacune des parties 7 jours de membership et 5000 unités de puissance de calcul.
La page des membres du site officiel affiche deux options de paiement : mensuel et annuel. Le paiement annuel indique une réduction de 25 %, mais le montant réel n’est pas affiché sur la page anonyme.
Les niveaux de rechargement, les prix de membre, les avantages et les promotions peuvent varier ; il convient de se référer à la page de paiement après connexion.
Pourquoi n’y a-t-il pas de tableau des prix ici
La page officielle actuellement accessible ne présente pas le montant des forfaits ni l’ensemble des avantages, ce qui rend impossible une comparaison fiable entre plusieurs forfaits.
Les prix indiqués dans les anciens tutoriels ou sur des pages de tiers peuvent être obsolètes, et ne sont donc pas publiés en tant que tarifs en vigueur.
Comment utiliser une clé API personnalisée
Le client permet de saisir ses propres clés pour les services de traduction ou les grands modèles de langage.
Les sources officielles énumèrent actuellement clairement OpenAI et Zhipu, ainsi que des instructions de configuration pour la traduction concernant Baidu, Tencent, Microsoft et DeepL.
- La traduction de la clé personnelle ne consomme pas la puissance de calcul de traduction en nuage correspondant aux 33 sous-titres.
- Les fournisseurs de modèles ou de services de traduction peuvent facturer des frais supplémentaires.
- La clé doit être stockée sur un appareil personnel et ne doit pas être inscrite dans les sous-titres ou publiée dans des projets.
- Les clés doivent être immédiatement annulées et remplacées en cas de départ, de partage d’équipement ou de fuite.
- Les règles de traitement des données des services tiers doivent être consultées séparément.
Il s’agit d’une connexion du client à une interface tierce, ce qui ne signifie pas que 33 sous-titres propose une API publique pour les développeurs.
Confidentialité et traitement des données
Les autorités affirment que l’identification locale ne télécharge pas de vidéos ni d’audio, ce qui permet de réduire le risque que les médias quittent l’appareil.
La reconnaissance dans le cloud extrait l’audio et le télécharge sur le serveur ; une fois la tâche terminée, les ressources du serveur sont supprimées.
- Les matériaux sensibles doivent privilégier l’identification locale.
- Supprimez d’abord les identifiants et les éléments de confidentialité non pertinents avant de soumettre en nuage.
- Ne téléchargez pas d’enregistrements de réunions ou d’interviews sans autorisation de traitement.
- Vérifiez les noms, coordonnées et informations internes avant de partager les sous-titres.
- Une fois la tâche terminée, vous pouvez supprimer manuellement les projets et fichiers en ligne.
La date de mise à jour de la politique de confidentialité sur le site officiel est indiquée comme étant le 15 janvier 2023, et il y est précisé que des informations sur les appareils, les historiques de navigation et les clics peuvent être collectées.
Cette politique concerne également la publicité et le traitement des données des partenaires ; les équipes soucieuses du respect de la réglementation doivent relire l’intégralité des conditions avant d’en faire usage.
Précision et correction manuelle
Le site officiel utilise l’expression publicitaire « précision allant jusqu’à 99 % », mais cela ne signifie pas que tous les contenus atteignent ce niveau.
Les tutoriels officiels reconnaissent également que des erreurs de chronologie, des phrases fantômes et d’autres problèmes peuvent survenir.
- Le bruit de fond, les interférences de plusieurs personnes et les fortes accents réduisent la précision.
- Les noms de marques, les noms de personnes, les chiffres et les termes techniques sont susceptibles d’être mal interprétés.
- La traduction par des grands modèles peut fusionner les lignes de sous-titres ou altérer le sens original.
- La discrimination automatique des locuteurs peut entraîner des erreurs dans l’identification des discours consécutifs.
- Avant de compresser la vidéo, il faut la jouer entièrement une fois.
- Le contenu public, pédagogique et commercial doit faire l’objet d’une révision finale manuelle.
Avantages du produit
- Les versions web et les clients desktop couvrent des tailles de tâches différentes.
- La reconnaissance locale par Whisper peut réduire considérablement les coûts de transcription.
- Prend en charge l’ensemble du processus de transcription, de traduction, d’édition, de mise en forme et de compression.
- Les outils d’onde et d’axe temporel facilitent une correction précise.
- Autoriser l’accès aux traducteurs personnels et aux clés de grands modèles.
- Prend en charge les tâches par lots et le découpage d’audio et de vidéo par texte.
- Le traitement local peut réduire le téléchargement de médias sensibles.
Restrictions d'utilisation et précautions
- La page officielle anonyme ne divulgue pas le montant des forfaits en vigueur.
- Les fonctionnalités cloud consomment des quantités différentes de puissance de calcul.
- Les modèles locaux nécessitent de l’espace de stockage pour le téléchargement et des performances informatiques suffisantes.
- Les sous-titres et les traductions automatiques ne peuvent pas remplacer la révision humaine.
- L’extraction de liens peut échouer en raison des règles des plateformes tierces.
- Une clé API personnelle engendre des frais de tiers et des responsabilités en matière de confidentialité.
- La politique de confidentialité a été mise à jour récemment ; il convient de la vérifier à nouveau avant de l’utiliser.
- Aucune API de produit publique ou code source officiel complet n’a été trouvée.
Plateforme, API et statut open source
33 Sous-titres est actuellement disponible sur le site web, ainsi que pour les clients Windows 64 bits et macOS.
Aucune API de développeur publique ni dépôt de code source officiel complet n’a été trouvé pour ce produit ; il ne peut donc pas être qualifié de logiciel open source ou d’outil pouvant être déployé en mode privé.
Le fait que le client utilise le modèle open source Whisper indique uniquement l’origine des composants de reconnaissance, mais ne permet pas de déduire la licence du logiciel dans son ensemble.
Questions fréquentes
À quoi sert principalement la sous-titres ?
Il peut convertir des vidéos et de l’audio en sous-titres ou en script mot par mot, ainsi qu’effectuer la traduction, l’édition, l’ajustement du style et le compression vidéo.
33. Les sous-titres peuvent-ils être utilisés gratuitement ?
Oui, il y a 5000 unités de calcul gratuites par mois, et la plupart des fonctionnalités locales du client peuvent également être utilisées gratuitement sans limite.
Combien coûte l’abonnement aux sous-titres ?
Le site officiel affiche actuellement les options de paiement mensuel et annuel, mais la page anonyme ne divulgue pas le montant réel ; il convient de se référer à la page de paiement après connexion.
33 Les sous-titres téléchargeront-ils ma vidéo ?
La reconnaissance locale ne télécharge pas de médias ; la reconnaissance en nuage télécharge l’audio extrait et affirme que les ressources sont supprimées une fois la tâche terminée.
33 Quels formats de sous-titres sont pris en charge ?
La documentation officielle confirme que l’export en SRT, ASS et TXT est pris en charge, et il est également possible d’intégrer directement les sous-titres dans la vidéo.
Puis-je utiliser ma propre clé OpenAI ?
Oui, le client prend en charge des interfaces telles que OpenAI et Zhipu ; la traduction avec une clé personnelle ne consomme pas de ressources de calcul correspondant à 33 sous-titres.
33 Subtitles est-il un logiciel open source et propose-t-il une API ?
Non, aucune API de produit publique ou code source officiel complet n’a été trouvée pour le moment ; intégrer Whisper open source ne signifie pas que le produit est lui-même open source.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164