Doctly AI
Doctly AI : rend le traitement des documents par l’IA plus efficace et plus simple
Étiquettes :Outils de documents IAQu’est-ce que Doctly AI ?
Doctly AI est une plateforme destinée aux entreprises pour l’analyse de documents, l’extraction de données structurées et les questions-réponses sur des documents. Elle reçoit des PDF, des fichiers Office et des images via une console web et des API, puis génère du Markdown, du JSON, du CSV ou du XML.
L’objectif du produit est de transformer des formats complexes, des tableaux, des formulaires, des graphiques, ainsi que des documents manuscrits et numérisés en données utilisables par les machines. Il convient aux processus à forte production de documents dans les domaines de la finance, de l’assurance, de la santé, du droit, du gouvernement, de la logistique et de la construction.
Aperçu des fonctions principales
| Fonctionnalité | Entrée | Sortie | Adéquat pour la tâche |
|---|---|---|---|
| Conversion de documents | PDF, DOCX et images | Markdown nettoyé | RAG, recherche et migration de contenu |
| Extraction structurée | Factures, contrats, formulaires et rapports | JSON, CSV ou XML | Saisie de données et synchronisation du système |
| Extracteur personnalisé | Définition des champs et documents métier | Données de la structure spécifiée | Extraction en masse des champs du secteur |
| Ensembles et questions-réponses | Plusieurs documents d’index et questions | Réponses et citations au niveau de la page | Recherche dans la base de données et études |
| Chat de documents | Ensembles, sessions et messages | Réponse unique ou en flux | Recherche interactive dans l’application |
| Traitement asynchrone | Fichiers, paramètres et appels de retour | État, résultats du téléchargement et Webhook | Flux de travail en batch de niveau production |
Fichiers et contenus pris en charge
Les formats de fichiers listés sur la page web incluent PDF, DOCX, PNG, JPG, TIFF et XLSX. La plateforme met également en avant sa capacité à traiter des images scannées, des photos, des mises en page complexes, des tableaux, des formulaires, de l’écriture manuscrite, des graphiques et des illustrations.
- PDF : contrats, états financiers, polices d’assurance, dossiers médicaux, rapports et documents de construction.
- DOCX : documents de bureau, instructions et rapports modélisés.
- Images : scans, photos de téléphone, reçus et formulaires manuscrits.
- XLSX : données commerciales sous forme de tableau, les limites réelles de la parsing doivent être testées à l’aide d’échantillons.
- Pages complexes : plusieurs colonnes, tableaux imbriqués, en-têtes et pieds de page, ainsi que mélange texte-image.
L’indication d’erreur de l’API indique que la limite pour un seul fichier téléchargé est de 100 MB. Les fichiers trop volumineux, les documents protégés par mot de passe, les scans en basse résolution, les pages rotatives et les formules complexes doivent être testés avant une intégration officielle.
Transformer un document en Markdown
L’interface de conversion transforme les fichiers PDF, DOCX et images en Markdown propre, facilitant leur intégration dans des systèmes de recherche, des bases de connaissances, RAG ou des systèmes de gestion de contenu. Le traitement est asynchrone ; après le téléchargement, le fichier passe par des états tels que la file d’attente, le traitement en cours et la fin du traitement.
- Créez un compte et générez une clé API personnalisée.
- Soumettez le fichier et sélectionnez le niveau de précision ou les paramètres de résolution appropriés.
- Enregistrer l’identifiant du document, surveiller l’état ou configurer la callback de fin.
- Téléchargez Markdown ou les résultats structurés.
- Vérifier la numérotation des pages, les titres, les tableaux, les annotations et le contenu manquant.
- Écrire les résultats confirmés dans le système métier, et supprimer les fichiers originaux qui ne sont plus nécessaires.
Une conversion réussie ne signifie pas que la sémantique du format est entièrement conservée. Les cellules fusionnées, les légendes, les tableaux sur plusieurs pages et les caractères manuscrits nécessitent en particulier un contrôle manuel.
Extraction de données structurées
Extractor est utilisé pour extraire des champs spécifiques à partir d’un document et pour maintenir les relations entre ces champs. Les équipes peuvent définir la structure souhaitée pour les factures, les demandes de remboursement, les contrats, les dossiers médicaux, les documents logistiques ou les documents de construction.
- Préciser le nom du champ, son type, s’il est obligatoire et les valeurs vides autorisées.
- Définir des règles de formatage pour les dates, les montants, les devises et les numéros.
- Conserver les numéros de page, les extraits du texte original ou les informations de confiance pour révision.
- Concevoir des structures de tableau pour plusieurs tableaux, plusieurs entités et des éléments répétés.
- Envoyer les pages de vérification échouée et de rejet du modèle dans une file manuelle.
Les clauses précisent que les résultats peuvent être erronés, incomplets ou donner lieu à des hallucinations. La tenue de la comptabilité financière, le traitement médical et les soumissions juridiques doivent faire l’objet d’une vérification manuelle et d’un contrôle par des règles métier.
Questions-réponses collectives et chat de documents
Les développeurs peuvent créer des Collections, télécharger des fichiers pour les indexer, puis poser des questions via une requête unique ou une conversation en session. Les réponses peuvent inclure des références par page, afin d’aider l’utilisateur à retourner à la position correspondante du document pour vérification.
- Séparer les ensembles par client, affaire, projet ou limite de droits.
- Définir la version et la date de mise à jour du fichier d’index.
- Le problème précise la date, les acteurs, le document et les champs requis.
- Afficher la page de citation et permettre à l’utilisateur d’ouvrir le texte original pour vérification.
- Supprimer les données obsolètes pour éviter que des versions anciennes ne participent aux réponses.
Les questions-réponses collectives sont utiles pour la recherche et l’aide à la lecture, mais ne doivent pas remplacer une évaluation formelle. Les références au niveau de la page ne prouvent que le système a associé une certaine page, sans garantir que la réponse reflète une compréhension correcte de celle-ci.
Intégration API
Doctly API s’authentifie à l’aide d’un token Bearer, et les réponses sont au format JSON. Les principales interfaces couvrent les documents, l’Extractor, les Collections, les fichiers, les questions-réponses ponctuelles, ainsi que les sessions de chat et l’historique des messages.
| Groupe d’interfaces | Opérations principales | Utilisations typiques |
|---|---|---|
| Documents | Télécharger, liste, détails, télécharger, supprimer | Chaîne de conversion de documents |
| Extractors | Lister, exécuter, mettre à jour et supprimer | Gestion des modèles d’extraction de champs |
| Collections | Création, mise à jour, suppression et gestion de fichiers | Base de données de documents |
| Query | Une seule question sur l’ensemble | Question-réponse sans état |
| Chat | Séances, messages, réponses en flux et suppression | Interface de dialogue continu |
| Webhook | Notification de fin du traitement | Orchestration asynchrone des services |
En cas d’échec de l’envoi du Webhook, jusqu’à 3 tentatives sont possibles, avec un intervalle de 5 secondes entre chaque tentative. Le destinataire doit néanmoins vérifier la signature ou les conditions de confiance, assurer l’idempotence, et vérifier activement l’état en cas de perte de notification.
Erreurs et limitations de vitesse
- Si le fichier dépasse 100 MB, une erreur de charge trop élevée sera retournée.
- Une clé manquante ou invalide entraîne une erreur d’authentification.
- En cas d’échec de la validation, des détails d’erreur au niveau des champs sont affichés.
- Dépasser la limite de vitesse du forfait entraînera une erreur de trop de requêtes.
- Le client doit utiliser un arriéré exponentiel et ne pas réessayer immédiatement de manière infinie.
- Conserver l’ID de la demande afin de faciliter le suivi par l’équipe d’assistance.
Python SDK
Doctly propose un client Python pouvant être installé via pip, qui gère principalement le téléchargement de PDF, la consultation asynchrone et la lecture des résultats en Markdown. L’SDK prend en charge les options de précision LITE et ULTRA, et offre un type d’exception DoctlyError.
Ce SDK est licencié sous la licence MIT et accepte les contributions, mais son éventail de fonctionnalités peut être inférieur à celui d’une API complète. Les nouvelles interfaces Extractor, Collection et Chat doivent se référer aux documents de développement actuels.
Mesure des pages et calcul de la consommation
| Type d’entrée | Méthode de mesure | Précautions à prendre |
|---|---|---|
| Chaque page réelle compte pour 1 page | Les espaces vides ou la couverture peuvent également être pris en compte dans le traitement. | |
| Image | Chaque fichier d’image compte pour 1 page | Chaque image est facturée séparément |
| DOCX | 1 page pour 3000 caractères | Les langues différentes et le texte caché affectent le nombre de caractères. |
| Professionnel excédentaire | 0,02 dollar par page | Facturation continue après 25 000 pages |
Lorsque la consommation atteint 80 % du quota, la plateforme envoie une notification, et il est possible de configurer une augmentation automatique. Dans un environnement de production, des budgets internes, des plafonds par tâche et des alertes pour un nombre excessif de pages doivent être définis séparément.
Prix et forfaits
| Forfait ou version | Prix | Période de facturation | Droits ou crédit principal | Adéquat pour les utilisateurs |
|---|---|---|---|---|
| Flexible | 0,02 dollar américain/page | Abonnement payant à l’usage, sans engagement mensuel | Tous les formats, Markdown/JSON/CSV, API, 1 poste, SLA à 99 % | Essais et doses fluctuantes |
| Professional | 499 dollars/mois | Abonnement mensuel, abonnement annuel avec remise | 25 000 pages par mois, 0,02 dollar/page en excès, 5 postes, extracteur personnalisé, Webhook, option ZDR | Équipe de traitement en lot continu |
| Enterprise | Cotation sur mesure | Selon la quantité et les termes du contrat | Taille de page personnalisable, infrastructure dédiée, SSO, hébergement self-hosted, SLA de 99,9 %+ | Organisations de grande taille et régulées |
Tous les forfaits offrent une période d’essai sans carte de crédit, et Enterprise permet une validation conceptuelle à l’aide de documents réels. La page de paiement annuel indique une remise de 10 %, mais il est nécessaire de contacter le service des ventes pour confirmer le montant exact du contrat.
Le prix par page de Flexible semble bas, mais il ne comprend pas le quota de paiement anticipé mensuel. Les coûts réels doivent également prendre en compte les tentatives de réessai en cas d’échec, le traitement répété, les documents trop volumineux, la vérification manuelle et l’intégration de stockage.
Mise à niveau, dégradation et remboursement
Le forfait peut être mis à niveau ou dégradé à tout moment ; une mise à niveau donne immédiatement accès aux nouvelles fonctionnalités, tandis qu’une dégradation prend effet dès le cycle de facturation suivant. Les frais d’abonnement sont payés à l’avance et facturés automatiquement de manière périodique ; selon les conditions, aucun remboursement n’est généralement accordé, sauf en cas de exigences légales.
La plateforme peut notifier une augmentation de prix au moins 30 jours à l’avance. En cas d’annulation, l’accès à l’API cesse immédiatement, et les données restantes dans l’historique du compte sont supprimées de manière permanente selon un cycle de suppression ne dépassant pas 30 jours.
Conservation des données et absence de conservation
| forfait | Politique par défaut ou optionnelle | Explication |
|---|---|---|
| Flexible | Jusqu’à 30 jours | Utilisé pour l'historique et le débogage, peut être supprimé manuellement |
| Professional | ZDR optionnel | Le tableau des prix indique une fenêtre de suppression de 24 heures |
| Enterprise | ZDR optionnel ou entièrement personnalisé | Peut être combiné avec un cloud privé ou une installation locale |
L’affirmation « Aucun document n’est jamais stocké » en page d’accueil résume la capacité de zéro conservation, tandis que les pages consacrées à la confidentialité et aux forfaits précisent que la politique de conservation varie selon le plan. Pour les données sensibles, il convient de se référer aux dispositions écrites figurant dans la configuration du compte, le DPA, le BAA ou les contrats d’entreprise.
Sécurité, confidentialité et conformité
La plateforme affirme utiliser TLS 1.2 ou une version ultérieure pour sécuriser les transferts, AES-256 pour protéger les données statiques, et a été auditée selon les normes SOC 2 Type II. Tous les forfaits garantissent que les données d’entrée et de sortie ne seront pas utilisées pour entraîner ou affiner les modèles de base de Doctly avec des tiers.
- Les fournisseurs de traitement par IA comprennent OpenAI, Google, Anthropic et d’autres prestataires de protocoles sans entraînement.
- Le paiement est géré par Stripe, et la plateforme ne conserve que des informations limitées telles que les quatre derniers chiffres de la carte, la date d’expiration et l’adresse de facturation.
- Professional et Enterprise peuvent demander un DPA et un HIPAA BAA.
- Il est interdit de télécharger des informations de santé protégées avant la signature d’un BAA valide.
- Les données personnelles peuvent être traitées à l’étranger ; pour certaines régions, il est nécessaire de prendre contact au préalable pour obtenir confirmation.
- L’utilisateur peut demander l’accès, la correction, la suppression, la limitation, le transfert ou le retrait de son consentement.
- Tous les utilisateurs peuvent supprimer des documents via l’API ou la console.
HIPAA Ready, BAA disponible et BAA signé sont des états différents. Les organisations médicales doivent d’abord finaliser le package de conformité, le contrat, les autorisations, les audits et la configuration de conservation avant de télécharger des données protégées.
Propriété des données, droits d’auteur et restrictions
L’utilisateur conserve le droit d’entrer le document ; les clauses transfèrent au utilisateur le droit d’extraire et de structurer la sortie. Doctly conserve les droits de propriété intellectuelle sur la plateforme, l’API, le code et les technologies sous-jacentes.
- Il est interdit d’utiliser des services ou des sorties pour créer des ensembles de données destinés à l’entraînement de réseaux de neurones et de modèles d’apprentissage automatique.
- Il est interdit de créer des produits concurrents ou des plateformes d’ingénierie inverse.
- Il ne faut pas dépasser la vitesse et le quota du forfait.
- L’utilisateur est responsable de s’assurer que le document téléchargé dispose des droits nécessaires.
- La sortie doit être vérifiée manuellement et ne doit pas être considérée comme un conseil médical, juridique ou financier.
Plateforme, déploiement et statut open source
| Projet | État actuel | Explication |
|---|---|---|
| Console du site web | Fourni | Gestion des comptes, des fichiers et de la configuration |
| REST API | Fourni | Documents, extraction, collections et chat |
| Webhook | Fourni | Professionnel et solutions d’entreprise correspondantes |
| Python SDK | Open source | Licence MIT, axée sur la conversion PDF en Markdown |
| Plateforme Doctly SaaS | Source fermée | Le fait que le SDK soit open source ne signifie pas que le code source de la plateforme est accessible. |
| Cloud privé ou déploiement local | Enterprise optionnel | Le déploiement commercial n’est pas équivalent à l’open source. |
| Application mobile ou desktop native | Pas encore confirmé | Actuellement, c’est principalement via des API et des pages web. |
Scénarios d’application typiques
- Finance : Extraction des montants et des éléments à partir des factures, des relevés de compte et des états financiers.
- Assurance : Gestion des polices, des documents de sinistre et des annexes.
- Santé : dossiers médicaux structurés et formulaires dans le cadre d’un BAA valide et d’une configuration conforme.
- Loi : Extraction des clauses du contrat, des parties, des dates et des obligations.
- Logistique : lecture des connaissements, des listes d’emballage, des reçus et des documents de transport.
- Construction : organiser les plans, les descriptions, les rapports d’inspection et les tableaux de projet.
- Système de connaissances : convertir les documents en Markdown et créer une collection de questions-réponses avec des références par page.
Avantages et limites des capacités
Avantages principaux
- Il offre en même temps la conversion, l’extraction structurée et les questions-réponses sur des collections.
- Prend en charge les layouts complexes, les tableaux, les scans et le contenu manuscrit.
- Couverture API complète, prise en charge des états asynchrones et des Webhook.
- Tous les forfaits incluent une promesse écrite selon laquelle ils ne seront pas utilisés pour l’entraînement de modèles.
- Fournit des options SOC 2, BAA, ZDR, SSO et déploiement privé.
- Le Python SDK est soumis à une licence MIT permissive.
Principales restrictions
- Les sorties de l’IA peuvent encore être erronées, incomplètes ou générer des illusions.
- Les tarifs Professional sont élevés ; les utilisateurs à faible volume doivent comparer attentivement les coûts à la consommation.
- Les mentions de « zéro conservation » sur la page d’accueil et la page de confidentialité doivent être interprétées en fonction du forfait.
- Les données médicales doivent d’abord faire l’objet d’un BAA ; il ne suffit pas de se fier à l’indication de conformité HIPAA.
- Le SDK open source ne couvre que certaines utilisations, tandis que la plateforme complète est fermée.
- L’exactitude et le coût des documents complexes doivent être vérifiés à l’aide d’échantillons réels.
Questions fréquentes
Quels fichiers Doctly AI peut-il traiter ?
La page publique liste les formats PDF, DOCX, PNG, JPG, TIFF et XLSX, en mettant l’accent sur les scans, les photos, les tableaux, les formulaires, les graphiques et le contenu manuscrit.
Quels formats peut-on exporter ?
Les formats de sortie courants incluent Markdown, JSON, CSV et XML. Les champs structurés sont définis par l’Extractor.
Y a-t-il une cotisation mensuelle pour Flexible ?
Aucune engagement mensuel, facturation à 0,02 dollar par page. Il convient toujours de prendre en compte le traitement répétitif, les tentatives de récupération des échecs et les coûts supplémentaires liés aux processus.
Combien de pages le pack Professional contient-il ?
Chaque mois comprend 25 000 pages ; le supplément est facturé à 0,02 dollar par page. La définition de la page varie selon que le document est en PDF, en image ou en DOCX.
Le document sera-t-il utilisé pour entraîner le modèle ?
La plateforme s’engage envers tous les clients et forfaits à ne pas utiliser des données d’entrée ou de sortie pour entraîner, affiner ou améliorer ses propres modèles de base ainsi que ceux de tiers.
Doctly est-il sans conservation de données ?
On ne peut pas généraliser. Flexible permet de conserver les données jusqu’à 30 jours au maximum, Professional et Enterprise offrent l’option ZDR ; la stratégie réelle dépend de la configuration et du contrat.
Peut-il gérer des données médicales ?
Seules les versions Professional ou Enterprise, disposant d’un BAA valide signé, permettent de télécharger des informations de santé protégées.
Y a-t-il une API publique ?
Oui, cela couvre les documents, l’extracteur, la collection, les requêtes et le chat. Toutes les requêtes utilisent une clé API et sont soumises aux limites de débit du forfait.
Le SDK Python est-il open source ?
Oui, le SDK officiel Python est distribué sous la licence MIT. La plateforme cloud Doctly reste quant à elle un service commercial propriétaire.
Peut-on le déployer dans son propre environnement ?
Enterprise propose des options d’infrastructure propre, de cloud privé ou de déploiement local ; les détails de l’architecture, les responsabilités de maintenance et les prix doivent être demandés au service des ventes.
L’output a-t-il besoin d’une vérification manuelle ?
Nécessaire. Les conditions stipulent clairement que les sorties des grands modèles peuvent être erronées, incomplètes ou présenter des hallucinations ; une vérification manuelle est indispensable pour les opérations importantes.
Résumé
Doctly AI convient aux équipes qui ont besoin d’intégrer de manière fiable des documents complexes dans des processus automatisés, tout en exigeant une extraction structurée, des API, le respect des réglementations et des options de déploiement. Avant le lancement, il convient de valider la précision et le coût par page à l’aide d’échantillons réels, et d’intégrer dans la conception la relecture manuelle, la conservation des données et la gestion des clés.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164