FormX.ai
FormX.ai, outil intelligent spécialisé dans les documents IA
Étiquettes :Outils de documents IAUne phrase pour présenter
FormX.ai est une plateforme intelligente de traitement de documents qui permet d’identifier les factures, reçus, relevés bancaires, pièces d’identité, contrats et autres documents commerciaux à l’aide d’extracteurs pré-entraînés ou personnalisés, et de les fournir sous forme JSON structuré aux systèmes financiers, opérationnels ou de développement.
Présentation des outils
FormX est géré par SkyMakers Digital Limited et propose des fonctionnalités telles que le téléchargement de documents, la vérification de la qualité des images, la segmentation de la classification, l’extraction de champs, la reconnaissance de tableaux, les retours de correction, des API ainsi que des composants de numérisation pour appareils mobiles. Son objectif n’est pas seulement de convertir des images en texte, mais de créer des pipelines de données pouvant être intégrés dans les processus de production.
Les utilisateurs peuvent choisir des extracteurs pré-entraînés, ou bien télécharger des échantillons et définir les champs requis pour entraîner une configuration personnalisée adaptée à un format ou à un commerçant spécifique. La plateforme permet également de choisir entre des modèles visuels et des solutions basées sur de grands modèles de langage, tout en réduisant les résultats instables grâce à des règles métier et des échantillons.
Fonction principale
Extraiteur de documents pré-entraîné
La plateforme offre une capacité d’entraînement préalable pour des documents courants tels que les factures, les reçus et les pièces d’identité, adaptée aux tâches où les champs sont relativement standardisés. Les utilisateurs n’ont pas besoin d’étiqueter de nombreux échantillons à partir de zéro, mais ils doivent néanmoins vérifier la couverture des langues, des formats et des types de pièces d’identité.
Extraiteur personnalisé
Les utilisateurs peuvent télécharger des échantillons représentatifs, définir le numéro de facture, la date, le montant, le fournisseur ou des champs propres à l’entreprise, et effectuer des ajustements continus grâce aux retours. La configuration personnalisée convient aux fichiers dont le format est fixe, dont la signification des champs est particulière, ou dont le modèle standard est facile à confondre.
Classification et segmentation de documents
Split & Classify permet d’identifier les types de documents dans des lots mixtes et de diviser plusieurs fichiers en unités à traiter ultérieurement. Il convient aux pièces jointes e-mail, aux dossiers scannés et aux PDF contenant plusieurs documents, mais il est nécessaire de créer des files manuelles pour les pages anormales et les types inconnus.
Extraction avancée de tableaux
L’extraction avancée de tableaux s’adresse aux détails de factures, aux relevés bancaires et à d’autres structures de lignes et de colonnes, et peut générer une liste d’éléments plutôt que de ne reconnaître que les champs en en-tête de page. Les en-têtes sur plusieurs pages, les cellules fusionnées, les modifications manuscrites et les scans de faible qualité peuvent encore affecter les résultats.
Vérification des champs et Centre d’exactitude
Le Accuracy Center est utilisé pour gérer en masse des ensembles de données, vérifier les résultats et fournir aux modèles des valeurs correctes. Les données de production peuvent aider l’extracteur à s’adapter progressivement aux documents réels, mais le processus de feedback doit faire l’objet d’autorisations, de masquage des données et de vérification.
AI Code Mapping
Le mappage de code IA permet de relier le texte identifié aux codes internes de l’entreprise, aux catégories ou aux valeurs standards, réduisant ainsi les vérifications manuelles ultérieures. Lorsque les données métier principales changent, il est nécessaire de mettre à jour en parallèle les règles de mappage, tout en conservant les branches nécessitant une vérification manuelle en cas d’incertitude.
Fraude et détection d’images par l’IA
La liste des fonctionnalités pour les petites entreprises et les entreprises comprend la détection de la fraude et des images générées par l’IA, qui peut servir de signal de risque dans les processus de remboursement, de demande de compensation ou de vérification d’identité. Elle ne doit pas être considérée comme un jugement définitif concernant la fraude ; les décisions cruciales nécessitent une analyse des documents originaux, des registres commerciaux et une enquête manuelle.
Vérification de la qualité de l’image
Les fonctionnalités de balayage mobile et d’AI Scan permettent de vérifier avant le téléchargement les problèmes de flou, d’éclairage, de cadrage ou des bords du document, afin de réduire les entrées de faible qualité. Une bonne qualité ne garantit pas pour autant que les champs soient toujours corrects ; il reste nécessaire de définir des seuils de confiance pour les montants importants et les champs d’identité.
Combinaison de modèles visuels et de grands modèles de langage
FormX permet de basculer ou de combiner des modèles visuels et des grands modèles de langage en fonction du type de document, du délai et des objectifs de précision, tout en mettant l’accent sur l’utilisation de contraintes pour réduire les hallucinations. Les modèles sous-jacents spécifiques, la disponibilité régionale et les coûts peuvent varier en fonction de la configuration du projet.
Traitement de grands PDF
En 2026, de nouvelles interfaces de téléchargement et processus d’espace de travail destinés aux gros fichiers ont été ajoutés, permettant de gérer des documents allant jusqu’à 500 MB et 1 000 pages. L’interface traditionnelle de extraction d’une seule image conserve une limite de corps de requête de 10 MB ; ces deux types d’entrées ne peuvent pas partager la même limite.
Documents traitables
| Catégorie de document | Fichier représentatif | Champs courants | Scénarios d’application |
|---|---|---|---|
| Documents financiers | Factures, reçus, documents fiscaux | Numéro, date, fournisseur, montant de la taxe, montant total | Dettes fournisseurs, remboursements et audit |
| Banques et comptabilité | Comptes bancaires, rapport annuel | Compte, date de transaction, résumé, montant débiteur et créditeur | Rapprochements, flux de trésorerie et comptabilisation |
| Identité et qualifications | Carte d’identité, passeport, permis, certificat | Nom, numéro, date d’expiration, organisme émetteur | Ouverture de compte, embauche et vérification de conformité |
| Achat et logistique | Bon de commande, bon de livraison, bordereau de transport | Numéro de commande, article, quantité, adresse, état | Stocks, exécution et chaîne d’approvisionnement |
| Ressources humaines | Curriculum vitæ, formulaire de demande, contrat de travail, relevés de salaire | Personnel, expérience, poste, date, montant | Recrutement, intégration et organisation des dossiers |
| Droit et affaires | Contrats, accords de confidentialité, licences commerciales | Sujet, clauses, délais, obligations et numéro | Enregistrement des contrats et rappels d’échéance |
| Service client | Demandes de garantie, tickets de support, contrats de service | Clients, produits, problèmes et état de traitement | Réclamations et automatisation des services |
Processus de travail complet
- Sélectionner des documents d’échantillon capables de couvrir le format réel, la langue, la qualité et les cas anormaux.
- Sélectionnez un extracteur pré-entraîné dans la zone de travail, ou créez un extracteur personnalisé et définez les champs.
- Téléchargez l’échantillon et indiquez les valeurs correctes, la structure du tableau ainsi que le contenu à ignorer.
- Utilisez l’ensemble de test pour évaluer la précision au niveau des champs, et ne vous contentez pas d’examiner un petit nombre d’échantillons réussis.
- Configuration de la classification, du découpage, de la vérification, de la mappage du code, du seuil de confiance et de la révision manuelle.
- Accéder aux fichiers via l’espace de travail ou une API, et transmettre du JSON structuré au système métier.
- Enregistrer en continu les cas d’erreur et les retours, afin de surveiller l’évolution du format, les délais, les coûts et le taux d’anomalies.
Tutoriel pour créer un extracteur personnalisé
- Inscrivez-vous et créez un projet, puis sélectionnez la région de traitement États-Unis, Taïwan ou Singapour en fonction des exigences réglementaires.
- Créer un extracteur nouveau pour un type de document métier, afin d’éviter d’inclure des fichiers aux différences trop importantes dans la même configuration.
- Définir le nom du champ, le type de données, s’il est obligatoire et les formats acceptés.
- Téléchargez des échantillons représentatifs et vérifiez la portée dans laquelle la plateforme conserve ces fichiers d’entraînement.
- Corriger chaque champ et tableau individuellement, en gérant les images floues, tournées, les valeurs manquantes, les sauts de page et les formats différents des fournisseurs.
- Calculer le taux de précision, le taux de faux négatifs et le taux de faux positifs pour chaque champ à l’aide d’un ensemble de test indépendant.
- Une fois le seuil opérationnel atteint, publier la configuration et conserver des solutions de rollback ainsi que de révision manuelle.
Guide d’intégration API
- Créez un extracteur dans l’espace de travail Web, et obtenez l’identifiant de l’extracteur ainsi que le token d’accès depuis le tableau de bord.
- Choisissez le mode de synchronisation, le mode asynchrone ou l’entrée de téléchargement pour les gros fichiers en fonction de la taille et de la durée du fichier.
- Soumettez la demande avec un fichier ou l’adresse d’un fichier contrôlé, et indiquez l’identifiant correct de l’extraiteur.
- Les requêtes synchrones lisent directement les résultats ; les requêtes asynchrones enregistrent l’identifiant de la tâche et consultent périodiquement l’état des résultats.
- Analyser les champs, les tableaux, le degré de confiance et les messages d’erreur dans le JSON, puis les mapper au modèle de données métier.
- Ajout de délais d’attente, d’idempotence, de tentatives avec recul, de gestion des quotas, de masquage des journaux et de file d’attente des échecs.
- Mesurer avant le lancement la précision, le délai, le débit et le coût par page des fichiers réels.
Tutoriel de traitement de grands PDF
- Vérifiez d’abord le nombre de pages du document, la taille du fichier, s’il est chiffré, et si les pages contiennent plusieurs types de documents.
- Utilisez le processus de téléchargement en gros volume pour les fichiers allant jusqu’à 500 MB ou 1 000 pages, et n’appliquez pas le corps de demande unique de 10 MB.
- Activez la classification et la segmentation pour attribuer les documents mixtes aux extracteurs correspondants.
- Utilisez des tâches asynchrones pour éviter les délais d’attente trop longs pour les requêtes, et conservez l’identifiant de la tâche afin de reprendre la consultation.
- Vérifier les pages manquantes, l’ordre, les pages dupliquées, les tableaux qui s’étendent sur plusieurs pages et les pages défaillantes par page et par document.
- Une fois confirmé que les résultats ont été enregistrés dans son propre système, supprimer ensuite les fichiers de l’espace de travail conformément à la politique des données.
Fichiers, dimensions et limites d’interface
| Entrée ou projet | Restrictions ou recommandations publiques | Adéquat pour la situation | Précautions à prendre |
|---|---|---|---|
| Téléchargement d’un corps de demande traditionnel | Un seul fichier d’image jusqu’à 10 MB | Image une page ou PDF de petite taille | Si le plafond est dépassé, il faut utiliser une autre méthode de téléchargement. |
| Saisie de l’adresse du fichier | Le document indique qu’il n’y a pas de limite similaire de taille de fichier. | Stockage d’objets contrôlé déjà disponible | Les permissions et la durée de validité des liens doivent être contrôlées. |
| Processus de téléchargement en grand volume | Jusqu’à 500 MB, 1 000 pages | Rapports longs et numérisation de PDF en masse | Entrée nouvellement ajoutée en 2026 |
| Taille de l’image | Un côté ne doit pas dépasser 10 000 pixels | Photos haute résolution et scans | Le nombre total de pixels doit être inférieur à 75 M. |
| Résolution recommandée | Unilatéral de 1 000 à 2 000 pixels ou au moins 100 DPI | Billets et formulaires ordinaires | Le texte doit être lisible. |
| Formats courants | JPEG, PNG, PDF | Images et documents | La liste au format complet est déterminée par l’espace de travail. |
| Mode asynchrone | Récupérer les résultats après le retour de la tâche | Temps de traitement plus long ou traitement en lot | Une fois les résultats obtenus, le fichier est supprimé selon les règles. |
À qui s’adresse-t-il
- Équipe financière et comptable : saisie en masse de factures, de reçus, d’extraits bancaires et de documents fiscaux.
- Équipe de vente au détail et d’opérations : gestion des commandes d’achat, des registres de stock, des bons de livraison et des factures des magasins.
- Entreprise de logistique : extraction des champs clés à partir des bons de transport, des justificatifs d’adresse et des documents de livraison.
- Service des ressources humaines : organisation des CV, formulaires de demande, fiches de paie et pièces d’identité.
- Équipe juridique et de conformité : création d’un index structuré des contrats, des licences et des dates d’expiration.
- Développeur de logiciels : intégrer la reconnaissance de documents via une API dans un CRM, un ERP ou son propre flux de travail.
- Équipe d’applications mobiles : Intégration du scan de documents dans des applications Android, iOS ou Flutter.
Scénarios d'utilisation typiques
- Convertir les factures des fournisseurs reçues par e-mail ou via l’interface de téléchargement en données de comptes à payer.
- Extraire les détails des transactions à partir des flux bancaires, puis entrer dans le processus de rapprochement et de classification.
- Identifier les reçus de remboursement et contrôler les risques grâce aux signaux de fraude, aux règles de montant et à une vérification manuelle.
- Guider l’utilisateur pour qu’il prenne en photo ses pièces d’identité dans l’application de création de compte ou d’embauche, et vérifier la qualité de l’image.
- Découper un PDF long en différents types de documents, et extraire séparément les champs et les tableaux.
- Connecter les disques cloud, l’e-mail, la plateforme et les systèmes métier associés via Zapier ou n8n.
- Utiliser la mise en correspondance par code interne pour unifier les noms des fournisseurs, des comptes, des produits ou des magasins.
Avantages du produit
- Il propose en même temps des modèles pré-entraînés, des extracteurs personnalisés et un feedback continu, sans se limiter au texte OCR général.
- Un pipeline complet couvrant le contrôle de qualité, la classification et le décomposition, ainsi que le JSON structuré et la mise en correspondance du code.
- Le plan payant à l’usage n’a pas d’engagement minimum et convient pour valider d’abord avec des échantillons réels.
- Starter est disponible en version publique avec 3 000 pages, 20 exemples de Smart Learning et des fonctionnalités avancées.
- Prend en charge la synchronisation, l’asynchrone et les chemins de fichiers volumineux, et peut gérer des images une page et des PDF longs.
- Fournit des zones de traitement aux États-Unis, à Taïwan et à Singapour, et prend en charge les négociations pour le cloud privé des entreprises.
- Disponible avec des API et des composants de scan mobile pour Android, iOS et Flutter.
- La plateforme affirme être certifiée conforme à ISO 27001 et SOC 2 Type II.
Restrictions d'utilisation et précautions
- Le taux de précision de l’identification dépend de la qualité du document, du format, des définitions des champs et de la langue ; les indicateurs marketing ne doivent pas être considérés comme des promesses.
- Les exemples officiels indiquent que les champs généraux peuvent représenter plus de 90 % dans des images de haute qualité, mais il ne s’agit pas d’un SLA uniforme.
- Le plan standard payant ne comprend pas de fonctionnalités avancées ; la classification, les tableaux, la mise en correspondance des codes, etc., nécessitent le plan Starter ou l’offre entreprise.
- La page de tarification utilise à la fois une indication par page et une indication par appel ; l’unité de facturation pour les grands fichiers multicouches doit être confirmée par écrit au préalable.
- Les limites de taille des interfaces traditionnelles et des ports d’upload de grande capacité diffèrent ; il est donc nécessaire de choisir le bon chemin lors de l’intégration.
- Les fichiers synchronisés ne sont pas conservés de manière permanente, tandis que les fichiers asynchrones sont chiffrés temporairement ; le document principal et les échantillons d’entraînement sont stockés.
- Le fait que la région de traitement soit optionnelle ne signifie pas que tous les sous-traitants et appels de modèles restent nécessairement dans la même région.
- Les services ne doivent pas être utilisés directement pour des décisions automatisées susceptibles de mettre en danger des vies, l’environnement ou des infrastructures essentielles.
- Les environnements Beta, d’essai gratuit, de prévisualisation et de clés non productives ne sont pas couverts par un SLA payant.
- La sortie API doit faire l’objet d’une vérification manuelle et d’une validation métier, en particulier pour les champs de montant, d’identité et de contrat.
Prix et forfaits
| Plan | Prix | Période de facturation | Plafond et avantages | Adéquat pour les utilisateurs |
|---|---|---|---|---|
| Essai gratuit | Les 100 premières pages sont gratuites | Essai gratuit unique | Utilisé pour les espaces de travail ou les essais d’API ; appelés alternatifs de la page pour les 100 premières requêtes | Vérification conceptuelle et tests d’échantillons |
| Pay-as-you-go | À partir de 0,30 $/page | À la demande | Aucune engagement minimum, sans fonctionnalités avancées | Traitement à basse fréquence ou unique |
| Starter | 299 $/mois/extraiteur | Monthly | 3 000 pages par mois, 0,10 dollar/pause pour les dépassements, 20 exemples de Smart Learning et fonctionnalités avancées | Petites entreprises et processus stables |
| Enterprise | Cotation sur mesure | Dispositions contractuelles | Toutes les fonctionnalités de Starter, SLA personnalisé, gestionnaire client, support en ligne et cloud privé | Haute capacité de traitement, conformité et déploiement complexe |
La date de vérification du prix est le 22 août 2026, et le prix indiqué ne comprend pas les taxes. Les frais des services peuvent être ajustés après une notification 30 jours à l’avance ; l’abonnement se renouvelle automatiquement par défaut, l’annulation prend généralement effet à la fin du cycle en cours, et aucun remboursement n’est accordé pour les cycles déjà payés.
Comparaison des fonctionnalités des forfaits
| Capacité | À la demande | Starter | Enterprise |
|---|---|---|---|
| Essai des 100 premières pages | Soutien | On peut d’abord essayer. | Pouvant être vérifié par démonstration ou contrat |
| Engagement minimum | Aucun | 299 $/mois/extraiteur | Conformément au contrat |
| Nombre de pages inclus | Traiter selon les réalités | 3 000 pages/mois | sur mesure |
| Prix unitaire excédentaire | À partir de 0,30 $/page | 0,10 dollar/feuille | sur mesure |
| Tableaux avancés, séparation et classification | Non inclus | Contient | Contient |
| Cartographie du code IA et détection de la fraude | Non inclus | Contient | Contient |
| Accuracy Center | Non inclus | Contient | Contient |
| Soutien | Ressources conventionnelles | Forum communautaire | Gestionnaire de compte et support en ligne |
| SLA | Aucune promesse de personnalisation | SLA général payant | Personnalisable |
| Cloud privé | Non fourni | Non inclus | Négociable |
Débit, latence et précision
| Indicateur | Référence publique | Nature de l’engagement | Conseils d'utilisation |
|---|---|---|---|
| Débit des opérations courantes | Au moins 180 fois par minute en l’absence de détails du produit | Les questions-réponses sur la tarification servent de référence pour le plan d’affaires, sans SLA. | Utiliser des tests de charge en parallèle réels |
| Taux de traitement avec détail des produits | Au moins 30 fois/minute | Pas d’engagement SLA | Tableau d’évaluation et complexité des éléments de ligne |
| Retard dans le traitement des reçus | Généralement de 4 à 8 secondes, sans téléchargement | Sans SLA | Mesurer la taille du fichier et le réseau régional |
| Taux de précision des champs généraux | Référence client d’au moins environ 70 % | Garantie non unifiée | Mesure par champ et ensemble d’échantillons |
| Champs courants pour des images de haute qualité | La date, l’heure et le montant peuvent dépasser 90 %. | Référence aux retours clients | Ne peut pas être extrapolé à tous les champs |
| Disponibilité mensuelle payante | 99.95% | SLA général | Il y a de nombreuses exclusions et il faut demander activement des points. |
Le taux de précision doit être défini en fonction des champs métier, des canaux de documents et du coût des erreurs. La moyenne globale peut masquer un faible taux de précision pour des champs clés tels que le numéro de facture, le montant ou le numéro d’identité ; il convient donc d’établir des seuils séparés ainsi que des contrôles manuels.
SLA et points de service
Le SLA général du plan payant garantit une disponibilité de 99,95 % par mois. Les interventions de maintenance planifiées sont généralement annoncées avec 48 heures d’avance, et ne dépassent pas 12 heures par an. En cas de non-respect de ces objectifs, le client doit faire une demande explicite ; des points de service équivalant à 10 % du montant du mois seront alors appliqués.
| Projet | Règles | Restrictions |
|---|---|---|
| Disponibilité mensuelle | 99.95% | Sans maintenance planifiée et sans incidents de dépannage |
| Avis de maintenance prévue | 48 heures à l’avance | Planifier un entretien d’au plus 12 heures par an |
| Indemnisation en cas de non-respect des normes | Points de service correspondant à 10 % des frais du mois | Sans espèces, demande du client requise |
| Essai et Beta | SLA non applicable | Les versions gratuites, les prévisualisations et l’accès anticipé sont exclus. |
| Clé non productive | SLA non applicable | Exclusion du sandbox ou de l’environnement non productif |
| Engagement de l’entreprise | Personnalisable | Il faut écrire une offre ou un contrat |
API et sortie structurée
L’interface d’extraction est authentifiée via un token d’accès et utilise l’identifiant de l’extrait pour sélectionner la configuration de reconnaissance. Les résultats réussis sont retournés sous forme JSON, ce qui permet de les mapper vers des ERP, des CRM, des bases de données, des systèmes d’approbation ou des plateformes automatisées.
Les tâches longues peuvent être configurées en mode asynchrone : le système renvoie d’abord l’identifiant de la tâche, puis le client consulte les résultats. L’intégration en production nécessite de gérer les quotas, l’expiration des tâches, les soumissions répétées, les échecs partiels et les modifications des versions des résultats.
SDK mobile
| Composant | Plateforme | Exigences minimales ou état | Utilisation principale |
|---|---|---|---|
| SDK FormX natif | Android et iOS | Il y a des références et des exemples publics | Détection de documents, prise de vue et numérisation mobile |
| Flutter SDK | Android | SDK 26 et ultérieurs | Vue de la caméra native dans les applications multiplateformes |
| Flutter SDK | iOS | iOS 14 et ultérieurs | Appeler les capacités de scan d’iOS dans Flutter |
| Flutter Desktop et Web | macOS, Windows, Linux, Web | Non pris en charge actuellement | On ne peut pas supposer que l’emballage mobile puisse être directement adapté à ces plateformes. |
| Application d’exemple de scan par IA | Android | Démonstration publique de l’application | Expérience de la prise de photo du reçu, de sa reconnaissance et du partage des résultats |
L’SDK mobile vise principalement à améliorer l’affichage dans l’objectif de la caméra, la détection des documents et l’expérience de collecte ; l’extraction des champs réels reste cependant dépendante du service FormX et des paramètres du projet. Lors de l’obtention des droits d’accès à la caméra, il faut fournir une description claire de son utilisation et éviter d’enregistrer les tokens d’accès en code dans le client.
Mode d’intégration
| Méthode | Scénarios adaptés | Sortie ou connexion | Précautions à prendre |
|---|---|---|---|
| Espace de travail Web | Configuration et test du personnel commercial | Résultats de visualisation et ensemble de données | Le document principal et les échantillons d’entraînement peuvent être enregistrés |
| API de synchronisation | Processus une page et faible latence | Retourner immédiatement au JSON | Restreint par le délai de la demande et la taille du corps de la demande à 10 MB |
| API asynchrone | Tâches longues et traitement par lots | Identifiant de la tâche + recherche des résultats | Il faut gérer l’expiration des tâches et les tentatives de réessai |
| API de téléchargement en grand volume | Jusqu’à 500 MB, 1 000 pages | Résultats de structuration de documents à plusieurs pages | Les règles de facturation par page doivent être confirmées |
| SDK mobile | Collecte mobile et contrôle de qualité | Photo ou résultat de scan | Les niveaux de compatibilité avec Android, iOS et Flutter diffèrent. |
| Zapier et n8n | Workflow à faible code | Relier les canaux de fichiers aux applications métier | Les justificatifs, les tentatives de réessai et les données sensibles doivent être contrôlés. |
Confidentialité, sauvegarde des fichiers et entraînement
| Type de données | Règles de sauvegarde | Entraînement ou utilisation | Mesures utilisateur |
|---|---|---|---|
| Extraction de fichiers via l’API de synchronisation | Ne pas entrer dans le stockage permanent | Utilisé pour effectuer ce retrait | Il faut toujours contrôler les champs sensibles et les journaux. |
| Fichier API asynchrone | Stockage temporaire chiffré, résultat récupéré ou supprimé à l’expiration de la tâche | Utilisé pour exécuter des tâches asynchrones | Récupérer les résultats en temps opportun et vérifier la date d’expiration |
| Document principal de l’espace de travail | Sera sauvegardé | Utilisé pour la configuration des utilisateurs et les services | Procédure de suppression claire et durée de conservation |
| Échantillons d’entraînement pour le modèle personnalisé | Sera sauvegardé | Modèles personnalisés pour les demandes des clients | Désensibiliser et restreindre les droits de l’équipe |
| Informations sur le compte et l’équipe | Conservation avant suppression du compte | Connexion, facturation, support et opérations | Le contenu partagé sera traité séparément lors de la suppression du compte. |
| Utilisation d’activités et de métadonnées | Conserver pendant la durée nécessaire | Amélioration des produits, analyse et sécurité | Exiger des journaux d’entreprise et des instructions de conservation |
| Entraînement des modèles génératifs | En principe, il n’est pas utilisé pour la formation destinée à d’autres clients. | Seules les exceptions telles que l’accord écrit, la prestation de services à ces clients ou des exigences légales. | Vérifier les exceptions et l’anonymisation dans le DPA |
Les données peuvent être hébergées et traitées aux États-Unis, à Taïwan ou à Singapour, et la plateforme fait également appel à des sous-traitants pour l’hébergement cloud, l’inférence IA, les paiements, l’observabilité et l’analyse. Avant de choisir la région du projet, il convient de vérifier le DPA, l’emplacement des sous-traitants et les mécanismes de transfert transfrontalier.
- Inclure la synchronisation, l’asynchrone, le document principal de l’espace de travail et les échantillons d’entraînement dans la classification des données respectivement.
- Ne téléchargez que les pages et champs nécessaires à l’achèvement de la tâche ; masquez les données si c’est possible.
- Utilisez les droits minimaux pour l’équipe et nettoyez régulièrement les membres qui quittent l’entreprise ainsi que les tokens d’accès expirés.
- FormX conserve les fichiers originaux et les données finales dans son propre système ; il n’est pas responsable de la sauvegarde ou de l’archivage.
- Signer un DPA pour les données personnelles, et vérifier les sous-traitants, les régions, le chiffrement et les preuves de suppression.
- Ne pas utiliser le service pour des décisions médicales, relatives à la sécurité de la vie ou aux infrastructures critiques qui ne nécessitent pas de révision humaine.
Sécurité et conformité
FormX affirme être conforme aux normes ISO 27001 et SOC 2 Type II, et propose des SLA généraux aux clients payants. Les entreprises qui effectuent des achats doivent néanmoins demander des rapports valables, un résumé des tests d’infiltration, des documents relatifs à la continuité d’activité ainsi que des conditions de notification en cas d’événement de sécurité.
Les clauses définissent le client comme le contrôleur de données personnelles, FormX comme le traitement, et font référence au DPA ainsi qu’à la liste des sous-traitants. Le certificat ne peut pas remplacer le contrôle d’accès, la minimisation des données et l’approbation manuelle dans les projets spécifiques.
API, GitHub et open source
FormX fournit des documents d’API publiques, des références pour les SDK Android et iOS ainsi qu’une encapsulation Flutter. Le répertoire du SDK Flutter sous l’organisation Oursky est soumis à la licence MIT et prend en charge Android SDK 26 et ultérieurs ainsi que iOS 14 et ultérieurs ; il existe également un répertoire de documents pour les SDK natifs et un répertoire d’anciens documents d’aide archivés.
La mise à disposition publique de l’SDK et des documents ne signifie pas que la plateforme FormX est open source. L’OCR, le routage des modèles, l’entraînement personnalisé, Accuracy Center, l’extraction en cloud et l’espace de travail d’entreprise restent des services hébergés propriétaires ; l’utilisation de l’SDK nécessite toujours un accès à une plateforme commerciale.
| Projet | Statut public | Licence ou instructions |
|---|---|---|
| Plateforme cloud FormX | Source fermée | Services de gestion commerciale |
| Extraire l’API | Document public | Compte, jeton d’accès et crédit de paiement requis |
| SDK mobile natif | Entrepôts publics et références | L’entrepôt n’affiche pas dans le résumé public la licence globale de la plateforme. |
| Flutter SDK | Code source ouvert | Licence MIT |
| Anciens documents d’aide | Public mais archivé | À partir du 18 avril 2024, lecture seule |
| Modèles personnalisés et espaces de travail | Source fermée | Impossible de déployer hors ligne de manière autonome |
Informations de base
| Projet | Contenu |
|---|---|
| Nom de l’outil | FormX.ai |
| Entité opérationnelle | SkyMakers Digital Limited |
| Lieu d’enregistrement | Angleterre et Pays de Galles en Angleterre |
| Type d’outil | Traitement intelligent de documents, OCR et extraction de données structurées |
| Entrée principale | Images, PDF, scans et documents pris sur appareil mobile |
| Sortie principale | JSON composé de champs, de tableaux et de métadonnées |
| Modèle de prix | Essai de 100 pages, facturation par page, abonnement mensuel et devis pour entreprises |
| Faut-il s’inscrire ? | La configuration, les API et l’utilisation payante nécessitent un compte. |
| Soutien en chinois | La capacité de traitement doit être déterminée par des tests sur le document ; la gestion et les documents sont principalement en anglais. |
| Zone de traitement | États-Unis, Taïwan, Singapour |
| Plateformes principales | Espace de travail Web, API, Android, iOS et Flutter |
| API publique | Fournir |
| SDK officiel | Android, iOS et Flutter |
| Le produit est-il open source | Pas open source |
| Partie open source | Le Flutter SDK est sous licence MIT |
| Âge minimum | 18 ans |
| Date de vérification du prix | 22 août 2026 |
Indice de recommandation
Indice de recommandation : 4,3 / 5. FormX.ai propose une chaîne de production assez complète, allant de la qualité des documents, de la segmentation par catégories, de l’extraction des champs et des tableaux jusqu’aux retours, aux API et à la collecte mobile ; ses prix publics ainsi que ses instructions relatives au traitement des données sont également plus détaillés que ceux de nombreux services OCR.
Le principal défaut est que Starter facture en fonction de l’extracteur, et les opérations complexes peuvent nécessiter plusieurs configurations ; il existe de grandes différences entre les fichiers volumineux et les limites des interfaces ordinaires, et il faut également confirmer les modalités de facturation par page et par appel. Les champs clés doivent toujours être vérifiés à l’aide d’échantillons réels, d’une revue manuelle et des SLA contractuels.
Questions fréquentes
À quoi sert FormX.ai ?
Il extrait des champs et des tableaux à partir de factures, de reçus, de relevés, de documents d’identité, de contrats et d’autres documents, et les fournit sous forme de JSON structuré aux workflows ou aux systèmes métier.
FormX.ai, c’est juste de l’OCR ?
Non. L’OCR n’est que la base de la reconnaissance de texte ; FormX offre en plus le classement des documents, la segmentation, des champs personnalisés, des tableaux, la mise en correspondance des codes, des retours d’information et l’intégration métier.
FormX.ai est-il gratuit ?
Une version d’essai gratuite des 100 premières pages est proposée, de même que des questions-réponses à tarif gratuit pour les 100 premières requêtes de récupération. La manière de calculer le coût pour des documents plus longs doit être confirmée avant de lancer le traitement en masse.
Combien coûte l’utilisation à la demande ?
Le forfait payant commence à 0,30 dollar par page, sans engagement minimum, mais ne comprend pas les fonctionnalités avancées. Les prix peuvent être modifiés ; les taxes et la facture finale seront basées sur le solde réel.
Qu’est-ce que le Starter contient ?
Le Starter coûte 299 dollars par mois et par extracteur, pour un total de 3 000 pages ; au-delà, il en coûte 0,10 dollar par page. Il inclut 20 exemples de Smart Learning, le Accuracy Center, la segmentation de classification, la mise en correspondance des codes et des tableaux avancés.
Quelle taille de PDF est prise en charge ?
Le nouveau processus de téléchargement en masse prend en charge jusqu’à 500 MB et 1 000 pages. Le téléchargement via le corps de la requête traditionnel reste limité à 10 MB ; il ne faut pas interpréter cette même limite pour toutes les entrées.
Quels formats de fichiers sont pris en charge ?
Les documents publics énumèrent clairement des formats courants tels que JPEG, PNG et PDF. D’autres formats, les PDF chiffrés et les encodages spéciaux doivent être testés dans le cadre du projet.
Quel est le format du résultat extrait ?
Il renvoie principalement des champs, des tableaux et des informations connexes au format JSON, ce qui facilite leur insertion dans une base de données, un ERP, un CRM ou des workflows automatisés.
Le fichier sera-t-il enregistré ?
Les fichiers extraits de manière synchrone ne sont pas stockés de façon permanente ; les fichiers asynchrones sont chiffrés temporairement et supprimés une fois que les résultats ont été récupérés ou que la tâche a expiré. Le document principal de l’espace de travail ainsi que les échantillons d’entraînement personnalisés sont conservés.
Les documents seront-ils utilisés pour entraîner des modèles publics ?
Les conditions stipulent que le contenu des clients ne sera pas utilisé pour entraîner des modèles génératifs destinés à d’autres clients ou à des tiers, sauf avec l’accord écrit préalable du client, si cela est nécessaire pour fournir et améliorer les services à ce dernier, ou en cas d’exigence légale.
Où les données sont-elles traitées ?
Lors de la création d’un projet, vous pouvez choisir la région des États-Unis, de Taïwan ou de Singapour, avec pour infrastructure GCP et Azure. Il convient néanmoins de vérifier les itinéraires transfrontaliers pour l’inférence IA et d’autres sous-processor.
Quel est le taux de précision de la reconnaissance ?
Il n’existe pas de taux de précision uniforme applicable à tous les documents. Selon les références officielles, les champs généraux peuvent atteindre plus de 70 %, tandis que les dates, les heures et les montants sur les reçus de qualité peuvent dépasser 90 %, mais il ne s’agit d’aucune promesse uniforme.
Combien de temps faut-il pour traiter une facture ?
Le temps de référence public est généralement de 4 à 8 secondes, sans compter le temps de téléchargement, et ce n’est pas non plus un SLA. La taille du fichier, le réseau, l’extraiteur ainsi que la complexité du tableau influencent tous la latence.
Y a-t-il une API ?
Fourni. Les développeurs utilisent des tokens d’accès et des identifiants d’extraction pour soumettre des documents, et peuvent choisir entre un traitement synchrone, asynchrone ou pour de gros fichiers.
Est-ce que l’accès aux applications mobiles est pris en charge ?
Il prend en charge Android, iOS et le SDK Flutter, et permet d’intégrer une vue de la caméra, la détection de documents et le flux de prise de vue. Flutter n’est actuellement pas compatible avec les plateformes Web et desktop.
FormX.ai est-il open source ?
La plateforme elle-même n’est pas open source. Le Flutter SDK est licencié sous la licence MIT ; certains SDK et dépôts de documentation sont accessibles au public, mais la reconnaissance en cloud, l’entraînement et l’espace de travail restent des services commerciaux.
Y a-t-il un SLA d’disponibilité ?
L’SLA général pour les forfaits payants est de 99,95 % par mois ; en cas de non-respect, des points de service équivalant à 10 % du montant de la facture du mois peuvent être demandés. Les environnements d’essai, Beta, prévisionnels et non productifs ne sont pas couverts par cette garantie.
Est-ce adapté aux décisions médicales ou liées à la sécurité de la vie ?
Il n’est pas adapté à une utilisation directe dans des décisions automatisées à haut risque pouvant entraîner la mort, des blessures ou des pannes d’infrastructures critiques. De tels scénarios exigent une négociation préalable d’un accord écrit distinct.
Résumé
FormX.ai convient aux équipes qui souhaitent transformer des factures, des documents d’identité, des contrats et de longs PDF en données commerciales structurées, en particulier pour les projets nécessitant des champs personnalisés, des tableaux, du scan mobile et une intégration API. Une version d’essai payante permet de définir au préalable une base de référence en termes de précision et de coûts à l’aide de documents réels.
Avant le lancement, il convient de définir clairement les restrictions de fichiers et les unités de facturation pour chaque point d’accès, de distinguer les méthodes de stockage pour la synchronisation, l’asynchrone, les documents principaux et les échantillons d’entraînement, et d’inclure dans le plan de mise en œuvre ou le contrat les seuils des champs clés, la révision manuelle, les zones de traitement, les sous-traitants, le débit et les SLA.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164