FormX.ai
Valeur ajoutée gratuite
Outils de bureautique IA Outils de documents IA

FormX.ai

FormX.ai, outil intelligent spécialisé dans les documents IA

Étiquettes :

Une phrase pour présenter

FormX.ai est une plateforme intelligente de traitement de documents qui permet d’identifier les factures, reçus, relevés bancaires, pièces d’identité, contrats et autres documents commerciaux à l’aide d’extracteurs pré-entraînés ou personnalisés, et de les fournir sous forme JSON structuré aux systèmes financiers, opérationnels ou de développement.

Présentation des outils

FormX est géré par SkyMakers Digital Limited et propose des fonctionnalités telles que le téléchargement de documents, la vérification de la qualité des images, la segmentation de la classification, l’extraction de champs, la reconnaissance de tableaux, les retours de correction, des API ainsi que des composants de numérisation pour appareils mobiles. Son objectif n’est pas seulement de convertir des images en texte, mais de créer des pipelines de données pouvant être intégrés dans les processus de production.

Les utilisateurs peuvent choisir des extracteurs pré-entraînés, ou bien télécharger des échantillons et définir les champs requis pour entraîner une configuration personnalisée adaptée à un format ou à un commerçant spécifique. La plateforme permet également de choisir entre des modèles visuels et des solutions basées sur de grands modèles de langage, tout en réduisant les résultats instables grâce à des règles métier et des échantillons.

Fonction principale

Extraiteur de documents pré-entraîné

La plateforme offre une capacité d’entraînement préalable pour des documents courants tels que les factures, les reçus et les pièces d’identité, adaptée aux tâches où les champs sont relativement standardisés. Les utilisateurs n’ont pas besoin d’étiqueter de nombreux échantillons à partir de zéro, mais ils doivent néanmoins vérifier la couverture des langues, des formats et des types de pièces d’identité.

Extraiteur personnalisé

Les utilisateurs peuvent télécharger des échantillons représentatifs, définir le numéro de facture, la date, le montant, le fournisseur ou des champs propres à l’entreprise, et effectuer des ajustements continus grâce aux retours. La configuration personnalisée convient aux fichiers dont le format est fixe, dont la signification des champs est particulière, ou dont le modèle standard est facile à confondre.

Classification et segmentation de documents

Split & Classify permet d’identifier les types de documents dans des lots mixtes et de diviser plusieurs fichiers en unités à traiter ultérieurement. Il convient aux pièces jointes e-mail, aux dossiers scannés et aux PDF contenant plusieurs documents, mais il est nécessaire de créer des files manuelles pour les pages anormales et les types inconnus.

Extraction avancée de tableaux

L’extraction avancée de tableaux s’adresse aux détails de factures, aux relevés bancaires et à d’autres structures de lignes et de colonnes, et peut générer une liste d’éléments plutôt que de ne reconnaître que les champs en en-tête de page. Les en-têtes sur plusieurs pages, les cellules fusionnées, les modifications manuscrites et les scans de faible qualité peuvent encore affecter les résultats.

Vérification des champs et Centre d’exactitude

Le Accuracy Center est utilisé pour gérer en masse des ensembles de données, vérifier les résultats et fournir aux modèles des valeurs correctes. Les données de production peuvent aider l’extracteur à s’adapter progressivement aux documents réels, mais le processus de feedback doit faire l’objet d’autorisations, de masquage des données et de vérification.

AI Code Mapping

Le mappage de code IA permet de relier le texte identifié aux codes internes de l’entreprise, aux catégories ou aux valeurs standards, réduisant ainsi les vérifications manuelles ultérieures. Lorsque les données métier principales changent, il est nécessaire de mettre à jour en parallèle les règles de mappage, tout en conservant les branches nécessitant une vérification manuelle en cas d’incertitude.

Fraude et détection d’images par l’IA

La liste des fonctionnalités pour les petites entreprises et les entreprises comprend la détection de la fraude et des images générées par l’IA, qui peut servir de signal de risque dans les processus de remboursement, de demande de compensation ou de vérification d’identité. Elle ne doit pas être considérée comme un jugement définitif concernant la fraude ; les décisions cruciales nécessitent une analyse des documents originaux, des registres commerciaux et une enquête manuelle.

Vérification de la qualité de l’image

Les fonctionnalités de balayage mobile et d’AI Scan permettent de vérifier avant le téléchargement les problèmes de flou, d’éclairage, de cadrage ou des bords du document, afin de réduire les entrées de faible qualité. Une bonne qualité ne garantit pas pour autant que les champs soient toujours corrects ; il reste nécessaire de définir des seuils de confiance pour les montants importants et les champs d’identité.

Combinaison de modèles visuels et de grands modèles de langage

FormX permet de basculer ou de combiner des modèles visuels et des grands modèles de langage en fonction du type de document, du délai et des objectifs de précision, tout en mettant l’accent sur l’utilisation de contraintes pour réduire les hallucinations. Les modèles sous-jacents spécifiques, la disponibilité régionale et les coûts peuvent varier en fonction de la configuration du projet.

Traitement de grands PDF

En 2026, de nouvelles interfaces de téléchargement et processus d’espace de travail destinés aux gros fichiers ont été ajoutés, permettant de gérer des documents allant jusqu’à 500 MB et 1 000 pages. L’interface traditionnelle de extraction d’une seule image conserve une limite de corps de requête de 10 MB ; ces deux types d’entrées ne peuvent pas partager la même limite.

Documents traitables

Catégorie de documentFichier représentatifChamps courantsScénarios d’application
Documents financiersFactures, reçus, documents fiscauxNuméro, date, fournisseur, montant de la taxe, montant totalDettes fournisseurs, remboursements et audit
Banques et comptabilitéComptes bancaires, rapport annuelCompte, date de transaction, résumé, montant débiteur et créditeurRapprochements, flux de trésorerie et comptabilisation
Identité et qualificationsCarte d’identité, passeport, permis, certificatNom, numéro, date d’expiration, organisme émetteurOuverture de compte, embauche et vérification de conformité
Achat et logistiqueBon de commande, bon de livraison, bordereau de transportNuméro de commande, article, quantité, adresse, étatStocks, exécution et chaîne d’approvisionnement
Ressources humainesCurriculum vitæ, formulaire de demande, contrat de travail, relevés de salairePersonnel, expérience, poste, date, montantRecrutement, intégration et organisation des dossiers
Droit et affairesContrats, accords de confidentialité, licences commercialesSujet, clauses, délais, obligations et numéroEnregistrement des contrats et rappels d’échéance
Service clientDemandes de garantie, tickets de support, contrats de serviceClients, produits, problèmes et état de traitementRéclamations et automatisation des services

Processus de travail complet

  1. Sélectionner des documents d’échantillon capables de couvrir le format réel, la langue, la qualité et les cas anormaux.
  2. Sélectionnez un extracteur pré-entraîné dans la zone de travail, ou créez un extracteur personnalisé et définez les champs.
  3. Téléchargez l’échantillon et indiquez les valeurs correctes, la structure du tableau ainsi que le contenu à ignorer.
  4. Utilisez l’ensemble de test pour évaluer la précision au niveau des champs, et ne vous contentez pas d’examiner un petit nombre d’échantillons réussis.
  5. Configuration de la classification, du découpage, de la vérification, de la mappage du code, du seuil de confiance et de la révision manuelle.
  6. Accéder aux fichiers via l’espace de travail ou une API, et transmettre du JSON structuré au système métier.
  7. Enregistrer en continu les cas d’erreur et les retours, afin de surveiller l’évolution du format, les délais, les coûts et le taux d’anomalies.

Tutoriel pour créer un extracteur personnalisé

  1. Inscrivez-vous et créez un projet, puis sélectionnez la région de traitement États-Unis, Taïwan ou Singapour en fonction des exigences réglementaires.
  2. Créer un extracteur nouveau pour un type de document métier, afin d’éviter d’inclure des fichiers aux différences trop importantes dans la même configuration.
  3. Définir le nom du champ, le type de données, s’il est obligatoire et les formats acceptés.
  4. Téléchargez des échantillons représentatifs et vérifiez la portée dans laquelle la plateforme conserve ces fichiers d’entraînement.
  5. Corriger chaque champ et tableau individuellement, en gérant les images floues, tournées, les valeurs manquantes, les sauts de page et les formats différents des fournisseurs.
  6. Calculer le taux de précision, le taux de faux négatifs et le taux de faux positifs pour chaque champ à l’aide d’un ensemble de test indépendant.
  7. Une fois le seuil opérationnel atteint, publier la configuration et conserver des solutions de rollback ainsi que de révision manuelle.

Guide d’intégration API

  1. Créez un extracteur dans l’espace de travail Web, et obtenez l’identifiant de l’extracteur ainsi que le token d’accès depuis le tableau de bord.
  2. Choisissez le mode de synchronisation, le mode asynchrone ou l’entrée de téléchargement pour les gros fichiers en fonction de la taille et de la durée du fichier.
  3. Soumettez la demande avec un fichier ou l’adresse d’un fichier contrôlé, et indiquez l’identifiant correct de l’extraiteur.
  4. Les requêtes synchrones lisent directement les résultats ; les requêtes asynchrones enregistrent l’identifiant de la tâche et consultent périodiquement l’état des résultats.
  5. Analyser les champs, les tableaux, le degré de confiance et les messages d’erreur dans le JSON, puis les mapper au modèle de données métier.
  6. Ajout de délais d’attente, d’idempotence, de tentatives avec recul, de gestion des quotas, de masquage des journaux et de file d’attente des échecs.
  7. Mesurer avant le lancement la précision, le délai, le débit et le coût par page des fichiers réels.

Tutoriel de traitement de grands PDF

  1. Vérifiez d’abord le nombre de pages du document, la taille du fichier, s’il est chiffré, et si les pages contiennent plusieurs types de documents.
  2. Utilisez le processus de téléchargement en gros volume pour les fichiers allant jusqu’à 500 MB ou 1 000 pages, et n’appliquez pas le corps de demande unique de 10 MB.
  3. Activez la classification et la segmentation pour attribuer les documents mixtes aux extracteurs correspondants.
  4. Utilisez des tâches asynchrones pour éviter les délais d’attente trop longs pour les requêtes, et conservez l’identifiant de la tâche afin de reprendre la consultation.
  5. Vérifier les pages manquantes, l’ordre, les pages dupliquées, les tableaux qui s’étendent sur plusieurs pages et les pages défaillantes par page et par document.
  6. Une fois confirmé que les résultats ont été enregistrés dans son propre système, supprimer ensuite les fichiers de l’espace de travail conformément à la politique des données.

Fichiers, dimensions et limites d’interface

Entrée ou projetRestrictions ou recommandations publiquesAdéquat pour la situationPrécautions à prendre
Téléchargement d’un corps de demande traditionnelUn seul fichier d’image jusqu’à 10 MBImage une page ou PDF de petite tailleSi le plafond est dépassé, il faut utiliser une autre méthode de téléchargement.
Saisie de l’adresse du fichierLe document indique qu’il n’y a pas de limite similaire de taille de fichier.Stockage d’objets contrôlé déjà disponibleLes permissions et la durée de validité des liens doivent être contrôlées.
Processus de téléchargement en grand volumeJusqu’à 500 MB, 1 000 pagesRapports longs et numérisation de PDF en masseEntrée nouvellement ajoutée en 2026
Taille de l’imageUn côté ne doit pas dépasser 10 000 pixelsPhotos haute résolution et scansLe nombre total de pixels doit être inférieur à 75 M.
Résolution recommandéeUnilatéral de 1 000 à 2 000 pixels ou au moins 100 DPIBillets et formulaires ordinairesLe texte doit être lisible.
Formats courantsJPEG, PNG, PDFImages et documentsLa liste au format complet est déterminée par l’espace de travail.
Mode asynchroneRécupérer les résultats après le retour de la tâcheTemps de traitement plus long ou traitement en lotUne fois les résultats obtenus, le fichier est supprimé selon les règles.

À qui s’adresse-t-il

  • Équipe financière et comptable : saisie en masse de factures, de reçus, d’extraits bancaires et de documents fiscaux.
  • Équipe de vente au détail et d’opérations : gestion des commandes d’achat, des registres de stock, des bons de livraison et des factures des magasins.
  • Entreprise de logistique : extraction des champs clés à partir des bons de transport, des justificatifs d’adresse et des documents de livraison.
  • Service des ressources humaines : organisation des CV, formulaires de demande, fiches de paie et pièces d’identité.
  • Équipe juridique et de conformité : création d’un index structuré des contrats, des licences et des dates d’expiration.
  • Développeur de logiciels : intégrer la reconnaissance de documents via une API dans un CRM, un ERP ou son propre flux de travail.
  • Équipe d’applications mobiles : Intégration du scan de documents dans des applications Android, iOS ou Flutter.

Scénarios d'utilisation typiques

  • Convertir les factures des fournisseurs reçues par e-mail ou via l’interface de téléchargement en données de comptes à payer.
  • Extraire les détails des transactions à partir des flux bancaires, puis entrer dans le processus de rapprochement et de classification.
  • Identifier les reçus de remboursement et contrôler les risques grâce aux signaux de fraude, aux règles de montant et à une vérification manuelle.
  • Guider l’utilisateur pour qu’il prenne en photo ses pièces d’identité dans l’application de création de compte ou d’embauche, et vérifier la qualité de l’image.
  • Découper un PDF long en différents types de documents, et extraire séparément les champs et les tableaux.
  • Connecter les disques cloud, l’e-mail, la plateforme et les systèmes métier associés via Zapier ou n8n.
  • Utiliser la mise en correspondance par code interne pour unifier les noms des fournisseurs, des comptes, des produits ou des magasins.

Avantages du produit

  • Il propose en même temps des modèles pré-entraînés, des extracteurs personnalisés et un feedback continu, sans se limiter au texte OCR général.
  • Un pipeline complet couvrant le contrôle de qualité, la classification et le décomposition, ainsi que le JSON structuré et la mise en correspondance du code.
  • Le plan payant à l’usage n’a pas d’engagement minimum et convient pour valider d’abord avec des échantillons réels.
  • Starter est disponible en version publique avec 3 000 pages, 20 exemples de Smart Learning et des fonctionnalités avancées.
  • Prend en charge la synchronisation, l’asynchrone et les chemins de fichiers volumineux, et peut gérer des images une page et des PDF longs.
  • Fournit des zones de traitement aux États-Unis, à Taïwan et à Singapour, et prend en charge les négociations pour le cloud privé des entreprises.
  • Disponible avec des API et des composants de scan mobile pour Android, iOS et Flutter.
  • La plateforme affirme être certifiée conforme à ISO 27001 et SOC 2 Type II.

Restrictions d'utilisation et précautions

  • Le taux de précision de l’identification dépend de la qualité du document, du format, des définitions des champs et de la langue ; les indicateurs marketing ne doivent pas être considérés comme des promesses.
  • Les exemples officiels indiquent que les champs généraux peuvent représenter plus de 90 % dans des images de haute qualité, mais il ne s’agit pas d’un SLA uniforme.
  • Le plan standard payant ne comprend pas de fonctionnalités avancées ; la classification, les tableaux, la mise en correspondance des codes, etc., nécessitent le plan Starter ou l’offre entreprise.
  • La page de tarification utilise à la fois une indication par page et une indication par appel ; l’unité de facturation pour les grands fichiers multicouches doit être confirmée par écrit au préalable.
  • Les limites de taille des interfaces traditionnelles et des ports d’upload de grande capacité diffèrent ; il est donc nécessaire de choisir le bon chemin lors de l’intégration.
  • Les fichiers synchronisés ne sont pas conservés de manière permanente, tandis que les fichiers asynchrones sont chiffrés temporairement ; le document principal et les échantillons d’entraînement sont stockés.
  • Le fait que la région de traitement soit optionnelle ne signifie pas que tous les sous-traitants et appels de modèles restent nécessairement dans la même région.
  • Les services ne doivent pas être utilisés directement pour des décisions automatisées susceptibles de mettre en danger des vies, l’environnement ou des infrastructures essentielles.
  • Les environnements Beta, d’essai gratuit, de prévisualisation et de clés non productives ne sont pas couverts par un SLA payant.
  • La sortie API doit faire l’objet d’une vérification manuelle et d’une validation métier, en particulier pour les champs de montant, d’identité et de contrat.

Prix et forfaits

PlanPrixPériode de facturationPlafond et avantagesAdéquat pour les utilisateurs
Essai gratuitLes 100 premières pages sont gratuitesEssai gratuit uniqueUtilisé pour les espaces de travail ou les essais d’API ; appelés alternatifs de la page pour les 100 premières requêtesVérification conceptuelle et tests d’échantillons
Pay-as-you-goÀ partir de 0,30 $/pageÀ la demandeAucune engagement minimum, sans fonctionnalités avancéesTraitement à basse fréquence ou unique
Starter299 $/mois/extraiteurMonthly3 000 pages par mois, 0,10 dollar/pause pour les dépassements, 20 exemples de Smart Learning et fonctionnalités avancéesPetites entreprises et processus stables
EnterpriseCotation sur mesureDispositions contractuellesToutes les fonctionnalités de Starter, SLA personnalisé, gestionnaire client, support en ligne et cloud privéHaute capacité de traitement, conformité et déploiement complexe

La date de vérification du prix est le 22 août 2026, et le prix indiqué ne comprend pas les taxes. Les frais des services peuvent être ajustés après une notification 30 jours à l’avance ; l’abonnement se renouvelle automatiquement par défaut, l’annulation prend généralement effet à la fin du cycle en cours, et aucun remboursement n’est accordé pour les cycles déjà payés.

Comparaison des fonctionnalités des forfaits

CapacitéÀ la demandeStarterEnterprise
Essai des 100 premières pagesSoutienOn peut d’abord essayer.Pouvant être vérifié par démonstration ou contrat
Engagement minimumAucun299 $/mois/extraiteurConformément au contrat
Nombre de pages inclusTraiter selon les réalités3 000 pages/moissur mesure
Prix unitaire excédentaireÀ partir de 0,30 $/page0,10 dollar/feuillesur mesure
Tableaux avancés, séparation et classificationNon inclusContientContient
Cartographie du code IA et détection de la fraudeNon inclusContientContient
Accuracy CenterNon inclusContientContient
SoutienRessources conventionnellesForum communautaireGestionnaire de compte et support en ligne
SLAAucune promesse de personnalisationSLA général payantPersonnalisable
Cloud privéNon fourniNon inclusNégociable

Débit, latence et précision

IndicateurRéférence publiqueNature de l’engagementConseils d'utilisation
Débit des opérations courantesAu moins 180 fois par minute en l’absence de détails du produitLes questions-réponses sur la tarification servent de référence pour le plan d’affaires, sans SLA.Utiliser des tests de charge en parallèle réels
Taux de traitement avec détail des produitsAu moins 30 fois/minutePas d’engagement SLATableau d’évaluation et complexité des éléments de ligne
Retard dans le traitement des reçusGénéralement de 4 à 8 secondes, sans téléchargementSans SLAMesurer la taille du fichier et le réseau régional
Taux de précision des champs générauxRéférence client d’au moins environ 70 %Garantie non unifiéeMesure par champ et ensemble d’échantillons
Champs courants pour des images de haute qualitéLa date, l’heure et le montant peuvent dépasser 90 %.Référence aux retours clientsNe peut pas être extrapolé à tous les champs
Disponibilité mensuelle payante99.95%SLA généralIl y a de nombreuses exclusions et il faut demander activement des points.

Le taux de précision doit être défini en fonction des champs métier, des canaux de documents et du coût des erreurs. La moyenne globale peut masquer un faible taux de précision pour des champs clés tels que le numéro de facture, le montant ou le numéro d’identité ; il convient donc d’établir des seuils séparés ainsi que des contrôles manuels.

SLA et points de service

Le SLA général du plan payant garantit une disponibilité de 99,95 % par mois. Les interventions de maintenance planifiées sont généralement annoncées avec 48 heures d’avance, et ne dépassent pas 12 heures par an. En cas de non-respect de ces objectifs, le client doit faire une demande explicite ; des points de service équivalant à 10 % du montant du mois seront alors appliqués.

ProjetRèglesRestrictions
Disponibilité mensuelle99.95%Sans maintenance planifiée et sans incidents de dépannage
Avis de maintenance prévue48 heures à l’avancePlanifier un entretien d’au plus 12 heures par an
Indemnisation en cas de non-respect des normesPoints de service correspondant à 10 % des frais du moisSans espèces, demande du client requise
Essai et BetaSLA non applicableLes versions gratuites, les prévisualisations et l’accès anticipé sont exclus.
Clé non productiveSLA non applicableExclusion du sandbox ou de l’environnement non productif
Engagement de l’entreprisePersonnalisableIl faut écrire une offre ou un contrat

API et sortie structurée

L’interface d’extraction est authentifiée via un token d’accès et utilise l’identifiant de l’extrait pour sélectionner la configuration de reconnaissance. Les résultats réussis sont retournés sous forme JSON, ce qui permet de les mapper vers des ERP, des CRM, des bases de données, des systèmes d’approbation ou des plateformes automatisées.

Les tâches longues peuvent être configurées en mode asynchrone : le système renvoie d’abord l’identifiant de la tâche, puis le client consulte les résultats. L’intégration en production nécessite de gérer les quotas, l’expiration des tâches, les soumissions répétées, les échecs partiels et les modifications des versions des résultats.

SDK mobile

ComposantPlateformeExigences minimales ou étatUtilisation principale
SDK FormX natifAndroid et iOSIl y a des références et des exemples publicsDétection de documents, prise de vue et numérisation mobile
Flutter SDKAndroidSDK 26 et ultérieursVue de la caméra native dans les applications multiplateformes
Flutter SDKiOSiOS 14 et ultérieursAppeler les capacités de scan d’iOS dans Flutter
Flutter Desktop et WebmacOS, Windows, Linux, WebNon pris en charge actuellementOn ne peut pas supposer que l’emballage mobile puisse être directement adapté à ces plateformes.
Application d’exemple de scan par IAAndroidDémonstration publique de l’applicationExpérience de la prise de photo du reçu, de sa reconnaissance et du partage des résultats

L’SDK mobile vise principalement à améliorer l’affichage dans l’objectif de la caméra, la détection des documents et l’expérience de collecte ; l’extraction des champs réels reste cependant dépendante du service FormX et des paramètres du projet. Lors de l’obtention des droits d’accès à la caméra, il faut fournir une description claire de son utilisation et éviter d’enregistrer les tokens d’accès en code dans le client.

Mode d’intégration

MéthodeScénarios adaptésSortie ou connexionPrécautions à prendre
Espace de travail WebConfiguration et test du personnel commercialRésultats de visualisation et ensemble de donnéesLe document principal et les échantillons d’entraînement peuvent être enregistrés
API de synchronisationProcessus une page et faible latenceRetourner immédiatement au JSONRestreint par le délai de la demande et la taille du corps de la demande à 10 MB
API asynchroneTâches longues et traitement par lotsIdentifiant de la tâche + recherche des résultatsIl faut gérer l’expiration des tâches et les tentatives de réessai
API de téléchargement en grand volumeJusqu’à 500 MB, 1 000 pagesRésultats de structuration de documents à plusieurs pagesLes règles de facturation par page doivent être confirmées
SDK mobileCollecte mobile et contrôle de qualitéPhoto ou résultat de scanLes niveaux de compatibilité avec Android, iOS et Flutter diffèrent.
Zapier et n8nWorkflow à faible codeRelier les canaux de fichiers aux applications métierLes justificatifs, les tentatives de réessai et les données sensibles doivent être contrôlés.

Confidentialité, sauvegarde des fichiers et entraînement

Type de donnéesRègles de sauvegardeEntraînement ou utilisationMesures utilisateur
Extraction de fichiers via l’API de synchronisationNe pas entrer dans le stockage permanentUtilisé pour effectuer ce retraitIl faut toujours contrôler les champs sensibles et les journaux.
Fichier API asynchroneStockage temporaire chiffré, résultat récupéré ou supprimé à l’expiration de la tâcheUtilisé pour exécuter des tâches asynchronesRécupérer les résultats en temps opportun et vérifier la date d’expiration
Document principal de l’espace de travailSera sauvegardéUtilisé pour la configuration des utilisateurs et les servicesProcédure de suppression claire et durée de conservation
Échantillons d’entraînement pour le modèle personnaliséSera sauvegardéModèles personnalisés pour les demandes des clientsDésensibiliser et restreindre les droits de l’équipe
Informations sur le compte et l’équipeConservation avant suppression du compteConnexion, facturation, support et opérationsLe contenu partagé sera traité séparément lors de la suppression du compte.
Utilisation d’activités et de métadonnéesConserver pendant la durée nécessaireAmélioration des produits, analyse et sécuritéExiger des journaux d’entreprise et des instructions de conservation
Entraînement des modèles génératifsEn principe, il n’est pas utilisé pour la formation destinée à d’autres clients.Seules les exceptions telles que l’accord écrit, la prestation de services à ces clients ou des exigences légales.Vérifier les exceptions et l’anonymisation dans le DPA

Les données peuvent être hébergées et traitées aux États-Unis, à Taïwan ou à Singapour, et la plateforme fait également appel à des sous-traitants pour l’hébergement cloud, l’inférence IA, les paiements, l’observabilité et l’analyse. Avant de choisir la région du projet, il convient de vérifier le DPA, l’emplacement des sous-traitants et les mécanismes de transfert transfrontalier.

  • Inclure la synchronisation, l’asynchrone, le document principal de l’espace de travail et les échantillons d’entraînement dans la classification des données respectivement.
  • Ne téléchargez que les pages et champs nécessaires à l’achèvement de la tâche ; masquez les données si c’est possible.
  • Utilisez les droits minimaux pour l’équipe et nettoyez régulièrement les membres qui quittent l’entreprise ainsi que les tokens d’accès expirés.
  • FormX conserve les fichiers originaux et les données finales dans son propre système ; il n’est pas responsable de la sauvegarde ou de l’archivage.
  • Signer un DPA pour les données personnelles, et vérifier les sous-traitants, les régions, le chiffrement et les preuves de suppression.
  • Ne pas utiliser le service pour des décisions médicales, relatives à la sécurité de la vie ou aux infrastructures critiques qui ne nécessitent pas de révision humaine.

Sécurité et conformité

FormX affirme être conforme aux normes ISO 27001 et SOC 2 Type II, et propose des SLA généraux aux clients payants. Les entreprises qui effectuent des achats doivent néanmoins demander des rapports valables, un résumé des tests d’infiltration, des documents relatifs à la continuité d’activité ainsi que des conditions de notification en cas d’événement de sécurité.

Les clauses définissent le client comme le contrôleur de données personnelles, FormX comme le traitement, et font référence au DPA ainsi qu’à la liste des sous-traitants. Le certificat ne peut pas remplacer le contrôle d’accès, la minimisation des données et l’approbation manuelle dans les projets spécifiques.

API, GitHub et open source

FormX fournit des documents d’API publiques, des références pour les SDK Android et iOS ainsi qu’une encapsulation Flutter. Le répertoire du SDK Flutter sous l’organisation Oursky est soumis à la licence MIT et prend en charge Android SDK 26 et ultérieurs ainsi que iOS 14 et ultérieurs ; il existe également un répertoire de documents pour les SDK natifs et un répertoire d’anciens documents d’aide archivés.

La mise à disposition publique de l’SDK et des documents ne signifie pas que la plateforme FormX est open source. L’OCR, le routage des modèles, l’entraînement personnalisé, Accuracy Center, l’extraction en cloud et l’espace de travail d’entreprise restent des services hébergés propriétaires ; l’utilisation de l’SDK nécessite toujours un accès à une plateforme commerciale.

ProjetStatut publicLicence ou instructions
Plateforme cloud FormXSource ferméeServices de gestion commerciale
Extraire l’APIDocument publicCompte, jeton d’accès et crédit de paiement requis
SDK mobile natifEntrepôts publics et référencesL’entrepôt n’affiche pas dans le résumé public la licence globale de la plateforme.
Flutter SDKCode source ouvertLicence MIT
Anciens documents d’aidePublic mais archivéÀ partir du 18 avril 2024, lecture seule
Modèles personnalisés et espaces de travailSource ferméeImpossible de déployer hors ligne de manière autonome

Informations de base

ProjetContenu
Nom de l’outilFormX.ai
Entité opérationnelleSkyMakers Digital Limited
Lieu d’enregistrementAngleterre et Pays de Galles en Angleterre
Type d’outilTraitement intelligent de documents, OCR et extraction de données structurées
Entrée principaleImages, PDF, scans et documents pris sur appareil mobile
Sortie principaleJSON composé de champs, de tableaux et de métadonnées
Modèle de prixEssai de 100 pages, facturation par page, abonnement mensuel et devis pour entreprises
Faut-il s’inscrire ?La configuration, les API et l’utilisation payante nécessitent un compte.
Soutien en chinoisLa capacité de traitement doit être déterminée par des tests sur le document ; la gestion et les documents sont principalement en anglais.
Zone de traitementÉtats-Unis, Taïwan, Singapour
Plateformes principalesEspace de travail Web, API, Android, iOS et Flutter
API publiqueFournir
SDK officielAndroid, iOS et Flutter
Le produit est-il open sourcePas open source
Partie open sourceLe Flutter SDK est sous licence MIT
Âge minimum18 ans
Date de vérification du prix22 août 2026

Indice de recommandation

Indice de recommandation : 4,3 / 5. FormX.ai propose une chaîne de production assez complète, allant de la qualité des documents, de la segmentation par catégories, de l’extraction des champs et des tableaux jusqu’aux retours, aux API et à la collecte mobile ; ses prix publics ainsi que ses instructions relatives au traitement des données sont également plus détaillés que ceux de nombreux services OCR.

Le principal défaut est que Starter facture en fonction de l’extracteur, et les opérations complexes peuvent nécessiter plusieurs configurations ; il existe de grandes différences entre les fichiers volumineux et les limites des interfaces ordinaires, et il faut également confirmer les modalités de facturation par page et par appel. Les champs clés doivent toujours être vérifiés à l’aide d’échantillons réels, d’une revue manuelle et des SLA contractuels.

Questions fréquentes

À quoi sert FormX.ai ?

Il extrait des champs et des tableaux à partir de factures, de reçus, de relevés, de documents d’identité, de contrats et d’autres documents, et les fournit sous forme de JSON structuré aux workflows ou aux systèmes métier.

FormX.ai, c’est juste de l’OCR ?

Non. L’OCR n’est que la base de la reconnaissance de texte ; FormX offre en plus le classement des documents, la segmentation, des champs personnalisés, des tableaux, la mise en correspondance des codes, des retours d’information et l’intégration métier.

FormX.ai est-il gratuit ?

Une version d’essai gratuite des 100 premières pages est proposée, de même que des questions-réponses à tarif gratuit pour les 100 premières requêtes de récupération. La manière de calculer le coût pour des documents plus longs doit être confirmée avant de lancer le traitement en masse.

Combien coûte l’utilisation à la demande ?

Le forfait payant commence à 0,30 dollar par page, sans engagement minimum, mais ne comprend pas les fonctionnalités avancées. Les prix peuvent être modifiés ; les taxes et la facture finale seront basées sur le solde réel.

Qu’est-ce que le Starter contient ?

Le Starter coûte 299 dollars par mois et par extracteur, pour un total de 3 000 pages ; au-delà, il en coûte 0,10 dollar par page. Il inclut 20 exemples de Smart Learning, le Accuracy Center, la segmentation de classification, la mise en correspondance des codes et des tableaux avancés.

Quelle taille de PDF est prise en charge ?

Le nouveau processus de téléchargement en masse prend en charge jusqu’à 500 MB et 1 000 pages. Le téléchargement via le corps de la requête traditionnel reste limité à 10 MB ; il ne faut pas interpréter cette même limite pour toutes les entrées.

Quels formats de fichiers sont pris en charge ?

Les documents publics énumèrent clairement des formats courants tels que JPEG, PNG et PDF. D’autres formats, les PDF chiffrés et les encodages spéciaux doivent être testés dans le cadre du projet.

Quel est le format du résultat extrait ?

Il renvoie principalement des champs, des tableaux et des informations connexes au format JSON, ce qui facilite leur insertion dans une base de données, un ERP, un CRM ou des workflows automatisés.

Le fichier sera-t-il enregistré ?

Les fichiers extraits de manière synchrone ne sont pas stockés de façon permanente ; les fichiers asynchrones sont chiffrés temporairement et supprimés une fois que les résultats ont été récupérés ou que la tâche a expiré. Le document principal de l’espace de travail ainsi que les échantillons d’entraînement personnalisés sont conservés.

Les documents seront-ils utilisés pour entraîner des modèles publics ?

Les conditions stipulent que le contenu des clients ne sera pas utilisé pour entraîner des modèles génératifs destinés à d’autres clients ou à des tiers, sauf avec l’accord écrit préalable du client, si cela est nécessaire pour fournir et améliorer les services à ce dernier, ou en cas d’exigence légale.

Où les données sont-elles traitées ?

Lors de la création d’un projet, vous pouvez choisir la région des États-Unis, de Taïwan ou de Singapour, avec pour infrastructure GCP et Azure. Il convient néanmoins de vérifier les itinéraires transfrontaliers pour l’inférence IA et d’autres sous-processor.

Quel est le taux de précision de la reconnaissance ?

Il n’existe pas de taux de précision uniforme applicable à tous les documents. Selon les références officielles, les champs généraux peuvent atteindre plus de 70 %, tandis que les dates, les heures et les montants sur les reçus de qualité peuvent dépasser 90 %, mais il ne s’agit d’aucune promesse uniforme.

Combien de temps faut-il pour traiter une facture ?

Le temps de référence public est généralement de 4 à 8 secondes, sans compter le temps de téléchargement, et ce n’est pas non plus un SLA. La taille du fichier, le réseau, l’extraiteur ainsi que la complexité du tableau influencent tous la latence.

Y a-t-il une API ?

Fourni. Les développeurs utilisent des tokens d’accès et des identifiants d’extraction pour soumettre des documents, et peuvent choisir entre un traitement synchrone, asynchrone ou pour de gros fichiers.

Est-ce que l’accès aux applications mobiles est pris en charge ?

Il prend en charge Android, iOS et le SDK Flutter, et permet d’intégrer une vue de la caméra, la détection de documents et le flux de prise de vue. Flutter n’est actuellement pas compatible avec les plateformes Web et desktop.

FormX.ai est-il open source ?

La plateforme elle-même n’est pas open source. Le Flutter SDK est licencié sous la licence MIT ; certains SDK et dépôts de documentation sont accessibles au public, mais la reconnaissance en cloud, l’entraînement et l’espace de travail restent des services commerciaux.

Y a-t-il un SLA d’disponibilité ?

L’SLA général pour les forfaits payants est de 99,95 % par mois ; en cas de non-respect, des points de service équivalant à 10 % du montant de la facture du mois peuvent être demandés. Les environnements d’essai, Beta, prévisionnels et non productifs ne sont pas couverts par cette garantie.

Est-ce adapté aux décisions médicales ou liées à la sécurité de la vie ?

Il n’est pas adapté à une utilisation directe dans des décisions automatisées à haut risque pouvant entraîner la mort, des blessures ou des pannes d’infrastructures critiques. De tels scénarios exigent une négociation préalable d’un accord écrit distinct.

Résumé

FormX.ai convient aux équipes qui souhaitent transformer des factures, des documents d’identité, des contrats et de longs PDF en données commerciales structurées, en particulier pour les projets nécessitant des champs personnalisés, des tableaux, du scan mobile et une intégration API. Une version d’essai payante permet de définir au préalable une base de référence en termes de précision et de coûts à l’aide de documents réels.

Avant le lancement, il convient de définir clairement les restrictions de fichiers et les unités de facturation pour chaque point d’accès, de distinguer les méthodes de stockage pour la synchronisation, l’asynchrone, les documents principaux et les échantillons d’entraînement, et d’inclure dans le plan de mise en œuvre ou le contrat les seuils des champs clés, la révision manuelle, les zones de traitement, les sous-traitants, le débit et les SLA.

©️Droit d’auteur : Sauf indication contraire, tous les articles de ce site sont protégés par le droit d’auteur.Partage d’outils d’IATous les droits d’auteur sont réservés. Sans autorisation, aucune personne, média, site web ou groupe ne peut reproduire, copier ou diffuser de quelque manière que ce soit le contenu de ce site, ni créer de mirror sur des serveurs qui ne lui appartiennent pas. Dans le cas contraire, notre site se réserve le droit de poursuivre en justice les responsables conformément à la loi.

Outils similaires à FormX.ai