FormX.ai
Kostenloser Mehrwert
KI-Bürowerkzeuge KI-Dokumentenwerkzeuge

FormX.ai

FormX.ai – eine intelligente Tool für Dokumente mit KI-Technologie

Tags:

Eine kurze Beschreibung

FormX.ai ist eine intelligente Plattform für die Verarbeitung von Dokumenten. Mithilfe von vortrainierten oder anpassbaren Extraktoren kann sie Rechnungen, Quittungen, Bankauszüge, Ausweise, Verträge sowie andere Geschäftsunterlagen erkennen und diese in strukturiertem JSON-Format an Finanz-, Betriebs- oder Entwicklungsysteme liefern.

Einführung in die Tools

FormX wird von SkyMakers Digital Limited betrieben. Die Produkte umfassen den Upload von Dokumenten, die Überprüfung der Bildqualität, die Klassifizierung und Aufteilung von Inhalten, das Extrahieren von Feldern, die Erkennung von Tabellen, Korrekturvorschläge sowie API- und Mobile-Scanning-Funktionen. Das Ziel ist es nicht nur, Bilder in Text umzuwandeln, sondern vielmehr Datenpipelines zu schaffen, die in den Produktionsprozess integriert werden können.

Die Benutzer können entweder vorkonfigurierte Extraktoren wählen oder eigene Beispiele hochladen und die erforderlichen Felder definieren, um eine maßgeschneiderte Konfiguration für ein bestimmtes Format oder einen Händler zu erstellen. Die Plattform ermöglicht außerdem die Wahl zwischen visuellen Modellen und großen Sprachmodellen sowie die Reduzierung instabiler Ausgaben mithilfe von Geschäftsregeln und Beispielen.

Hauptfunktionen

Vortrainierter Dokumentextraktor

Die Plattform bietet die Möglichkeit, gängige Dokumente wie Rechnungen, Quittungen und Ausweisdokumente vorzutrainieren – geeignet für Aufgaben mit relativ standardisierten Feldern. Die Benutzer müssen keine großen Mengen an Beispielen von Grund auf annotieren, sollten jedoch den Umfang der Unterstützung für Sprachen, Formatierungen sowie regionale Ausweisdokumente überprüfen.

Custom-Extractor

Benutzer können repräsentative Beispiele hochladen, Rechnungsnummern, Daten, Beträge sowie Felder für Lieferanten oder interne Unternehmensdaten definieren und diese durch Rückmeldungen kontinuierlich anpassen. Die individuelle Konfiguration eignet sich für Dokumente mit fester Struktur, bei denen die Bedeutung der Felder speziell ist oder bei denen das Standardmodell zu Verwirrung führt.

Dokumentenklassifizierung und -Aufteilung

Split & Classify kann die Dokumenttypen in gemischten Chargen erkennen und mehrere Dateien in Einheiten für die weitere Verarbeitung aufteilen. Es eignet sich für E-Mail-Anhänge, gescannte Dateien sowie PDFs mit mehreren Dokumenten. Für abweichende Seiten und unbekannte Typen muss jedoch eine manuelle Warteschlange erstellt werden.

Erweiterte Tabellenextraktion

Die fortgeschrittene Tabellenextraktion ist für Rechnungsdetails, Bankauszüge und andere tabellarische Strukturen geeignet und kann eine Liste der Einträge liefern, anstatt nur die Überschrifffelder zu erkennen. Überschriften über mehrere Seiten, zusammengeführte Zellen, handschriftliche Änderungen sowie schlecht scanierte Dokumente können weiterhin die Ergebnisse beeinträchtigen.

Feldprüfung und Accuracy Center

Das Accuracy Center dient zum Batch-Management von Datensätzen, zur Überprüfung der Ergebnisse sowie zur Rückgabe korrekter Werte an das Modell. Produktionsdaten können dem Extraktor dabei helfen, sich schrittweise an echte Dokumente anzupassen, wobei der Feedback-Prozess durch Berechtigungsverwaltung, Maskierung und Überprüfung gesteuert werden sollte.

AI Code Mapping

Durch die AI-Code-Mapping-Funktion kann der erkannte Text mit internen Codes, Kategorien oder Standardwerten des Unternehmens abgeglichen werden, wodurch manuelle Abgleiche reduziert werden. Wenn sich die Geschäftsdaten ändern, müssen die Zuordnungsregeln entsprechend aktualisiert werden, und es sollten weiterhin Optionen für manuelle Überprüfungen bei unklaren Fällen vorhanden sein.

Betrug und AI-basierte Bilderkennung

Die Liste der Starter- und Unternehmensfunktionen umfasst die Erkennung von Betrug sowie künstlichen Bildern, die als Risikosignale für Prozesse wie Rechnungsstellung, Ansprüche oder Dokumentenerstellung dienen können. Sie sollte nicht als endgültige Entscheidung bezüglich eines Betrugs angesehen werden; wichtige Entscheidungen erfordern die Berücksichtigung der ursprünglichen Unterlagen, Geschäftsunterlagen sowie einer manuellen Prüfung.

Überprüfung der Bildqualität

Die Funktionen für mobile Scannung und AI-Scanning ermöglichen es, vor dem Hochladen Unklarheiten, Lichtverhältnisse, unkorrekte Schnitte oder Probleme an den Rändern der Dokumente zu überprüfen – dadurch wird die Menge an minderwertigen Eingaben verringert. Die Qualität eines Dokuments bedeutet jedoch nicht automatisch, dass alle Felder korrekt sind; daher müssen für wichtige Betrags- und Identifikationsfelder immer noch Schwellenwerte für die Zuverlässigkeit festgelegt werden.

Kombination von visuellen Modellen und großen Sprachmodellen

FormX ermöglicht es, je nach Dokumenttyp, Verzögerungszeiten und Genauigkeitsanforderungen zwischen visuellen Modellen und großen Sprachmodellen zu wechseln oder diese zu kombinieren, wobei der Fokus auf der Reduzierung von Illusionen durch Einschränkungen liegt. Die konkreten zugrunde liegenden Modelle, die Verfügbarkeit in bestimmten Regionen sowie die Kosten können je nach Projektkonfiguration variieren.

Großangelegte PDF-Verarbeitung

Im Jahr 2026 werden neue Upload-Schnittstellen sowie Arbeitsabläufe für große Dateien hinzugefügt, mit denen Dokumente von bis zu 500 MB und 1.000 Seiten verarbeitet werden können. Die herkömmliche Schnittstelle zur Extraktion einzelner Bilder hat weiterhin eine Grenze von 10 MB für den Anfrageinhalt; diese beiden Schnittstellen unterliegen nicht derselben Beschränkung.

Verarbeitbare Dokumente

DokumentkategorieRepräsentative DokumenteHäufige FelderAnwendungsfallen
FinanzdokumenteRechnungen, Quittungen, SteuerdokumenteNummer, Datum, Lieferant, Steuerbetrag, GesamtbetragForderungen, Abrechnungen und Prüfungen
Banken und BuchhaltungBankauszüge, JahresberichteKonto, Transaktionsdatum, Zusammenfassung, Betrag des Geliehens und DesolventenAbrechnung, Cashflow und Buchführung
Identität und QualifikationenPersonalausweis, Reisepass, Genehmigungen, ZertifikateName, Nummer, Gültigkeitsdauer, AusstellungsstelleKontoeinrichtung, Einstellung und Konformitätsprüfung
Einkauf und LogistikBestellformulare, Lieferbescheinigungen, FrachtunterlagenBestellnummer, Material, Menge, Adresse, StatusBestände, Lieferung und Lieferkette
PersonalressourcenLebenslauf, Antragsformulare, Arbeitsvertrag, LohnaufzeichnungenMitarbeiter, Erfahrungen, Positionen, Daten, BeträgeRekrutierung, Einstellung und Aktenverwaltung
Recht und GeschäftVerträge, Vertraulichkeitsabkommen, GeschäftslizenzenSubjekt, Bestimmungen, Fristen, Verpflichtungen und NummernVertragsregistrierung und Ablaufhinweise
KundenserviceGarantieverfahren, Support-Anfragen, ServiceverträgeKunden, Produkte, Probleme und BearbeitungsstatusAnspruchs- und Serviceautomatisierung

Vollständiger Arbeitsablauf

  1. Wählen Sie Beispieldokumente aus, die das tatsächliche Layout, die Sprache, die Qualität sowie Ausreißer abdecken.
  2. Wählen Sie im Arbeitsbereich einen vorgefertigten Extraktor aus oder erstellen Sie einen benutzerdefinierten Extraktor und definieren Sie die Felder.
  3. Laden Sie ein Beispiel hoch, markieren Sie die korrekten Werte, die Tabellenaufbau sowie den Inhalt, der ignoriert werden soll.
  4. Nutzen Sie den Testdatensatz, um die Genauigkeit auf Feldebene zu bewerten – schauen Sie sich nicht nur eine kleine Anzahl an erfolgreichen Beispielen an.
  5. Konfiguration von Klassifizierung, Aufteilung, Überprüfung, Code-Abgleich, Vertrauensschwellenwerten und manueller Überprüfung.
  6. Dateien werden über die Arbeitsbereich oder API zugänglich gemacht, und strukturiertes JSON wird an das Geschäftssystem übermittelt.
  7. Regelmäßige Erfassung von Fehlfällen und Feedbacks, Überwachung von Layout-Abweichungen, Verzögerungen, Kosten und Ausfallraten.

Leitfaden zur Erstellung eines benutzerdefinierten Extraktors

  1. Registrieren Sie ein Konto und erstellen Sie ein Projekt; wählen Sie gemäß den Compliance-Anforderungen den Verarbeitungsbereich in den USA, Taiwan oder Singapur aus.
  2. Erstellen Sie einen neuen Extraktor für ein Geschäftsdokument, um zu vermeiden, dass Dateien mit zu großen Unterschieden in derselben Konfiguration abgelegt werden.
  3. Definieren Sie den Feldnamen, den Datentyp, ob das Feld erforderlich ist und die zulässigen Formate.
  4. Laden Sie repräsentative Beispiele hoch und überprüfen Sie den Umfang, in dem die Plattform diese Trainingsdateien speichert.
  5. Jedes Feld und jede Tabelle wird einzeln korrigiert, um Unklarheiten, Rotationen, leere Werte, Überschreiten von Seiten sowie unterschiedliche Formatierungen der Lieferanten zu beseitigen.
  6. Berechnen Sie mit einem unabhängigen Testdatensatz die Genauigkeit, die Fehlerrate bei Auslassungen und die Fehlerrate bei Fehlern für jedes Feld.
  7. Nach Erreichen des Geschäfts-Schwellenwerts wird die Konfiguration veröffentlicht, wobei Rückroll- und manuelle Überprüfungspläne beibehalten werden.

API-Anbindungstutorial

  1. Erstellen Sie einen Extraktor in der Web-Arbeitsbereich und holen Sie sich vom Dashboard die Identifikationsdaten sowie den Zugriffstoken für den Extraktor.
  2. Wählen Sie je nach Dateigröße und Dauer den Synchronisierungsmodus, den Asynchronmodus oder die Übertragungsmethode für große Dateien.
  3. Geben Sie die Anfrage über eine Datei oder die Adresse einer kontrollierten Datei ein und geben Sie die richtige Extraktor-Identifikation an.
  4. Synchronanfragen lesen die Ergebnisse direkt ab; asynchrone Anfragen speichern die Aufgabenidentifikation und prüfen in Abständen den Status der Ergebnisse.
  5. Analyse der Felder, Tabellen, Zuverlässigkeitswerte und Fehlermeldungen im JSON und anschließende Zuordnung zum Geschäftsdatenmodell.
  6. Fügen Sie Zeitüberschreitung, Idempotenz, verzögerte Wiederholungsversuche, Quotenverwaltung, Log-Demaskierung und eine Fehlerwarteschlange hinzu.
  7. Vor dem Go-Live werden Genauigkeit, Verzögerung, Durchsatz und Kosten pro Seite der echten Dateien gemessen.

Umfassende Anleitung zur Verarbeitung von PDF-Dateien

  1. Zuerst prüfen Sie die Anzahl der Seiten des Dokuments, die Dateigröße, ob es verschlüsselt ist und ob die Seite mehrere Dokumente enthält.
  2. Für Dateien mit einer Größe von bis zu 500 MB oder 1.000 Seiten wird der Prozess zum Hochladen großer Dateien verwendet – es sollte nicht der Request-Body für einzelne Bilder mit 10 MB verwendet werden.
  3. Aktivieren Sie Klassifizierung und Aufteilung, um gemischte Dokumente an die entsprechenden Extraktoren zuzuweisen.
  4. Verwenden Sie asynchrone Aufgaben, um lange Anfragen vor Ablauf der Frist zu vermeiden, und speichern Sie die Aufgabenerkennung, um Abfragen wieder aufzunehmen.
  5. Überprüfen Sie nach Seite und Dokument auf fehlende Seiten, falsche Reihenfolge, wiederholte Seiten, Tabellen, die über Seiten gehen, sowie fehlerhafte Seiten.
  6. Nachdem bestätigt wurde, dass die Ergebnisse in das eigene System gespeichert wurden, sollten die Dateien der Arbeitsumgebung gemäß der Datensicherheitsrichtlinien gelöscht werden.

Dateien, Größen und Anschlussbeschränkungen

Eingang oder ProjektOffene Einschränkungen oder EmpfehlungenGeeignete SituationenHinweise
Übertragung eines traditionellen AnfragekörpersEinzelne Bilddateien bis zu 10 MBEinzelbild oder kleines PDFWenn die Grenze überschritten wird, sollte eine andere Methode zum Hochladen verwendet werden.
Eingabe der Datei-AdresseLaut dem Dokument gibt es keine ähnlichen Beschränkungen hinsichtlich der Dateigröße.Es gibt bereits kontrollierte Objektspeicherung.Die Berechtigungen für Links sowie ihre Gültigkeitsdauer müssen kontrolliert werden.
Großer Upload-ProzessMaximal 500 MB, 1.000 SeitenAusführliche Berichte und Massenscannen von PDFsZu den neuen Eingängen im Jahr 2026
BildgrößeEinzelseite nicht mehr als 10.000 PixelHochauflösende Fotos und ScansDie Gesamtzahl der Pixel muss unter 75 M liegen.
Empfohlene AuflösungEindeutig 1.000 bis 2.000 Pixel oder mindestens 100 DPIAllgemeine Belege und FormulareDer Text muss lesbar sein.
Häufige FormateJPEG, PNG, PDFBilder und DokumenteDie vollständige Formatliste richtet sich nach der Arbeitsumgebung.
Asynchroner ModusErgebnisse nach Rückkehr der Aufgabe abrufenLängere Dauer oder Batch-VerarbeitungNach Erhalt des Ergebnisses werden die Dateien gemäß den Regeln gelöscht.

Für welche Benutzer geeignet

  • Finanz- und Buchhaltungsteam: Masseneingabe von Rechnungen, Quittungen, Bankauszügen und Steuerdokumenten.
  • Vertrieb- und Betriebsteam: Bearbeitung von Einkaufsaufträgen, Lagerbestandsaufzeichnungen, Lieferbescheinigungen und Ladenergebnisse.
  • Logistikunternehmen: Extrahieren von Schlüsselfeldern aus Frachtpapieren, Adressnachweisen und Lieferdokumenten.
  • Personalabteilung: Organisation von Lebensläufen, Antragsformularen, Lohnunterlagen und Ausweisdokumenten.
  • Rechts- und Compliance-Team: Erstellung eines strukturierten Index für Verträge, Lizenzen und Gültigkeitsdaten.
  • Softwareentwickler: Über APIs wird die Dokumentenerkennung in CRM-, ERP-Systeme oder eigene Workflows integriert.
  • Mobile-App-Team: Einbetten von Dokumentenscannern in Android-, iOS- oder Flutter-Apps.

Typische Anwendungsszenarien

  • Konvertieren Sie die von der E-Mail-Adresse oder dem Upload-Portal eingegangenen Rechnungen der Lieferanten in Daten zu Forderungen.
  • Die Transaktionsdetails werden aus den Bankabrechnungen extrahiert und anschließend dem Abgleichs- und Klassifizierungsprozess zugeführt.
  • Identifizieren Sie die Rechnungen für Rückerstattungen und kontrollieren Sie das Risiko durch Anzeichen von Betrug, Betragsregeln sowie manuelle Überprüfungen.
  • In den Apps für die Eröffnung eines Kontos oder der Arbeitsaufnahme leitet man die Nutzer an, Ausweisdokumente aufzunehmen und die Bildqualität zu überprüfen.
  • Teilen Sie das lange PDF in verschiedene Dokumenttypen auf und extrahieren Sie jeweils Felder und Tabellen.
  • Verbinden Sie Cloud-Speicher, E-Mails, Workbenches sowie weitere Geschäftssoftware über Zapier oder n8n.
  • Verwenden Sie interne Codes, um Lieferanten, Konten, Produkt- oder Filialnamen zu standardisieren.

Vorteile des Produkts

  • Gleichzeitig werden vortrainierte Modelle, benutzerdefinierte Extraktoren und kontinuierliche Rückmeldungen bereitgestellt, nicht beschränkt auf allgemeine OCR-Texte.
  • Von der Qualitätskontrolle und Klassifizierung über die Aufteilung bis hin zu strukturiertem JSON sowie einer umfassenden Code-Übersetzung – ein recht vollständiger Prozesspfad.
  • Das Pay-as-you-go-Modell hat keine Mindestverpflichtung und eignet sich, um zunächst mit echten Proben zu testen.
  • Der Starter enthält offiziell 3.000 Seiten, 20 Smart-Learning-Beispiele sowie fortgeschrittene Funktionen.
  • Unterstützt Synchronisierung, Asynchronisierung sowie große Dateipfade; kann Einzelbildern und langen PDF-Dateien verarbeiten.
  • Es werden Verarbeitungsbereiche in den USA, Taiwan und Singapur bereitgestellt, und es wird die Abstimmung von Unternehmens-Private-Cloud-Lösungen unterstützt.
  • Verfügt über API sowie mobile Scann-Komponenten für Android, iOS und Flutter.
  • Die Plattform behauptet, die Zertifizierungen ISO 27001 und SOC 2 Type II zu besitzen.

Einsatzbeschränkungen und Hinweise

  • Die Genauigkeit der Erkennung hängt von der Qualität des Dokuments, der Formatierung, der Definition der Felder sowie der Sprache ab. Marketing-Kennzahlen sollten nicht als Zusagen angesehen werden.
  • Laut offiziellen Beispielen können die Anteile der regulären Felder in hochwertigen Bildern über 90 % betragen, doch es handelt sich dabei nicht um einen einheitlichen SLA.
  • Die einfache Pay-as-you-go-Lösung beinhaltet keine fortgeschrittenen Funktionen; Kategorisierung, Tabellen, Code-Übersetzungen usw. erfordern die Starter- oder Unternehmenslösung.
  • Auf der Preisseite werden sowohl die Angaben pro Seite als auch die Angaben pro Aufruf verwendet; die Abrechnungseinheit für große, mehrseitige Dokumente muss vorher schriftlich festgelegt werden.
  • Die Größenbeschränkungen für traditionelle Schnittstellen und große Upload-Portale unterscheiden sich, daher muss beim Integrieren der richtige Pfad gewählt werden.
  • Synchronisierte Dateien werden nicht dauerhaft gespeichert, asynchrone Dateien werden vorübergehend verschlüsselt aufbewahrt; das Hauptdokument sowie die Trainingsbeispiele werden gespeichert.
  • Dass der Verarbeitungsbereich optional ist, bedeutet nicht, dass alle Unterverarbeiter und Modellaufrufe notwendigerweise im selben Gebiet angesiedelt sind.
  • Die Dienste dürfen nicht direkt für automatische Entscheidungen verwendet werden, die ein Risiko für Leben, die Umwelt oder wichtige Infrastrukturen darstellen können.
  • Beta-, kostenlose Test-, Vorschau- und nicht-produktive Schlüsselumgebungen sind nicht durch eine gebührenpflichtige SLA abgesichert.
  • Die API-Ausgaben müssen einer manuellen Überprüfung sowie einer betriebsinternen Validierung unterzogen werden, insbesondere bei den Feldern für Beträge, Identitätsdaten und Vertragsinformationen.

Preise und Pakete

PlanPreisAbrechnungszeitraumLimit und VorteileFür Nutzer geeignet
Kostenloser ProbemonatDie ersten 100 Seiten sind kostenlos.Einmalige TestnutzungFür den Einsatz in Arbeitsbereichen oder zur Testung von APIs; Seitenaufrufe werden bis zu 100 Mal kostenlos angeboten.Konzeptvalidierung und Probentests
Pay-as-you-goAb 0,30 US-Dollar pro SeiteNach BedarfKeine Mindestverpflichtung, ohne erweiterte FunktionenNiedrigfrequenter oder einmaliger Prozess
Starter299 US-Dollar/Monat/ExtraktorMonatsgebühr3.000 Seiten pro Monat; für jede zusätzliche Seite fallen 0,10 US-Dollar an. 20 Smart-Learning-Beispiele sowie fortgeschrittene Funktionen.Kleine Unternehmen und stabile Prozesse
EnterpriseIndividuelle KostenschätzungVertragsvereinbarungenAlle Funktionen von Starter, maßgeschneiderte SLAs, Kundenservice, Betriebsunterstützung und Private CloudHohe Durchsatzrate, Konformität und komplexe Implementierung

Das Datum der Preisüberprüfung ist der 22. August 2026. Der angegebene Preis beinhaltet keine Steuern und Abgaben. Die Kosten für die Dienstleistungen können mit 30 Tagen Vorlaufzeit geändert werden; die Abonnementverlängerung erfolgt standardmäßig automatisch. Eine Kündigung wird in der Regel am Ende der aktuellen Laufzeit wirksam. Für bereits bezahlte Laufzeiten wird grundsätzlich kein Rückzahlung gewährt.

Vergleich der Funktionen der Pakete

FähigkeitenNach BedarfStarterEnterprise
Probelauf der ersten 100 SeitenUnterstützungMan kann es erst einmal ausprobieren.Kann durch Demonstration oder Vertrag überprüft werden
MindestverpflichtungKeines299 US-Dollar/Monat/ExtraktorGemäß Vertrag
Anzahl der SeitenNach tatsächlicher Bearbeitung3.000 Seiten/MonatMaßanfertigung
Überhöhter EinzelpreisAb 0,30 US-Dollar pro Seite0,10 US-Dollar/SeiteMaßanfertigung
Erweiterte Tabellen, Aufteilen und KlassifizierenNicht enthaltenEnthältEnthält
AI-Code-Mapping und BetrugserkennungNicht enthaltenEnthältEnthält
Accuracy CenterNicht enthaltenEnthältEnthält
UnterstützungÜbliche RessourcenCommunity-ForumKundenservice und Support im Betrieb
SLAKeine AnpassungsversprechenBezahlte allgemeine SLAAnpassbar
Private CloudNicht verfügbarNicht aufgeführtVerhandelbar

Durchsatz, Verzögerung und Genauigkeit

IndikatorenÖffentliche ReferenzenArt der VerpflichtungEmpfehlungen zur Verwendung
Übliche GeschäftsbelastungOhne Produktdetails mindestens 180 Mal pro MinutePreisfragen dienen als Referenz für Geschäftspläne, es gibt kein SLA.Mit echtem parallelem Belastungstest
Durchsatz mit ProduktdetailsMindestens 30 Mal pro MinuteKeine SLA-ZusagenBewertungstabelle und Komplexität der Zeileinträge
Verzögerung bei der Bearbeitung der QuittungenIn der Regel 4 bis 8 Sekunden, ohne HochladenNicht SLAMessung der Dateigröße und des regionalen Netzwerks
Allgemeine Genauigkeit der FelderKundenreferenzen von mindestens etwa 70%Nicht einheitliche GarantienMessung nach Feldern und Stichprobenmengen
Häufige Felder für hochwertige BilderDatum, Zeit und Betrag können 90 % überschreiten.Referenzen zu KundenfeedbackNicht auf alle Felder übertragen möglich
Monatliche Verfügbarkeit gegen Bezahlung99.95%Allgemeine SLAEs gibt viele Ausschlusskriterien und man muss aktiv Punkte beantragen.

Die Genauigkeit muss nach Geschäftsfeldern, Dokumentenkanälen und den Kosten für Fehler definiert werden. Der Durchschnittswert kann eine geringe Genauigkeit bei wichtigen Feldern wie Rechnungsnummern, Beträgen oder Personalausweisnummern verbergen; daher sollten jeweils Schwellenwerte festgelegt sowie eine manuelle Überprüfung durchgeführt werden.

SLA und Servicepunkte

Das Pay-as-you-go-Plan bietet eine SLA-Garantie von 99,95 % Verfügbarkeit pro Monat. Wartungsarbeiten werden in der Regel 48 Stunden im Voraus angekündigt; pro Jahr dürfen insgesamt maximal 12 Stunden für Wartungsarbeiten eingesetzt werden. Wenn diese Ziele nicht erreicht werden, muss der Kunde einen Antrag stellen – in diesem Fall beträgt der Betrag 10 % der monatlichen Gebühren.

ProjektRegelnEinschränkungen
Monatliche Verfügbarkeit99.95%Ohne geplante Wartungsarbeiten und Störbehebungen
Planmäßige Wartungshinweise48 Stunden im VorausJährlich sind maximal 12 Stunden Wartungsarbeiten geplant.
Entschädigung bei Nichterfüllung der Vorgaben10% Service-Punkte für die Kosten des MonatsNicht bar, der Kunde muss einen Antrag stellen.
Testen und BetaKein SLA gültigKostenlos, Vorschau und Early Access sind ausgeschlossen.
Nicht-produktive SchlüsselKein SLA gültigAusklammern von Sandbox- oder Nicht-Produktionsumgebungen
UnternehmensversprechenAnpassbarEs muss ein Angebot oder Vertrag erstellt werden.

API und strukturierte Ausgabe

Die Extraktions-Schnittstelle wird über ein Zugriffstoken authentifiziert und verwendet einen Extraktor-Identifikator zur Auswahl der Erkennungskonfiguration. Das erfolgreiche Ergebnis wird als JSON zurückgegeben, was eine Zuordnung zu ERP-, CRM-, Datenbank-, Genehmigungssystemen oder Automatisierungsplattformen ermöglicht.

Für zeitaufwändige Aufgaben kann der asynchrone Modus aktiviert werden: Das System gibt zunächst die Identifikation der Aufgabe zurück, und der Client fragt anschließend nach den Ergebnissen. Bei der Integration in die Produktion müssen Quoten, Ablaufdaten der Aufgaben, mehrfache Einreichungen, lokale Fehler sowie Änderungen bei den Ergebnisversionen berücksichtigt werden.

Mobile SDK

KomponentenPlattformMindestanforderungen oder ZuständeHauptverwendungszweck
Ursprüngliches FormX SDKAndroid und iOSEs gibt offene Referenzen und Beispiele.Dokumentenerkennung, Fotografieren und mobile Scannung
Flutter SDKAndroidSDK 26 und höherDie native Kameravorschau in plattformübergreifenden Anwendungen
Flutter SDKiOSiOS 14 und neuerAnrufung der Scannfunktionen von iOS in Flutter
Flutter Desktop und WebmacOS, Windows, Linux, WebDerzeit nicht unterstützt.Man darf nicht annehmen, dass mobile Pakete direkt auf diese Plattformen übertragen werden können.
Beispielanwendung für AI-ScanningAndroidOffene AnwendungspräsentationErleben Sie das Fotografieren von Quittungen, deren Erkennung sowie den Austausch der Ergebnisse.

Das Mobile SDK löst hauptsächlich die Probleme im Zusammenhang mit der Kamerabetrachtung, der Erkennung von Dokumenten sowie der Erfassung von Inhalten. Die tatsächliche Extraktion der Daten hängt weiterhin von den FormX-Diensten sowie der Konfiguration des Projekts ab. Bei der Anforderung von Zugriffsrechten auf die Kamera muss eine klare Beschreibung des Zwecks angegeben werden. Zudem sollte man vermeiden, Zugriffstoken direkt im Client zu kodieren.

Integrationsschema

MethodePassende SzenarienAusgabe oder VerbindungHinweise
Web-ArbeitsbereichPersonalbesetzung und Testing der GeschäftsprozesseVisualisierte Ergebnisse und DatensätzeDie Hauptdokumente und die Trainingsbeispiele können gespeichert werden.
Synchronisierungs-APIEinzelseiten- und Prozesse mit geringer VerzögerungSofort in JSON zurückkehrenEingeschränkt durch die Anfragezeit und den 10 MB großen Anfrageinhalt
Asynchrone APILange Aufgaben und BatchverarbeitungAufgabenidentifikation und ErgebnisabfrageEs müssen abgelaufene Aufgaben bearbeitet und Versuche wiederholt werden.
Große Upload-APIMaximal 500 MB, 1.000 SeitenStrukturierte Ergebnisse für mehrseitige DokumenteDie Gebühren nach Seitenanzahl müssen bestätigt werden.
Mobile SDKMobile Erfassung und QualitätskontrolleFoto oder Scan-ErgebnisAndroid, iOS und Flutter haben unterschiedliche Unterstützungsgebiete.
Zapier und n8nLow-Code-WerkflüsseVerbindung von Dateikanälen und UnternehmensanwendungenZertifikate, Wiederholungsversuche und sensible Daten müssen kontrolliert werden.

Privatsphäre, Dateispeicherung und Training

DatentypenSpeicherregelnTraining oder NutzungBenutzermaßnahmen
Synchronisierte API zum Extrahieren von DateienNicht in die permanente Speicherung aufnehmenZur Durchführung dieser Extraktion verwendet.Sensible Felder und Protokolle sollten weiterhin kontrolliert werden.
Asynchrone API-DateienVerschlüsselte vorübergehende Speicherung, Ergebnisse werden abgerufen oder gelöscht, wenn die Aufgabe abläuftZur Ausführung asynchroner AufgabenErgebnisse rechtzeitig abrufen und Ablaufdatum überprüfen
Hauptdokument des ArbeitsbereichsWird gespeichertZur Konfiguration und Bedienung durch BenutzerKlare Löschprozesse und Aufbewahrungsfristen
Anpassung von Trainingsbeispielen für ModelleWird gespeichertKundenspezifische Modelle für Anfragen der KundenDesensibilisierung und Beschränkung der Teamrechte
Kontoinformationen und TeaminformationenBevor das Konto gelöscht wird, wird es aufbewahrt.Anmelden, Abrechnung, Support und BetriebBei Löschung des Kontos wird der geteilte Inhalt separat behandelt.
Verwendung von Aktivitäten und MetadatenNach der notwendigen Frist aufbewahrenProduktverbesserung, Analyse und SicherheitAnforderungen an Unternehmensprotokolle und Aufbewahrungsanweisungen
Training generativer ModelleIm Prinzip wird es nicht für die Schulung anderer Kunden verwendet.Nur mit schriftlicher Zustimmung, zur Erbringung von Dienstleistungen für diese Kunden oder aufgrund gesetzlicher Anforderungen usw. – Ausnahmen.Bestätigung von Ausnahmen und Anonymisierung in der DPA

Die Daten können in den Regionen USA, Taiwan oder Singapur gehostet und verarbeitet werden. Die Plattform nutzt außerdem Dienstleister für Cloud-Hosting, KI-Berechnungen, Zahlungen, Überwachung und Analyse. Bevor man eine Region für die Speicherung der Daten auswählt, sollte man den DPA, den Standort der Dienstleister sowie die Mechanismen für die grenzüberschreitende Übertragung prüfen.

  • Führen Sie Synchronisation, Asynchronisation, die Hauptdokumente der Arbeitsbereiche sowie die Trainingsbeispiele getrennt in die Datenklassifizierung ein.
  • Laden Sie nur die Seiten und Felder hoch, die für die Erledigung der Aufgabe erforderlich sind. Wenn eine Maskierung möglich ist, sollte diese zuerst durchgeführt werden.
  • Verwenden Sie die geringsten Berechtigungen für das Team und räumen Sie regelmäßig ausscheidende Mitglieder sowie abgelaufene Zugriffstoken auf.
  • FormX speichert die Originaldateien sowie die endgültigen Daten in seinem eigenen System; es übernimmt keine Verantwortung für das Backup oder die Archivierung.
  • Unterschreiben Sie eine DPA für personenbezogene Daten und überprüfen Sie den Unterauftragnehmer, die Region, die Verschlüsselung sowie den Löschnachweis.
  • Verwenden Sie den Service nicht für Entscheidungen im Bereich Medizin, Lebenssicherheit oder kritische Infrastrukturen, bei denen keine menschliche Überprüfung erforderlich ist.

Sicherheit und Konformität

FormX behauptet, den Anforderungen von ISO 27001 sowie SOC 2 Type II zu entsprechen, und bietet seinen zahlenden Kunden allgemeine SLA-Bedingungen an. Unternehmen sollten bei ihren Einkäufen weiterhin Berichte über die Gültigkeitsdauer, Zusammenfassungen der Penetrationstests, Unterlagen zur Geschäftskontinuität sowie Bestimmungen bezüglich der Meldung von Sicherheitsvorfällen anfordern.

Die Bestimmungen definieren den Kunden als Kontrolleur personenbezogener Daten und FormX als Verarbeiter, und sie beziehen sich auf die DPA sowie die Liste der Unterauftragsverarbeiter. Ein Zertifikat kann den Zugriffskontrollmechanismus, die Minimierung von Daten sowie die manuelle Überprüfung in konkreten Projekten nicht ersetzen.

API, GitHub und Open Source

FormX bietet offizielle API-Dokumentationen, Referenzmaterialien für Android und iOS SDK sowie eine Flutter-Abstraktionsschicht. Das Flutter SDK im Oursky-Repository wird unter der MIT-Lizenz bereitgestellt und unterstützt Android SDK ab Version 26 sowie iOS ab Version 14; es gibt außerdem ein Repository mit Dokumentationen für die nativen SDKs sowie ein Archiv mit älteren Hilfedokumenten.

Die Veröffentlichung von SDKs und Dokumentationen bedeutet nicht, dass die FormX-Identifizierungsplattform open source ist. OCR, Modellrouting, kundenspezifisches Training, Accuracy Center, Cloud-Extraktion sowie die Unternehmensarbeitsbereiche bleiben weiterhin als proprietäre Dienste verfügbar; zur Nutzung des SDKs ist weiterhin ein Zugang zu einer kommerziellen Plattform erforderlich.

ProjektOffener StatusLizenz oder Anleitung
FormX-Cloud-PlattformClosed SourceWirtschaftliche Hosting-Dienste
API abrufenOffene DokumenteKonto, Zugriffstoken und Zahlungslimit erforderlich
Eigene Mobile SDKOffene Lager und ReferenzenDer Lagerbereich wird in dem öffentlichen Überblick nicht mit der allgemeinen Lizenz der Plattform dargestellt.
Flutter SDKOffener QuellcodeMIT-Lizenz
Alte HilfedokumentationÖffentlich, aber archiviertAb 18. April 2024 nur Lesen
Benutzerdefinierte Modelle und ArbeitsbereicheClosed SourceKann nicht eigenständig offline bereitgestellt werden

Grundlegende Informationen

ProjektInhalt
Name des ToolsFormX.ai
Betreibende StelleSkyMakers Digital Limited
RegistrierungsortEngland und Wales in Großbritannien
Arten von WerkzeugenIntelligente Dokumentverarbeitung, OCR und Extraktion strukturierter Daten
Kern-EingabeBilder, PDFs, Scans und Dokumente von Mobilgeräten
KernausgabeJSON, das aus Feldern, Tabellen und Metadaten besteht
Preismuster100 Seiten als Testversion, Abrechnung pro Seite, Monatsabonnement und Unternehmenskonditionen
Ist eine Registrierung erforderlich?Konfiguration, API und kostenpflichtige Nutzung erfordern ein Konto.
Chinesische UnterstützungDie Verarbeitungskapazität muss anhand von Messungen im Dokument ermittelt werden; Verwaltung und Dokumente sind hauptsächlich auf Englisch.
VerarbeitungsgebietUSA, Taiwan, Singapur
HauptplattformenWeb-Arbeitsbereich, API, Android, iOS und Flutter
Offene APIAnbieten
Offizielles SDKAndroid, iOS und Flutter
Ist das Produkt open source?Nicht open source
Open-Source-BereichDas Flutter SDK verwendet die MIT-Lizenz.
Mindestalter18 Jahre alt
Datum der Preisüberprüfung22. August 2026

Empfehlungswert

Empfehlungswert: 4,3 / 5. FormX.ai bietet eine recht umfassende Produktionskette – von der Dokumentqualität über die Klassifizierung und Trennung der Inhalte bis hin zur Extraktion von Feldern und Tabellen sowie zur Rückmeldung an den Benutzer. Zudem sind die Preise sowie die Anleitungen zur Datenverarbeitung genauer angegeben als bei vielen anderen OCR-Diensten.

Der Hauptmangel besteht darin, dass Starter nach dem Extractor abgerechnet wird; komplexe Anwendungen erfordern möglicherweise mehrere Konfigurationen. Bei großen Dateien gibt es erhebliche Unterschiede zu den Beschränkungen der normalen Schnittstellen. Auch die Abrechnung pro Seite und pro Aufruf muss noch bestätigt werden. Die Schlüsselfelder müssen weiterhin anhand echter Beispiele, durch manuelle Überprüfung sowie unter Berücksichtigung der vertraglichen SLA-Kriterien überprüft werden.

Häufige Fragen

Was macht FormX.ai?

Es extrahiert Felder und Tabellen aus Rechnungen, Quittungen, Auszügen, Dokumenten, Verträgen und anderen Unterlagen und liefert sie in strukturierter JSON-Form an Workflows oder Geschäftsunternehmen.

Ist FormX.ai nur OCR?

Nein. OCR ist nur die Grundlage für die Texterkennung. FormX bietet zudem Dokumentenklassifizierung, Aufteilung von Dokumenten, benutzerdefinierte Felder, Tabellen, Code-Übersetzung, Feedback sowie Integration in Geschäftsprozesse.

Ist FormX.ai kostenlos?

Die ersten 100 Seiten können kostenlos getestet werden; auch die Anzahl der Abfragen ist in den ersten 100 Fällen kostenlos. Wie bei Dokumenten mit mehr Seiten berechnet wird, muss vor dem Beginn der Massenverarbeitung geklärt werden.

Wie viel kostet die Nutzung nach Verbrauch?

Das Preismodell beginnt bei 0,30 US-Dollar pro Seite; es gibt keine Mindestvertragslaufzeit, doch es sind keine fortgeschrittenen Funktionen enthalten. Die Preise können sich ändern, Steuern und die tatsächliche Rechnung richten sich nach der endgültigen Abrechnung.

Was enthält der Starter?

Der Starter kostet 299 US-Dollar pro Monat und pro Extraktor – dabei sind 3.000 Seiten inbegriffen. Für jede weitere Seite fallen 0,10 US-Dollar an. Zudem sind 20 Smart Learning-Beispiele, ein Accuracy Center, Funktionen zur Klassifizierung, Code-Mapping sowie fortgeschrittene Tabellen enthalten.

Welche Größe von PDFs wird unterstützt?

Der neue, verbesserte Upload-Prozess unterstützt Dateien mit einer Größe von bis zu 500 MB sowie bis zu 1.000 Seiten. Der Upload über den herkömmlichen Anfrage-Formaten ist weiterhin auf 10 MB beschränkt; diese Einschränkung gilt nicht für alle Upload-Möglichkeiten.

Welche Dateiformate werden unterstützt?

In den offiziellen Dokumenten werden die gängigen Formate wie JPEG, PNG und PDF ausdrücklich aufgeführt. Andere Formate, verschlüsselte PDFs sowie spezielle Kodierungen sollten im Projekt getestet werden.

In welcher Formatierung werden die Extraktionsergebnisse geliefert?

Die Felder, Tabellen und relevanten Informationen werden hauptsächlich im JSON-Format zurückgegeben, was das Einfügen in Datenbanken, ERP-Systeme, CRM-Systeme oder automatisierte Workflows erleichtert.

Wird die Datei gespeichert?

Synchron abgerufene Dateien werden nicht in der dauerhaften Speicherung gespeichert; asynchrone Dateien werden vorübergehend verschlüsselt aufbewahrt und nach der Rückgabe der Ergebnisse oder Ablauf der Frist gelöscht. Die Hauptdokumente des Arbeitsbereichs sowie die benutzerdefinierten Trainingsbeispiele werden gespeichert.

Wird das Dokument zur Schulung von öffentlichen Modellen verwendet?

Laut den Bedingungen werden die Inhalte der Kunden nicht verwendet, um generative Modelle für andere Kunden oder Dritte zu trainieren, es sei denn, es gibt vorherige schriftliche Zustimmung des Kunden, dies ist zur Erbringung und Verbesserung der Dienstleistungen für diesen Kunden notwendig, oder es besteht eine gesetzliche Verpflichtung.

Wo werden die Daten verarbeitet?

Beim Erstellen eines Projekts kann man zwischen den Regionen USA, Taiwan oder Singapur wählen; für die Infrastruktur werden GCP und Azure verwendet. Dennoch sollte man die Übertragungswege für KI-Berechnungen sowie andere Verarbeitungsdienste über Grenzen hinweg überprüfen.

Wie hoch ist die Genauigkeit der Erkennung?

Es gibt keine einheitliche Genauigkeitsrate, die für alle Dokumente gilt. Laut offiziellen Angaben liegt die Genauigkeit bei den üblichen Feldern in der Regel bei über 70 %. Bei hochwertigen Quittungen können die Angaben zu Datum, Zeit und Betrag sogar über 90 % liegen – doch das sind keine verbindlichen Zahlen.

Wie lange dauert es, eine Quittung zu bearbeiten?

Die durchschnittliche Verzögerung liegt in der Regel bei 4 bis 8 Sekunden – dabei ist die Zeit zum Hochladen nicht einbezogen, und es handelt sich auch nicht um eine SLA. Die Dateigröße, das Netzwerk, der Extraktor sowie die Komplexität der Tabellen beeinflussen alle die Verzögerung.

Wird eine API bereitgestellt?

Zur Verfügung gestellt. Entwickler verwenden Zugriffstoken und Extraktoren, um Dokumente einzureichen, und können zwischen synchroner, asynchroner oder Prozessen für große Dateien wählen.

Wird die Anbindung von mobilen Apps unterstützt?

Es wird Android, iOS und das Flutter SDK unterstützt; es ist möglich, Kamerabilder, Dokumentenerkennung sowie Aufnahmefunktionen einzubinden. Flutter unterstützt derzeit weder Web- noch Desktop-Plattformen.

Ist FormX.ai open source?

Die Plattform selbst ist nicht open source. Das Flutter SDK wird unter der MIT-Lizenz bereitgestellt; einige SDKs sowie Dokumentationsräume sind öffentlich zugänglich, doch die Cloud-basierte Erkennung, das Training sowie die Arbeitsumgebung bleiben kommerzielle Dienste.

Gibt es ein SLA für die Verfügbarkeit?

Der allgemeine SLA für die Pay-as-you-go-Pläne beträgt 99,95 % pro Monat. Falls diese Marke nicht erreicht wird, kann man 10 % der Kosten für den jeweiligen Monat in Servicepunkte umwandeln lassen. Testumgebungen, Beta-Versionen, Vorabversionen sowie Nicht-Produktionsumgebungen fallen nicht unter die Garantiebedingungen.

Eignet es sich für Entscheidungen im Bereich der Medizin oder zur Sicherung des Lebens?

Es eignet sich nicht für die direkte Anwendung in Situationen mit hohem Risiko, die zum Tod, zu Verletzungen oder zu Störungen in der kritischen Infrastruktur führen können. In solchen Fällen ist im Voraus eine gesonderte schriftliche Vereinbarung erforderlich.

Zusammenfassung

FormX.ai eignet sich für Teams, die Rechnungen, Ausweise, Verträge sowie lange PDF-Dateien in strukturierte Geschäftsdaten umwandeln möchten – insbesondere für Projekte, bei denen angepasste Felder, Tabellen, mobile Scannfunktionen sowie API-Integrationen erforderlich sind. Ein Probelauf nach Gebrauch ermöglicht es, zunächst mit echten Dokumenten eine genaue Basis für Genauigkeit und Kosten zu ermitteln.

Vor dem Go-Live müssen die Dateilimits sowie die Abrechnungseinheiten für jede Art von Eingang klar festgelegt werden. Zudem muss unterschieden werden, wie Synchronisierungs-, Asynchronisierungs-Verfahren sowie die Speicherung der Hauptdokumente und Trainingsbeispiele ablaufen. Außerdem sollen Schwellenwerte für wichtige Felder, manuelle Überprüfungen, Verarbeitungsbereiche, Unterauftragnehmer sowie Durchsatz und SLA in den Umsetzungsplan oder Vertrag aufgenommen werden.

©️ Urheberrechtshinweis: Sofern nicht anders angegeben, liegen die Urheberrechte an allen Artikeln auf dieser Website beiTeilen von AI-ToolsAlle Urheberrechte liegen bei uns. Ohne Genehmigung darf keine Person, kein Medienunternehmen, keine Website oder irgendeine Gruppe den Inhalt dieser Website kopieren, nachahmen oder auf andere Weise verbreiten. Ebenso ist es nicht gestattet, Spiegelseiten auf Servern zu erstellen, die nicht uns gehören. Andernfalls behalten wir uns das Recht vor, rechtliche Schritte gegen die Verantwortlichen einzuleiten.

Werkzeuge, die dem FormX.ai ähneln