Invofox Self Serve
Invofox Self Serve ist eine automatisierte Dokumentenverarbeitungs-API, die PDFs und Bilder in strukturiertes JSON und Markdown parst und Klassifizierung, Tabellenextraktion sowie Zero-Retention-Compliance bietet.
Invofox Self Serve ist eine automatisierte Dokumentenverarbeitungs-API, die PDFs und Bilder in strukturiertes JSON und Markdown parst und Klassifizierung, Tabellenextraktion sowie Zero-Retention-Compliance bietet.
Funktion und offizielle Positionierung des Produkts
Invofox bietet eine einheitliche API zur Dokumentenextraktion, um unstrukturierte PDFs, gescannte Seiten und Bilder in normalisierte JSON-Datensätze und Markdown für nachgelagerte LLM- und Datenbankanwendungen umzuwandeln.
Das System deckt den gesamten Verarbeitungszyklus ab, einschließlich Entzerren, Dual-Pass-OCR, Dokumentenaufteilung, Klassifizierung, Tabellenabgleich und automatisierter Konfidenzbewertung.
Durch offizielle Quellen belegte Anwendungsfälle
Extraktion von Lieferantendaten, Steuernummern, Datumsangaben und Positionssummen aus Eingangsrechnungen in strukturierte JSON-Nutzdaten.
Parsen von Kreditnehmerinformationen, Darlehensbedingungen und Abrechnungswerten aus Hypothekenformularen und Closing Disclosures.
Automatisches Trennen von gesammelt hochgeladenen PDFs mit gemischten Dateien wie Kontoauszügen und Gehaltsabrechnungen in separate, klassifizierte Datensätze.
Extraktion von Arbeitgeberdaten, Mitarbeiter-Identifikationsnummern und Vergütungssummen aus standardmäßigen Gehaltsabrechnungen.
Der dokumentierte Ablauf, sofern verfügbar
Erstellen Sie ein Konto und generieren Sie die erforderlichen API-Schlüssel.
Wählen Sie die benötigten Standard-Dokumentmodelle aus oder richten Sie ein benutzerdefiniertes Schema ein.
Übertragen Sie Dokumente über eine POST-Anfrage an den Extraktions-Endpunkt.
Erhalten Sie die validierte, schemagerechte JSON- oder Markdown-Ausgabe direkt oder über einen Webhook.
Invofox verarbeitet unstrukturierte Dokumenten-Uploads über eine sequenzielle technische Pipeline. Wenn Dateien über den REST-API-Endpunkt empfangen werden, fangen Integritätsprüfungen passwortgeschützte oder beschädigte Dateien ab, bevor sie an Vorverarbeitungsmodule zum Entzerren, Entrauschen und Schärfen weitergeleitet werden.
Text- und Strukturelemente werden mithilfe eines Dual-Pass-OCR-Systems interpretiert, das die Layout-Geografie isoliert und gleichzeitig Text transkribiert. Mehrseitige Stapel werden durch einen automatischen Seitenspalter getrennt, woraufhin Klassifizierungsmodelle den Dokumenttyp bestimmen. Extrahierte Tabellen, Währungen und Datumsangaben werden anschließend normalisiert, anhand von Geschäftsregeln abgeglichen und zusammen mit Konfidenzwerten sowie Positionsnachweisen per Webhook oder Polling zurückgegeben.
Prüfungen mit eigenen Inhalten und Arbeitsabläufen
Welche Quellen wann geprüft wurden
Antworten auf Basis des quellengeprüften Produkteintrags
Invofox unterstützt Rechnungen, Quittungen, Lieferscheine, Bestellungen, Gehaltsabrechnungen, Kontoauszüge, Versorgungsrechnungen, Ausweisdokumente, Verträge, Steuerformulare und US-Hypothekenformulare wie Closing Disclosures.
Benutzer können Korrekturen an den Feedback-Endpunkt senden. Dadurch wird die Pipeline-Konfiguration aktualisiert, um zu verhindern, dass sich derselbe Fehler bei zukünftigen Dokumenten wiederholt.
Die Verarbeitung erfolgt standardmäßig innerhalb der Europäischen Union; eine Verarbeitung in den USA ist auf Anfrage verfügbar. Scale- und Enterprise-Tarife können den Zero-Retention-Modus aktivieren, während On-Premise-Bereitstellungen Enterprise-Verträgen vorbehalten sind.
Die Plattform akzeptiert PDF-Dateien, gescannte Dokumente sowie Bildformate wie PNG und JPG für die Extraktion.
Die Plattform unterstützt nativ Sprachen mit lateinischer Schrift wie Deutsch, Englisch, Spanisch, Portugiesisch, Französisch und Italienisch; für nicht-lateinische Schriften ist ein separates Konfigurationsfenster erforderlich.