Zum Hauptinhalt springen
Analysieren und klassifizieren

Erstellen Sie einen Parser für beliebige Dokumente.

Definieren Sie Ihr eigenes Feldschema und extrahieren Sie genau die benötigten Daten oder lassen Sie PDF4me gemischte Datensätze klassifizieren und jede Datei nach Typ weiterleiten. Dies ist die benutzerdefinierte Engine. Vorgefertigte Rechnungs- und Belegparser basieren auf KI-gestützter Datenextraktion.

Dokument analysieren

Extrahieren Sie genau die Felder, die Sie angeben.

Parse Document ist der universelle KI-Endpunkt. Geben Sie ein Dokument und eine Parse-Definition an; Sie erhalten JSON, das nach Ihrem Feldschema indiziert ist. Native Aktionen in Power Automate, Make und n8n.

Das Schema

Vier Schlüssel beschreiben jedes Feld.

  • Beschreiben Sie die Felder. Schreiben Sie eine Parse-Definition: Jedes Feld hat eine fieldName, a fieldType und eine einfache Sprache fieldDescription. Oder erstellen Sie dasselbe Schema wie einen Parse Analyzer im Dashboard.
  • Das Dokument posten. Base64 senden docContent with docName to /api/v2/ParseDocument, plus Ihre Analyzer-ID oder Parse-Definition.
  • Lies das JSON. Die Antwort trägt parsedData auf Ihr Schema abgestimmt, plus documentType and pageCount.
  • fieldName ist der JSON-Schlüssel, den Sie zurückerhalten.
  • fieldType is string, number, date, or table für sich wiederholende Zeilen.
  • fieldDescription ist der Hinweis in einfacher Sprache. Listen Sie alternative Bezeichnungen auf, um die Genauigkeit zu gewährleisten.
  • fieldMethod ist optional: extract nimmt den Wert so an, wie er gedruckt ist. generate leitet es ab oder normalisiert es.
parse-document.sh
curl -X POST https://api.pdf4me.com/api/v2/ParseDocument \
  -H "Authorization: Basic YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "docContent": "<base64 pdf>",
    "docName": "form.pdf",
    "AnalyzerId": "custom_form_parser",
    "async": false
  }'

REST-Dokument parsen

Dokument klassifizieren

Kenne den Datentyp, bevor du ihn analysierst.

Die Funktion „Dokument klassifizieren“ sagt voraus, ob es sich bei einer Datei um eine Rechnung, einen Vertrag, eine Quittung oder einen anderen Dateityp handelt, und gibt eine Wahrscheinlichkeitsbewertung an. Verwenden Sie sie, um einen gemischten Stapel zu sortieren und anschließend jede Datei nach Typ zu analysieren.

Das Urteil

Ein Beitrag, Typografie plus Selbstvertrauen.

  • Das Dokument posten. Base64-kodieren Sie PDF und senden Sie es als docContent with a docName to /api/v2/ClassifyDocument.
  • Lesen Sie das Urteil. Die Antwort kehrt zurück documentType, category and a confidence Punktzahl zwischen 0,0 und 1,0.
  • Verzweigen, dann analysieren. Leiten Sie Dateien mit hoher Zuverlässigkeit an den passenden Parser weiter. Dateien mit niedriger Zuverlässigkeit werden zur Überprüfung in eine Warteschlange gestellt. Bei gemischten Posteingängen kann ein Klassifizierungsanalysator die Weiterleitung und Extraktion in einem einzigen Aufruf durchführen.
documentType confidence 0.0–1.0 POST /ClassifyDocument
classify-document.sh
curl -X POST https://api.pdf4me.com/api/v2/ClassifyDocument \
  -H "Authorization: Basic YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "docContent": "<base64 PDF>",
    "docName": "incoming.pdf"
  }'
Dashboard-Analysatoren

Das Schema einmal erstellen, überall aufrufen.

Ein Parse Analyzer oder Classify Analyzer im Dashboard stellt Ihnen eine stabile Analyzer-ID für die REST-API (Power Automate, Make, n8n und Zapier) zur Verfügung. Benutzerdefinierte Formulare, die nicht im vorgefertigten Satz enthalten sind, werden hier gespeichert.

Erledigen Sie Ihre Dokumente.

Integrieren Sie es mit der API in Ihr Produkt, automatisieren Sie es ohne Programmierung oder nutzen Sie die kostenlosen Tools in Ihrem Browser. Keine Kreditkarte erforderlich.

Beginnen Sie mit einem einzigen Anrufcurl -X POST https://api.pdf4me.com/v1/ConvertToPdf

Kostenloses Angebot · Keine Kreditkarte erforderlich