Auto Crop API, optimiert für mehrere Dateien auf einer Seite

Effiziente Digitalisierung mehrerer Objekte, die in einem Scan oder Foto erfasst wurden, in einem Klick

Gewährleistet präzise Datensätze durch automatisches Isolieren und Zuschneiden einzelner Dokumente in separate Dateien

Kostenlos testen

4.8/5  (30+ Bewertungen)

Weltweit von Top-Teams genutzt

v2-Carlabella
v2-Spendesk
v2 Payfit
v2 Lucca
v2 Circula
v2-Carlabella
v2-Spendesk
v2 Payfit
v2 Lucca
v2 Circula

OHNE

Automatisches Zuschneiden

Allgemeine LLMs (Large Language Models) haben Schwierigkeiten mit präzisen räumlichen Koordinaten. Dies führt zu unordentlichen Zuschneidungen und “halluzinierten” Dokumenträndern.

Oft werden Koordinaten “halluziniert”, wodurch Text oder Logos abgeschnitten werden.

Für das Zuschneiden hochauflösender Bilder werden viele Tokens verbraucht.

Schwierigkeiten mit unübersichtlichen Layouts.

Problematisch, wenn Unsicherheit über den Dokumenttyp besteht.

MIT

Auto-crop

+99 %

Genauigkeit beim Zuschneiden

Erkennung exakter physischer Kanten

Feste Verarbeitungskosten, unabhängig von der Bildkomplexität

Einfache Isolierung von 10+ Objekten pro Scan

Integrierte Metriken zur Auslösung von manueller Prüfung nur bei Bedarf

Integrieren Sie „Crop“ in Sekundenschnelle in Ihren Dokumentenworkflow.

Verfügbar in jedem Tarif

Erstellen Sie auf der Mindee-Plattform ein neues Vorverarbeitungsmodell, indem Sie auf das Dienstprogramm „Zuschneiden“ klicken

Erstellen Sie auf der Mindee-Plattform ein neues Vorverarbeitungsmodell, indem Sie auf den Service „Crop“ klicken. Sie finden es am unteren Rand der Benutzeroberfläche. Wenn Sie mit diesem Vorverarbeitungsmodell bereits vertraut sind, können Sie es direkt verwenden. Weitere Informationen finden Sie in der Dokumentation.

User interface displaying document types like Resume, Invoice, Receipt, and tools such as Crop, Split, and OCR for document processing.
Interface for configuring document classes with options for RECIEPT and OTHER, and buttons to Cancel or Create Utility.

Customizing nach Ihren Anforderungen

Geben Sie die Dokumenttypen ein, die in Ihren Dateien vorkommen.

Vor der endgültigen Vorverarbeitung müssen Sie die entsprechenden Kategorien definieren. Fügen Sie unbedingt manuell eine Kategorie „Nicht definiert“ hinzu. Dateien, die keiner Ihrer Hauptkategorien zugeordnet sind, werden in der Kategorie „Nicht definiert“ angezeigt.“

PDF, HEIC, PNG, JPEG... Zahlreiche Formate

Laden Sie beliebige Dokumente problemlos hoch: Universelle Unterstützung für PDFs und Bilder.

Beschleunigen Sie die Datenerfassung dank nativer Unterstützung für PDFs und alle Bildformate. Von hochauflösenden Scans bis hin zu mobilen Aufnahmen – die Mindee API verarbeitet alle Eingabeformate und stellt sicher, dass Ihre Daten jederzeit zur Extraktion bereit sind.

Screenshot of a software interface displaying multiple cropped images of receipts with labels such as RECEIPT and OTHER and a JSON response showing metadata about detected receipts.

Vollständige Dokumentenverarbeitung

Alle Ihre Dokumente werden zugeschnitten und individualisiert im Standard-JSON-Format mit zugehörigen Begrenzungsrahmen angezeigt

Die Vorverarbeitung per automatischem Crop kann anschließend mit anderen Mindee-API-Funktionen kombiniert werden, um die Granularität der extrahierten Daten weiter zu verbessern.

Nutzen Sie die automatische Zuschneidefunktion und weitere Tools, um Ihren Dokumenten-Workflow zu optimieren

1

Erfassung

2

Vorverarbeitung

3

Datenextraktion

4

Anreicherung

5

Validierung

Top view of a coffee cup, pen, manila folder with envelopes and sticky notes, and IRS tax forms on a dark surface.

Konvertiert Handyfotos von schlechter Qualität und handschriftliche Notizen in native PDF-Dateien.

Die Mindee API bereinigt unscharfe Handyaufnahmen, analysiert Handschrift und isoliert mehrere Dokumente auf einer einzelnen Seite bzw. einem einzelnen Bild.

Older man with gray hair and beard reviewing a large stack of papers at a desk under red text that reads 'X TIME-CONSUMING'.

KI-gestützte Klassifizierung, die Dokumenten-„DNA“ (Rechnungen vs. Verträge) erkennt und die Stapelverarbeitung automatisiert.

Manuelle Dokumentensortierung gehört der Vergangenheit an. Unsere Routing-Engine fungiert als digitaler Architekt, klassifiziert Dokumente in Echtzeit und leitet sie an die korrekte Geschäftslogik weiter.

User interface showing extracted fields from a supplier document including supplier logo, name Joanna Binet, line items with quantity 2 and unit price 400, and SWIFT code 1293290221079 with confidence levels.

Extrahiert Daten aus beliebigen Layouts mit herausragender Genauigkeit: Komplexe Tabellen, Schlüssel-Wert-Paare und handschriftliche Anmerkungen werden unterstützt.

Mehr als einfache Zeichenerkennung. Unsere Extraktionsschicht nutzt neuronale Netze, um Ihre Daten kontextbezogen zu verstehen und statische, unstrukturierte Dateien in dynamische, strukturierte Assets im Standard-JSON-Format umzuwandeln.

Logos of software platforms Sage, Salesforce, Odoo, Oracle, Sellsy, HubSpot, SAP, and Microsoft Dynamics 365 above two labeled blocks 'SDKs' and 'NO-CODE' with arrows pointing to 'mindee' logo at the bottom.

Echtzeit-Synchronisierung mit ERP/CRM-Stammdaten und automatisierte API-Validierung von Drittanbietern (USt-IdNr., Compliance)

Isoliert betrachtete Daten sind nur bedingt aussagefähig. Die "Enrich"-Phase schließt dank Integrationen die Lücke zwischen einem Dokument und Ihrem gesamten Unternehmensökosystem (ERP, CRM, PLM).

Flowchart showing payment validation steps: if certainty is certain or high, validate payment; if medium, trigger human review.

Automatisierte Validierung von Geschäftsregeln und hocheffiziente Human-in-the-Loop-Workflows für die Validierung von Ausnahmefällen.

Gehen Sie über einfache Extraktion hinaus. Erstellen Sie belastbare Dokumenten-Pipelines, die Daten automatisch anhand Ihrer individuellen Geschäftsregeln überprüfen. Unsere API verwaltet die Schnittstelle zwischen automatisierten Konfidenzscores und menschlicher Sonderfallvalidierung – und stellt so sicher, dass Ihre Produktionsdaten stets sauber, konform und nutzbar sind.

Puzzle pieces displaying programming language logos including Ruby, Node.js, Python, Java, and PHP, with text below reading 'Also available on' followed by logos for Zapier, Make, and n8n.

Integrieren Sie Mindee in wenigen Minuten in Ihren Workflow mit SDKs und No-Code-Tools

Starten Sie innerhalb weniger Minuten live mit unserer verifizierten Zapier- und Make.com-App – ganz ohne Programmierung – oder integrieren Sie Mindee nahtlos über unsere gut dokumentierte REST-API für Entwickler. SDKs sind für Python, Node.js, Java, Ruby und PHP verfügbar.

Details zur Integration

security soc2 and gdpr

Unternehmensweite Sicherheit

Unsere API nutzt eine nach SOC 2 Typ II zertifizierte Infrastruktur und entspricht den DSGVO-Vorgaben, um den Schutz Ihrer Dateiinformationen jederzeit zu gewährleisten.

Hosting in der EU oder den USA verfügbar

DSGVO-, CCPA-konform

Mehr erfahren

Entwickler und technische Profile haben es bereits genutzt!

Integrieren Sie die moderne KI-basierte Mindee OCR API in wenigen Minuten in Ihr Produkt.

Mindee ist eine integrierte Dokumentenverarbeitungsplattform, die auf zuverlässiger KI-Technologie basiert. Der Dienst verfügt über eine intuitive und benutzerfreundliche Oberfläche und liefert hochpräzise Ergebnisse bei der Datenextraktion aus verschiedenen Dokumententypen, insbesondere aus Finanzbelegen und Rechnungen, die relativ komplex sind und spezialisierte optische Zeichenerkennungsdienste (OCR) erfordern. Die Plattform ermöglicht eine nahtlose Integration in unsere bestehenden Datenverarbeitungs-Workflows durch anpassbare APIs, was eine effiziente Datenextraktion und Automatisierung ermöglicht.

quote

on G2

Mindee ist eine Software, die uns dabei hilft, all unsere physischen Geschäftsdaten wie Rechnungen, Garantiebelege, Kalender und Belege in digitale Dokumente umzuwandeln. Diese können auf unserem Laufwerk gespeichert und in verschiedene Excel-Tabellen hochgeladen werden, sodass alle Aktualisierungen gepflegt und eine fundierte Transaktionsanalyse vom Finanzteam durchgeführt werden kann.

quote

on G2

Mindee ist ein webbasiertes Tool, das uns beim Scannen und Lesen verschiedener Dokumenttypen wie Ausweise, Rechnungen, Angebotspläne usw. hilft und alle Informationen mithilfe seiner KI extrahiert. Anschließend stellt es alle mit diesen Dokumenten verbundenen Informationen und Daten strukturiert bereit.

quote

on G2

Ausgezeichnet. Neben ihrem großartigen Produkt war das Vertriebsteam immer proaktiv dabei, uns zu unterstützen, das Maximum aus ihrem Produkt herauszuholen. Es war, als hätten wir einen zusätzlichen Produktmanager an unserer Seite.

quote

on Capterra

Mindee funktioniert zuverlässig und bietet eine gute Performance. Die OCR-Daten sind präzise, und die API ist stabil. Es funktioniert einwandfrei.

quote

on Capterra

Mindee ist ein webbasiertes Tool, das uns beim Scannen und Lesen verschiedener Dokumenttypen wie Ausweise, Rechnungen, Angebotspläne usw. hilft, alle Informationen mithilfe seiner KI extrahiert und anschließend alle mit diesen Dokumenten verbundenen Informationen und Daten strukturiert bereitstellt.

quote

on Capterra

Monatlich werden 15 Millionen Dokumente verarbeitet. Beginnen Sie mit Crop und Datenextraktion

Bereits +500 aktive Nutzer

14 Tage kostenlose testen

Keine Kreditkarte erforderlich

Screenshot of a software interface showing extracted fields from an invoice including supplier phone number, customer company registration, JSON data, and highlighted text boxes for employee ID and pay date.

FAQ zur OCR-API von Mindee

Was ist die automatisierte Erkennung und Zuschneidung mehrerer Dokumente?

Die automatisierte Erkennung und Zuschneidung mehrerer Dokumente ist eine spezialisierte Computer-Vision-Funktion, die erkennt, isoliertund einzelne Datensätze zuschneidet, die zusammen auf einer einzigen Seite gescannt wurden.

Anstatt einen Scan mehrerer Belege oder Ausweise als ein einziges Bild zu behandeln, identifiziert die API die physischen Grenzen jedes einzelnen Elements. Anschließend erstellt sie separate, hochauflösende Einzeldateien für jeden Datensatz, um sicherzustellen, dass die nachgeschaltete Extraktions-Engine diese einzeln verarbeitet, um maximale Genauigkeit.

Was sind Beispiele für automatisch zugeschnittene Mehrfachdokumente?

Der häufigste Anwendungsfall ist im Bereich Spesenmanagement, wo ein Mitarbeiter drei oder vier kleine Taxiquittungen und eine Restaurantrechnung auf einer einzigen DIN A4- oder Letter-Seite scannen könnte.

Ein weiteres zentrales Beispiel ist die Identitätsprüfung (KYC), wie das Scannen der Vorder- und Rückseite eines Führerscheins oder mehrerer Ausweise auf demselben Flachbettscanner.

Im medizinischen Bereichwird diese Technologie verwendet, um mehrere Labor-Etiketten oder Rezeptaufkleber, die auf einem einzigen Blatt gescannt wurden, zu digitalisieren.

Durch die Isolierung dieser Elemente stellt das System sicher, dass eine „Mittagsquittung“ nicht mit einem „Taxifahrpreis“ in Ihrer Buchhaltungsdatenbank zusammengeführt wird. Weitere Praxisbeispiele, wie Unternehmen diese Technologie nutzen, finden Sie unter Kundenreferenzen.

Wie funktioniert die automatisierte Verarbeitung mehrerer zugeschnittener Dokumente?

Der Prozess ist eine ausgeklügelte Mischung aus geometrischer Analyse und Kantenerkennung. Wenn eine einzelne Seite hochgeladen wird, führt Mindees Vision-Pipeline einen „räumlichen Scan“ durch, um kontrastreiche Ränder zu finden, die die Kante eines physischen Objekts anzeigen.

  • Objekterkennung: Die KI identifiziert, wie viele verschiedene Elemente sich auf der Seite befinden.
  • Generierung von Begrenzungsrahmen: Es zeichnet eine präzise „Box“ um jedes Element, selbst wenn diese schräg platziert sind (hier findet die „automatische Entzerrung“ statt).
  • Zuschneiden & Entrauschen: Das System schneidet jede Box zu einer neuen, individuellen Bilddatei zu und bereinigt die Qualität.
  • Individuelle Verarbeitung: Jede neue Datei wird an das entsprechende Extraktionsmodell (z. B. die Beleg-API) gesendet, als wäre sie einzeln hochgeladen worden, wodurch eine gegenseitige Beeinflussung zwischen verschiedenen Dokumenten ausgeschlossen wird.

Wie schneidet man mehrere Bilder oder PDFs gleichzeitig automatisch zu?

Bilder/PDFs manuell in einem Tool wie Photoshop oder mithilfe einfacher Python-Skripte zuzuschneiden, ist langsam und nicht skalierbar.

Um mehrere Bilder/PDFs für einen produktionsreifen Workflow gleichzeitig automatisch zuzuschneiden, sollten Sie eine OCR-API integrieren, die eine dedizierte Vorverarbeitungsschicht umfasst. Die API von Mindee erledigt dies automatisch: Wenn Sie einen einzelnen Scan mit mehreren Elementen senden, erkennt die Vision-Engine die Grenzen und führt den Zuschnitt in Millisekunden durch.

Für Entwickler bedeutet dies, dass Sie „Massenscans“ akzeptieren können von Benutzern, ohne komplexe Bildverarbeitungslogik schreiben zu müssen, wodurch Ihr Entwicklungszyklus erheblich beschleunigt und die Benutzererfahrung verbessert wird.