
PDFmdx – hochautomatisierte Middleware zur intelligenten Dokumentenverarbeitung (IDP – Intelligent Document Processing), die unstrukturierte PDF-Datenströme mittels Layout- und Content-Klassifizierung analysiert, dynamisch partitioniert (Splitting), über zonale OCR sowie relative Ankerfelder strukturierte Metadaten extrahiert und diese zur Weiterleitung an Drittsysteme (ERP/DMS) als XML oder CSV bereitstellt. Durch die native Kopplung mit der Druck-Engine PDF2Printer sowie einem integrierten SMTP-Modul lässt sich dieser digitale Workflow nahtlos, regelbasiert und vollautomatisch in die physische Belegausgabe oder den digitalen Versand überführen:
• Dokumenten-Klassifizierung & Splitting: Automatische Erkennung des Dokumententyps anhand des Inhalts und dynamische Aufteilung (Segmentierung) von Sammel-PDFs basierend auf Trennkriterien wie Textwechseln oder detektierten Barcodes.
• Multiformat-Barcode-Erkennung: Automatische Dekodierung von 1D- und 2D-Barcodes (z. B. Code 128, QR-Code, DataMatrix) zur Steuerung von Trennprozessen, zur Dateinamensgebung oder als wertvoller Indexwert für den Metadatenexport.
• Intelligente Datenextraktion (Parser-Engine): Auslesen spezifischer Metadaten (z. B. Rechnungsbeträge oder Kundennummern) über geometrisch flexible Ankerfelder und reguläre Ausdrücke (RegEx).
• Dynamische Veredelung: Inhaltsgesteuertes Aufbringen von digitalem Briefpapier (Overlay/Underlay), elektronischen Signaturen oder das automatische Entfernen von Leerseiten (Blank Page Detection).
• Automatisierter E-Mail-Versand (SMTP-Output): Regelbasiertes, direktes Versenden der verarbeiteten Dokumente als E-Mail-Anhang, wobei Empfängeradresse, Betreff und Nachrichtentext dynamisch aus den zuvor extrahierten Metadaten (z. B. E-Mail-Adresse aus dem Rechnungs-Header) generiert werden.
• Event-gesteuertes File-Watching & Print-Control: Der PDF2Printer-Windows-Dienst überwacht kontinuierlich die Ausgabeverzeichnisse von PDFmdx und triggert sofort den Spooling-Prozess inklusive spezifischer Parameter wie Druckerzuweisung, gezielter Schachtsteuerung (Tray Selection) und Kopienanzahl.
• Lifecycle-Management & Error-Handling: Nach erfolgreichem Druck oder Versand verschiebt das System die Dokumente in ein Archivverzeichnis, während fehlerhafte Jobs isoliert und in dedizierten Error-Foldern zur administrativen Klärung bereitgestellt werden.