CS KI

Automatisierung der Verarbeitung von Produktdokumentation

Diese Case Study beschreibt eine serverlose AWS-Lösung zur automatisierten Verarbeitung technischer Dokumente wie Datenblätter, Kataloge und Zertifizierungen für einen führenden slowakischen Distributor für Elektroinstallationsmaterial und industrielle Automatisierung. Die Lösung beschleunigte die Verarbeitung für den B2B-Katalog, verbesserte die Datenqualität und reduzierte Betriebskosten.

90 % schnellere Verarbeitung

pro Dokument, ausgehend von ursprünglich 15–20 Minuten
Technologien
  • Amazon S3
  • AWS Lambda
  • SageMaker
AWS Advanced Tier Services Partner
Skener s dotykovým displejom pri automatickom spracovaní dokumentov

Die Herausforderung

Distributoren für Elektroinstallations- und Industriekomponenten verarbeiten jedes Jahr Zehntausende Produktdatenblätter und technische Dokumente verschiedener Hersteller. Viele Unternehmen übertragen Daten noch manuell, was langsam, ineffizient und fehleranfällig ist. Häufige Änderungen von Produktparametern und der Zeitdruck bei der Veröffentlichung neuer Artikel in B2B-Portalen erhöhen den Bedarf an Automatisierung und verlässlicher Datenqualität.

  • Volumen und Vielfalt der Dokumente: Hunderte Lieferanten und mehrere Formate (PDF, DOCX, XLS) in unterschiedlichen Sprachen.

  • Manuelle Datenextraktion: 15–20 Minuten pro Dokument und ein erhöhtes Fehlerrisiko bei der manuellen Übertragung technischer Parameter.

  • Verzögerte Produktveröffentlichung: längere Time-to-Market für neue Artikel im B2B-Portal.

Projektziele

  • Die Verarbeitungszeit von Dokumenten um mindestens 80 % reduzieren.

  • Die manuelle Arbeit des Datenteams um 50 % reduzieren.

  • Eine Genauigkeit der extrahierten Daten von ≥ 98 % erreichen.

  • Eine skalierbare Pay-per-Use-Architektur mit Integration in ERP- und B2B-Systeme einführen.

Die Lösung

Die vorgeschlagene Lösung basiert auf einer serverlosen AWS-Architektur mit KI/ML und NLP zur Verarbeitung unstrukturierter Dokumente. Dieser Ansatz bietet ein ausgewogenes Verhältnis aus Flexibilität, Zuverlässigkeit und betrieblicher Effizienz. Das Serverless-Modell skaliert entsprechend dem Dokumentenvolumen ohne laufende Infrastrukturverwaltung, während AWS-Services für die KI-Verarbeitung eine schnelle Integration in bestehende ERP- und B2B-Systeme unterstützen.

Zentrale Komponenten:

  • Amazon S3: Eingangsspeicher für hochgeladene Dokumente.

  • Amazon Textract: automatisierte Extraktion von Text, Tabellen und Schlüssel-Wert-Paaren.

  • Amazon Comprehend + custom NLP (SageMaker): Identifikation und Klassifizierung technischer Parameter wie Spannung, Leistung, Abmessungen, Normen und IP-Schutzart.

  • AWS Lambda: Orchestrierung der Workflows und Transformation in strukturiertes JSON.

  • Amazon DynamoDB: Speicherung extrahierter Daten und Metadaten.

  • API Gateway: Integration mit ERP-Systemen und dem B2B-Portal.

  • Amazon CloudWatch: Monitoring von KPI, Latenz, Fehlern und Modellqualität.

Prozess:

  1. Eine Lieferantendatei wird im Batch- oder Event-driven-Modus in S3 hochgeladen.

  2. Textract extrahiert Text und Tabellen und übergibt das Ergebnis an eine AWS-Lambda-Funktion.

  3. Das SageMaker-NLP-Modell und Amazon Comprehend identifizieren Parameter und ordnen sie internen Feldern zu.

  4. AWS Lambda schließt die Validierung ab, erstellt JSON und speichert den Datensatz in DynamoDB.

  5. API Gateway ermöglicht den Export in das ERP-System und die Veröffentlichung im B2B-Katalog; manuelle Validierungen werden durch Audit-Logs unterstützt.

Umsetzung

Projektphasen (3–6 Monate):

  • Analyse und PoC (4 Wochen): Audit der Eingangsdokumente, Definition der Parametertaxonomie und PoC mit einer Stichprobe von 500 Dokumenten.

  • Entwicklung und Training (6–10 Wochen): Bereitstellung von Textract, Training des custom NLP-Modells in SageMaker sowie Entwicklung der AWS-Lambda-Funktionen und Integrationen.

  • Integration und Tests (4–6 Wochen): Anbindung an das ERP-System, End‑to‑End‑Tests und Sicherheitsprüfungen.

  • Bereitstellung und Feinabstimmung (2–4 Wochen): Monitoring, Nutzerfeedback und Kalibrierung der Modelle.

Die wichtigsten Entscheidungen:

  • Einsatz einer serverlosen AWS-Lösung für Skalierbarkeit und verbrauchsabhängige Abrechnung.

  • Hybrider Ansatz: automatisierte Verarbeitung mit menschlicher Validierung in Ausnahmefällen.

Ergebnisse und Nutzen

Die erste Auswertung bestätigte messbare Verbesserungen bei betrieblicher Effizienz, Datenqualität und Time-to-Market der Produkte. Die Kombination aus KI und Serverless-Ansatz unterstützte die Verarbeitung hoher Dokumentenvolumina, während sich das System an den tatsächlichen Bedarf anpasst und auch bei steigender Last zuverlässig skaliert.

KPI 1: Verarbeitungsgeschwindigkeit

  • Baseline: 15–20 Min./Dokument.

  • Ergebnis: durchschnittlich 1:45 Min./Dokument.

  • Auswirkung: rund 90 % schnellere Verarbeitung und deutlich schnellere Übernahme von Produkten in den Katalog.

KPI 2: Datengenauigkeit

  • Baseline: 93–95 % bei manueller Verarbeitung.

  • Ergebnis: 98,6 % nach der Validierung.

  • Auswirkung: weniger Reklamationen und eine bessere Qualität der Full‑Text‑Suche.

KPI 3: Kosteneffizienz

  • Ergebnis: rund 40 % geringere Kosten für das Datenteam.

  • Auswirkung: niedrigere OPEX und mehr Ressourcen für die Weiterentwicklung von Katalog und UX.

Betriebliche Vorteile:

  • Skalierbare parallele Verarbeitung von Tausenden Dokumenten.

  • Bessere Versionierung und Auditierbarkeit der Daten mit DynamoDB und CloudWatch Logs.

  • Unterstützung mehrerer Sprachen (SK/EN/DE) durch Amazon Comprehend und custom NLP.

„Die automatisierte Dokumentenverarbeitung hat routinemäßige Aufgaben reduziert und unserem Team ermöglicht, sich stärker auf die Qualität des Katalogs zu konzentrieren. Schnellere Produktimporte unterstützen direkt unsere Geschäftsziele.“

Fazit

Das Projekt bestätigte, dass KI-basierte Automatisierung mit einer serverlosen Architektur die Verarbeitung von Produktdokumentation in technisch anspruchsvollen Bereichen beschleunigen und präzisieren kann. Die Lösung ermöglichte dem Kunden, einen zeitaufwendigen manuellen Prozess durch ein agiles, messbares System zu ersetzen, das nach Bedarf skaliert. Die eingesetzten AWS-Services bilden eine Grundlage für die weitere Automatisierung und das Datenmanagement innerhalb der Organisation.

Teilen

Stehen Sie vor einer ähnlichen Herausforderung?

Schreiben Sie uns. Unverbindlich gehen wir durch, was sich in Ihrer Umgebung umsetzen lässt.