Strukturierte Datenextraktion aus jedem Sicherheitsdatenblatt.
Über 100 geprüfte Datenpunkte aus Abschnitt 1 bis 16 — strukturierte Werte und textuelle Phrasen, jeder Wert mit Fundstelle im Original. Was im SDB steht, kommt heraus. Nichts wird erfunden.
Jeder Wert stammt aus dem Dokument — und trägt seine Fundstelle mit sich.
Fragt ein Fachanwender bei einem Wert nach, ist die Antwort einen Klick entfernt: die Originalstelle im SDB, Seite und Position. Kein Suchen im PDF, kein Raten — und nichts, was ein Sprachmodell „sinnvoll" ergänzt hat.
Nur Daten aus dem SDB
Fehlt eine Angabe im Dokument, steht da fehlt. SdbHub CORE ergänzt nichts aus Fremddatenbanken und rät nicht.
Evidenz statt Vertrauen
Zu jedem Wert Seite und Position. Im Splitscreen liegt die Originalstelle direkt neben dem extrahierten Feld — prüfen wird zum Blick.
Keine Halluzination
Werte werden extrahiert und validiert, nie generiert. Unsicheres wird gelb markiert und zur Kontrolle ausgewiesen — statt unauffällig durchzulaufen.
Abschnittstreu zugeordnet
Jeder Wert kommt garantiert aus dem Abschnitt bzw. Unterabschnitt, in dem er im SDB steht — keine Vermischung über Abschnitte hinweg.
Abschnitt 1 bis 16 — vollständig erfasst.
Aus jedem Abschnitt zieht SdbHub CORE die relevanten Felder — strukturierte Werte ebenso wie textuelle Phrasen, jeweils mit Evidenz.
Stoff & Lieferant
Gefahren & Kennzeichnung
Zusammensetzung
Erste-Hilfe-Maßnahmen
Brandbekämpfung
Unbeabsichtigte Freisetzung
Handhabung & Lagerung
Expositionsbegrenzung
Physik. & chem. Eigenschaften
Stabilität & Reaktivität
Toxikologie
Umweltbezogene Angaben
Entsorgung
Transport
Rechtsvorschriften
Sonstige Angaben
Feingranular bis zum Vorzeichen
Physikalische Werte mit Operator, Einheit und Bezugsbedingung — nicht als gerundete Zahl.
Einstufung & GHS
Klassifikation, Piktogramme und Signalwort — gegen die extrahierten Phrasen geprüft.
Phrasen mit Volltext
H-/P-/EUH-Codes inklusive Wortlaut — als Code und als textuelle Phrase mit Evidenz.
Sieh live, wie viel mehr SdbHub in Sekunden aus deinen Dokumenten ausliest — präzise, automatisiert und bewertet.
Live ansehenDa, wo OCR und Standard-Lösungen aussteigen.
SDBs sind selten sauber: eingescannt, mehrspaltig, mehrsprachig, mehrere Produkte in einem PDF. Genau dafür ist SdbHub CORE gebaut — nicht nur für das Lehrbuch-PDF.
Scan- & Bildbereiche
Eingescannte Tabellen und in Bilder eingebettete Angaben, an denen OCR und Vision-Modelle scheitern, rekonstruiert unser Close-Verfahren — der Wert geht nicht verloren.
Mehrspaltige Layouts
Zwei- und dreispaltige SDBs werden in korrekter Lesereihenfolge eingelesen — ohne Spalten zu vermischen oder Phrasen über den Umbruch zu zerreißen.
KIT-SDBs erkennen & trennen
Enthält ein Dokument mehrere Produkte, erkennt SdbHub CORE die einzelnen Stoffe und trennt sie in eigenständige Datensätze — jeder mit eigener Evidenz.
Über 16 Sprachen
SdbHub CORE extrahiert sprachunabhängig und ordnet Phrasen normiert zu — auch nicht-lateinische Schriften wie Chinesisch und Sprachen wie Türkisch.
Belegt, geprüft, bewertet.
Zu jedem Wert liefert SdbHub CORE Herkunft, Plausibilität und ein Vertrauensmaß — damit deine Fachanwender den Daten ansehen, worauf sie sich verlassen können.
Pixelgenaue Evidenz
Jeder Wert ist auf den Pixel genau lokalisiert — Seite und Bounding-Box. Wirkt eine Angabe fragwürdig, zeigt die EHS-Umgebung die Originalstelle direkt daneben; die Rückfrage beantwortet sich beim Hinsehen. {"page":3,"x":142,"y":388}
Validierung & Scoring → Ampel
Jedes Feld bekommt ein Konfidenz- und Plausibilitätsmaß. Daraus wird die Ampel: grün bestätigt, gelb kontrollieren, rot fehlt. So arbeitest du gezielt Gelb und Rot ab.
Abgleich mit TRGS & ECHA
Extrahierte Angaben werden gegen TRGS-Zuordnungen und ECHA-Listen auf Konsistenz und Aktualität geprüft. Widersprüche werden sichtbar gemacht, nicht stillschweigend korrigiert.
CAS 67-64-1 · Scoring
Ableitungen sind klar getrennt. Auf Wunsch ergänzt SdbHub CORE Werte, die nicht im SDB stehen (z. B. eine Handschuh-Empfehlung) — immer als „abgeleitet" gekennzeichnet, mit Begründung und nie mit den extrahierten Fakten vermischt.
Enterprise-KI ist mehr als „mal eben ChatGPT".
Präzision entsteht nicht aus einem guten Prompt, sondern aus einem strukturierten Qualitätsprozess — den wir messbar und kontinuierlich betreiben.
SdbHub CORE gegen typische Standard-Lösungen — Fähigkeit für Fähigkeit.
Kein abstrakter Score, sondern konkrete, nachprüfbare Eigenschaften der Extraktion — und wo eine rein modellbasierte Lösung an Grenzen stößt.
| Fähigkeit | SdbHub CORE | Typische Standard-Lösungen |
|---|---|---|
| Pixelgenaue Evidenz – Seite & Bounding Box | – | |
| Abschnittstreue Zuordnung der Werte | ~ | |
| Ampel-Validierung & Scoring je Wert | – | |
| „Fehlt“ statt geraten – keine Halluzination | – | |
| Abgleich gegen TRGS & ECHA | – | |
| Scans & mehrspaltige Layouts (Close-Verfahren) | ~ | |
| KIT-/Multi-Produkt-SDBs erkennen & trennen | – | |
| Über 16 Sprachen inkl. Chinesisch & Türkisch | ~ | |
| Reproduzierbar & versioniert über Modell-Updates | – |
✓ enthalten · ~ teilweise · – nicht enthalten. Einordnung auf Basis eigener Tests und des Austauschs mit Kunden; „typische Standard-Lösungen“ stehen für gängige, rein modellbasierte Ansätze ohne kontrollierte Extraktions-Pipeline.
Eine API-Infrastruktur, auf die du dich verlassen kannst.
Hochverfügbar, horizontal skalierbar und sauber dokumentiert — die Daten landen dort, wo deine Fachanwender ohnehin arbeiten.
{ "name": "Aceton", "cas": "67-64-1", "score": 0.974, "h_phrases": ["H225","H319","H336"], "flash_point": {"op":"<","value":-18,"unit":"°C"}, "lgk": "3", "wgk": 1, "adr": {"un":"1090","class":"3","pg":"II"}, "evidence": {"page":3,"x":142,"y":388}, "validation": ["wgk_pruefen"] }
JSON & Swagger-UI
Strukturiertes JSON je Datensatz, vollständige OpenAPI-Doku und interaktive Swagger-UI zum Ausprobieren.
Evidenz & Versionierung
Jeder Datensatz trägt Fundstelle, Score und Version direkt im JSON.
E-Mail-Agent → Excel
Wer keine Integration baut, schickt SDBs per Mail — der Agent liefert die ausgewerteten Daten als fertige Excel-Datei zurück.
In deine Systeme
Direkt in die bestehende Landschaft:
Höchste Präzision
Getrimmt auf höchste Präzision — mit festen Qualitätsansprüchen an jeden extrahierten Wert.
Flexibel erweiterbar
Neue Felder und Prüfungen kommen laufend dazu. Die API wächst mit deinen Anforderungen.
Skalierbar in der Nutzung
Vom einzelnen SDB bis zum Massenimport ganzer Bestände — ohne Reibung.
Fully managed
Kein Anpassungs-, Wartungs- oder Entwicklungsaufwand. Du integrierst, wir kümmern uns um den Rest.
Häufige Fragen zur Extraktion.
Die wichtigsten Antworten rund um Datenumfang, Evidenz, Sprachen und API.
Was ist SdbHub CORE?
Welche Daten extrahiert SdbHub CORE aus einem Sicherheitsdatenblatt?
Wie verhindert SdbHub CORE halluzinierte oder erfundene Werte?
Was bedeutet pixelgenaue Evidenz?
Welche Sprachen und Dokumenttypen unterstützt SdbHub CORE?
Wie wird SdbHub CORE in bestehende Systeme integriert?
Wie schnell und präzise ist SdbHub CORE?
Schick uns deine schwierigsten SDBs.
Eingescannt, mehrspaltig, mehrsprachig, KIT — egal. Wir zeigen live, welche Daten SdbHub CORE daraus zieht, mit Evidenz und Ampel zu jedem Wert. Die fachliche Bewertung bleibt bei dir.