Modul · Index

Alle Daten. Alle Formate. Eine Wissensschicht.

Der Index versteht strukturierte und unstrukturierte Daten — Tabellen und Verträge, Scans und 3D-Modelle — und macht daraus eine durchsuchbare, berechtigungsbewusste Wahrheit. Für Menschen, die suchen. Für KI, die antwortet. Für Systeme, die saubere Stammdaten brauchen.

1
Wissensschicht für alle Module und Systeme
Alle
Formate — von Excel bis BIM-Modell
100%
berechtigungsbewusst — jede Antwort, jeder Treffer
index · knowledge
Sources
Datasheet_X200.pdf
PDF · scan
Pricelist_Q3.xlsx
Excel
Supplier · Update
Email
Building_B.ifc
BIM / 3D
Golden Record
Quality 98%
Article X200-4417
EAN90083901441733 sources
Price€ 1,284.00by minute
Stock412 pcsERP · live
Datasheetv4 · 12 pagesindexed
Search semantic or structured…
Strukturiert & unstrukturiert

Ein Dokument ist mehr als Text. Der Index versteht alles davon.

Ein gescannter Vertrag enthält Text, Tabellen, Stempel und Unterschriften. Eine Preisliste enthält Struktur. Ein E-Mail-Anhang enthält beides. Der Index zerlegt jede Quelle in das, was sie wirklich ist: Text wird semantisch durchsuchbar, Tabellen werden per SQL abfragbar, Bilder werden beschrieben, Entitäten werden erkannt. Aus einem Dateiberg wird eine Wissensschicht.

  • OCR für Scans und Foto-PDFs — auch alte Bestände werden durchsuchbar
  • Tabellen aus PDFs und Excel als echte Daten: filterbar, aggregierbar, abfragbar
  • Bilder und Diagramme automatisch beschrieben und auffindbar
  • 3D-Gebäudemodelle (IFC/BIM): Bauteile und Eigenschaften als abfragbare Daten
  • Neue Inhalte sind in Sekunden durchsuchbar — Verarbeitung läuft im Hintergrund
index · ingest
Incoming
Contract_2481.pdf
Scanned · 24 pages
OCR · text recognition
Understood as
Text
42 chunks · semantic search
Tables
3 tables · SQL-queryable
Images
5 images · auto-described
Entities
supplier · article · project
Searchable in seconds — text, tables, images
Versteht unter anderem
PDF & ScansWordExcelPowerPointE-MailsHTMLCSVBilderIFC / BIMDatenbank-Tabellen
Wissensgraph

Der Index kennt nicht nur Inhalte. Er kennt Zusammenhänge.

Beim Einlesen erkennt der Index Entitäten — Lieferanten, Artikel, Projekte, Personen — und verknüpft sie über Quellen hinweg. Der Artikel im Datenblatt ist derselbe wie in der Bestellung und im Vertrag. Diese Zusammenhänge machen Suche präziser und KI-Antworten fundierter: Kontext kommt nicht aus einem Dokument, sondern aus allen.

  • Entitäten und Beziehungen automatisch extrahiert — ohne manuelles Verschlagworten
  • Verknüpfungen über Formate hinweg: Vertrag ↔ Artikel ↔ Bestellung ↔ Projekt
  • Suche mit Kontext: verwandte Fakten und Nachbar-Entitäten in jedem Treffer
  • Die Grundlage, auf der Assistants präzise und belegbar antworten
index · graph
TechParts GmbH
supplier
Datasheet_X200.pdf
document
Article X200-4417
12 relations · 4 sources
Order 10382
order
Project Nord
project
Entities & relations · extracted automaticallyacross all formats
Stammdaten-Management

Golden Records: eine bereinigte Wahrheit aus vielen Quellen.

Derselbe Artikel im ERP, im Lieferantenkatalog und im Webshop — mit drei verschiedenen Preisen und zwei Schreibweisen. Der Index führt Quellen zum Golden Record zusammen: dedupliziert, validiert, mit Herkunft pro Feld. Jede Änderung ist versioniert, jede Regel dokumentiert.

  • Zusammenführung und Deduplizierung über Quellsysteme hinweg
  • Herkunft pro Feld: Welcher Wert kommt woher — und warum gilt er
  • Datenqualitätsregeln und Vollständigkeits-Scoring pro Datensatz
  • Versionierung und Änderungshistorie — jeder Stand nachvollziehbar
  • Dokumente, Bilder und Datenblätter direkt am Datensatz — nicht daneben
index · master data
Golden Record
Quality 98%
Article X200-4417
EAN90083901441733 sources
NameRack unit 42UERP · master
Price€ 1,284.00API · live
CategoryRacks / 42Urule
Datasheetv4 · 12 pagesindexed
History
v14
Price updated
Pricing API
v13
Datasheet v4 linked
Index
v12
Duplicate merged
2 sources
v11
Category changed
awaiting approval
Every change versioned · full audit trail
Governance

Sechs Funktionen, die Ihre Daten unter Kontrolle halten.

Wer sieht was, woher kommt ein Wert, und wer hat ihn geändert? Auf diese Fragen hat der Index eingebaute Antworten — von Berechtigungen über Versionierung bis zur Mandantentrennung.

Berechtigungen bei jedem Zugriff

Jede Suche, jede Abfrage respektiert Ihr Berechtigungsmodell — geerbt aus Ihrem Identity Provider, durchgesetzt bis zum einzelnen Suchtreffer.

Versionierung & Audit

Jede Änderung an Inhalten und Stammdaten ist versioniert und einem Verursacher zugeordnet — vollständiger Audit-Trail inklusive.

Herkunft pro Feld

Zu jedem Wert die Quelle: aus welchem System, welchem Dokument, welcher Regel. Keine Blackbox-Daten.

Mandantenfähig

Strikte Trennung pro Mandant — für Konzernstrukturen, Töchter oder Kunden-Setups Ihrer Partner.

Qualitäts-Scoring

Vollständigkeit und Regelkonformität pro Datensatz sichtbar — Datenqualität wird messbar statt gefühlt.

Mehrere Indizes

Getrennte Indizes pro Abteilung, Projekt oder Datendomäne — mit eigenem Lebenszyklus und eigenen Rechten.

Für Menschen & für KI

Einmal indexiert. Überall nutzbar.

Dieselbe Wissensschicht beantwortet die Suche eines Mitarbeiters, die Frage an einen Assistenten und den API-Call eines Drittsystems — mit denselben Daten und denselben Berechtigungen.

Für Menschen
  • Semantische Suche in natürlicher Sprache — über alle Formate
  • Strukturierte Abfragen auf Tabellen: filtern, aggregieren, exportieren
  • Jeder Treffer mit Quelle und Kontext — bis ins Ursprungsdokument
  • Golden Records durchsuchen, prüfen und pflegen
Für KI & Systeme
  • Retrieval-Grundlage für Assistants: Antworten mit Beleg statt Halluzination
  • MCP-Schnittstelle: auch externe KI-Agenten nutzen den Index — mit Berechtigungen
  • REST-API für Drittsysteme: Webshop, Portal, Eigenentwicklung
  • Flows lesen und schreiben direkt — der Index als Drehscheibe der Plattform

Berechtigungen gelten überall gleich: Was ein Nutzer nicht sehen darf, sieht auch seine KI nicht.

FAQ

Fragen zum Index.

Was unterscheidet den Index von einer klassischen PIM- oder MDM-Lösung?
Klassische MDM-Systeme verwalten strukturierte Datensätze. Der Index verwaltet zusätzlich unstrukturierte Inhalte — Verträge, Scans, E-Mails, Bilder, sogar BIM-Modelle — und verknüpft beides: Das Datenblatt hängt am Artikel, der Vertrag am Lieferanten. Dieselbe Schicht dient gleichzeitig als Retrieval-Grundlage für KI.
Wie kommen unsere Bestandsdaten in den Index?
Über Flows: Anbindung an ERP, Dateiablagen, E-Mail-Postfächer und über 200 weitere Systeme. Bestandsdokumente werden per Massenimport eingelesen — inklusive OCR für Scans. Neue Inhalte fließen danach automatisch nach.
Ersetzt der Index unser ERP oder unser DMS?
Nein. Der Index liegt als Wissensschicht über Ihren Systemen: Er liest aus ihnen, führt zusammen und macht durchsuchbar. Führende Systeme bleiben führend — der Index macht ihre Daten nutzbar, auch für KI.
Wie stellt der Index sicher, dass KI-Antworten stimmen?
KI antwortet nur auf Basis indexierter Inhalte, und jede Antwort trägt ihre Quellen. Der Wissensgraph liefert Kontext über Dokumentgrenzen hinweg, Berechtigungen filtern vor der Antwort — nicht danach.
Können wir mit einem Bereich starten statt mit allen Daten?
Ja, und das ist der übliche Weg: ein Index für einen Bereich — etwa Artikelstammdaten oder Projektdokumente — und von dort erweitern. Mehrere Indizes mit eigenen Rechten sind vorgesehen.

Zeigen Sie uns Ihren unübersichtlichsten Datenbestand.

30 Minuten. Wir zeigen Ihnen, wie er als Wissensschicht aussieht — durchsuchbar, bereinigt, bereit für KI.