Glossar

Das Vokabular eines maschinenlesbaren Katalogs

17 Begriffe, die auftauchen, sobald Produktdaten von etwas anderem als einem Menschen gelesen werden müssen. Zuerst die Definitionen, dann warum jeder Begriff zählt, wenn Sie einen Katalog zu verkaufen haben.

Abruf

Agentenfähige Produktdaten

#

Produktdaten, die ein KI-Agent ohne Browser, ohne Menschen und ohne Raten abrufen, parsen und zitieren kann — erreichbar unter einer stabilen Adresse, in der ausgelieferten Antwort enthalten statt nachträglich zusammengesetzt, typisiert statt in Fließtext beschrieben und einer Quelle zuordenbar.

Warum es zähltEin Assistent, der Ihre Daten nicht abrufen kann, weicht nicht auf Ihren Prospekt aus; er weicht auf das aus, was ein Dritter über Ihr Teil geschrieben hat, oder auf einen Wettbewerber, dessen Daten er lesen konnte.

Siehe auchStrukturierte DatenServerseitiges RenderingModel Context Protocol

KI-Crawler

#

Ein automatisierter Client, der Webseiten im Auftrag eines KI-Systems abruft, entweder um Trainingskorpora aufzubauen oder um die Frage eines Nutzers live zu beantworten. Jeder Betreiber veröffentlicht eigene User-Agent-Namen, und die beiden Zwecke werden oft von verschiedenen Agenten desselben Betreibers erfüllt.

Warum es zähltSie zu blockieren oder zuzulassen ist nicht eine Entscheidung. Eine Website kann berechtigterweise Trainings-Crawls ablehnen wollen und zugleich für den Agenten, der gerade die Frage eines Käufers beantwortet, vollständig lesbar bleiben — und dieser Unterschied wird pro User-Agent ausgedrückt.

Siehe auchrobots.txtServerseitiges Rendering

Serverseitiges Rendering

auch SSR · client-side rendering · CSR#

Serverseitiges Rendering bedeutet, dass der Inhalt der Seite in dem HTML enthalten ist, das der Server zurückgibt. Clientseitiges Rendering bedeutet, dass der Server eine Hülle zurückgibt und der Inhalt anschließend von JavaScript im Browser zusammengesetzt wird.

Warum es zähltVeröffentlichte Analysen des KI-Crawler-Verkehrs haben ergeben, dass die Crawler der großen Assistenten JavaScript-Dateien abrufen, sie aber nicht ausführen. Für diese Crawler ist ein clientseitig gerenderter Katalog eine leere Seite — unabhängig davon, wie vollständig er für einen Menschen aussieht.

Siehe auchKI-CrawlerAgentenfähige Produktdaten

Generative Engine Optimization

auch GEO · AEO · answer engine optimisation#

Die Praxis, Inhalte für KI-Assistenten abrufbar und zitierbar zu machen, statt sie nur in einer Linkliste platzierbar zu halten. Sie betont Erreichbarkeit, Parsbarkeit, Eindeutigkeit und Zuordenbarkeit, denn das angestrebte Ergebnis ist eine Zitierung innerhalb einer Antwort statt eines Klicks.

Warum es zähltFür einen Katalog ist die Arbeit größtenteils nicht redaktionell. Es geht um Erreichbarkeit, Rendering, Struktur und Identifikatoren — dieselben Dinge, die Produktdaten überall sonst brauchbar machen.

Siehe auchAgentenfähige ProduktdatenServerseitiges Rendering

Golden Set

#

Eine feste Menge von Fragen mit bekannt richtigen Antworten, mit der gemessen wird, ob ein System nach einer Änderung noch richtig antwortet. Jeder Durchlauf wird gegen dieselben erwarteten Antworten bewertet, sodass eine Regression als Zahl auftaucht und nicht als Anekdote.

Warum es zähltOhne eines ist „der Assistent bekommt unsere Teile richtig hin“ ein Eindruck. Mit einem ist es eine Messung, und Sie erfahren an dem Tag davon, an dem es nicht mehr stimmt, statt im Quartal danach.

Siehe auchAgentenfähige Produktdaten

Agenten-Schnittstellen

Model Context Protocol

auch MCP#

Ein offenes Protokoll, um KI-Assistenten Werkzeuge und Daten über eine definierte Schnittstelle bereitzustellen, sodass ein Assistent eine Fähigkeit direkt aufrufen kann, statt eine Webseite auszulesen und zu erraten, was er gefunden hat. Ein Server deklariert die angebotenen Werkzeuge; ein Client entdeckt und ruft sie auf.

Warum es zähltFür einen Katalog ist es der Unterschied zwischen einem Assistenten, der eine Darstellung Ihres Produkts liest, und einem, der Ihrem System eine Frage stellt — parametrische Suche, Teilerecherche, Alternativen, Konformität — und eine typisierte Antwort zurückbekommt.

Siehe auchAgentenfähige ProduktdatenParametrische Suche

llms.txt

#

Eine vorgeschlagene Klartextdatei im Wurzelverzeichnis einer Website, die Sprachmodellen ein kurzes, kuratiertes Verzeichnis dessen gibt, was die Website enthält und wo die substanziellen Inhalte liegen. Sie ist ein Hinweis, keine Kontrolle: Sie sagt einem Modell, was lesenswert ist, nicht was es lesen darf.

Warum es zähltEs ist das billigste Signal, das ein Katalog veröffentlichen kann, und die Verbreitung ist noch gering genug, dass eine Veröffentlichung ein Alleinstellungsmerkmal ist statt Pflichtprogramm.

Siehe auchrobots.txtAgentenfähige Produktdaten

robots.txt

auch Robots Exclusion Protocol#

Die Datei im Wurzelverzeichnis einer Website, die automatisierten Clients mitteilt, welche Pfade sie anfragen dürfen. 2022 von der IETF als RFC 9309 standardisiert, ist sie eine Erlaubniserklärung, an die sich wohlerzogene Crawler halten — keine Zugriffskontrolle und keine Durchsetzung.

Warum es zähltDie meisten Industrieseiten haben ihre Datei geschrieben, bevor es KI-Crawler gab, sodass ihre Haltung zu diesen Crawlern das ist, was eine jahrealte Wildcard-Regel zufällig impliziert. Das ist eine Entscheidung aus Versehen.

Siehe auchllms.txtKI-Crawler

Katalogdaten

Strukturierte Daten

auch schema.org · JSON-LD#

Maschinenlesbares Markup, das in eine Seite eingebettet ist und in einem gemeinsamen Vokabular angibt, worum es auf der Seite geht — für ein Produkt typischerweise der Product-Typ von schema.org, der Identifikatoren, Preis, Verfügbarkeit und Spezifikationen als benannte Felder statt als Sätze trägt.

Warum es zähltEs entfernt den Schritt des Erratens. Ohne es muss eine Maschine herleiten, dass eine Zahl auf der Seite ein Preis ist; mit ihm sagt es die Seite selbst.

Siehe auchGTINHerstellerteilenummerAgentenfähige Produktdaten

Herstellerteilenummer

auch MPN#

Der Identifikator, den ein Hersteller einem Teil zuweist. Anders als eine globale Handelsnummer ist er nur innerhalb dieses Herstellers eindeutig, und in der Praxis wird er uneinheitlich geschrieben — mit und ohne Trennzeichen, mit Suffixen, Verpackungscodes und regionalen Varianten.

Warum es zähltDie meisten Fehler beim Querverweisen sind Fehler bei der MPN-Normalisierung. Erscheint dasselbe Teil in vier Schreibweisen, behandelt ein Assistent es als vier Teile oder ordnet es dem nicht zu, nach dem ein Kunde gefragt hat.

Siehe auchEntitätsauflösungGTIN

GTIN

#

Ein weltweit eindeutiger Identifikator für Handelseinheiten, verwaltet im GS1-System, der die in einem Einzelhandels-Barcode kodierte Nummer umfasst. Anders als eine MPN ist er über alle Hersteller hinweg eindeutig.

Warum es zähltEr ist der stärkste Schlüssel, um ein Produkt systemübergreifend abzugleichen, weshalb KI-Shopping-Oberflächen und Marktplätze zuerst danach fragen.

Siehe auchHerstellerteilenummerStrukturierte Daten

Entitätsauflösung

auch canonicalisation#

Die Entscheidung, dass mehrere Datensätze dasselbe reale Objekt beschreiben, und ihre Zusammenführung zu einer kanonischen Entität, an der die Varianten vermerkt sind. Im Teilekontext umfasst das Teilenummern, Varianten, Verpackungsoptionen und dasselbe Teil, gelistet von mehreren Distributoren.

Warum es zähltEs ist der Unterschied zwischen einem Katalog und einem Graphen. Alternativen, Querverweise und Fragen nach dem, was sonst noch passt, hängen alle davon ab, dies richtig zu machen.

Siehe auchHerstellerteilenummerParametrische Suche

Standards

ETIM

#

Ein offenes, internationales Klassifikationsmodell für technische Produkte. Es definiert Produktklassen und für jede Klasse die beschreibenden Merkmale sowie die Einheiten und Werteliste, die diese Merkmale annehmen dürfen — sodass eine technische Spezifikation herstellerübergreifend vergleichbar wird statt eine Freitexttabelle zu bleiben.

Warum es zähltEs ist in weiten Teilen Europas bereits die gemeinsame Sprache der Elektro-, HLK- und Baustoffversorgung. Ein darauf abgebildeter Katalog ist einer, den ein Assistent, ein Großhändler und eine Aufsichtsbehörde alle gleich lesen können.

Siehe auchECLASSBMEcatParametrische Suche

ECLASS

#

Ein branchenübergreifender Datenstandard zur Klassifizierung und Beschreibung von Produkten und Dienstleistungen, weit verbreitet in Beschaffung und industrieller Automatisierung. Wie ETIM liefert er sowohl eine Klassifikationshierarchie als auch standardisierte Merkmalsdefinitionen.

Warum es zähltWo ETIM Elektro- und Bauprodukte dominiert, ist ECLASS in der industriellen Automatisierung und in Prozessindustrien verbreiteter. Viele Hersteller brauchen beides.

Siehe auchETIMBMEcat

BMEcat

#

Ein weit verbreitetes XML-Format für den Austausch elektronischer Produktkataloge zwischen Lieferanten und Käufern, das üblicherweise nach ETIM oder ECLASS klassifizierte Daten als Nutzlast transportiert.

Warum es zähltSo bewegen sich Katalogdaten bereits zwischen Handelspartnern. Ein Katalog, der sauberes BMEcat erzeugen kann, hat meist die zugrunde liegende Struktur, die eine Agenten-Schnittstelle braucht.

Siehe auchETIMECLASS

Digitaler Produktpass

auch DPP#

Ein strukturierter, maschinenlesbarer Datensatz der Eigenschaften eines Produkts — Materialien, Konformität, Reparierbarkeit, Herkunft —, zugänglich über einen Datenträger am oder beim Produkt. Er wird mit der EU-Ökodesign-Verordnung für nachhaltige Produkte eingeführt, wobei die Pflichten je Produktgruppe durch delegierte Rechtsakte festgelegt werden.

Warum es zähltEr macht maschinenlesbare Produktdaten zu einer gesetzlichen Anforderung statt zu einem Marketingvorteil, für eine wachsende Zahl in die EU verkaufter Waren. Die Arbeit überschneidet sich stark damit, einen Katalog agentenlesbar zu machen.

Siehe auchETIMStrukturierte Daten

Auf die Probe stellen

Der Grader prüft einen echten Katalog gegen das meiste, was auf dieser Seite definiert wird — Crawler-Richtlinie, Rendering, strukturierte Daten, llms.txt, Agenten-Schnittstellen — und bewertet ihn.

Meinen Katalog bewerten