Was ist Data Labelling in der Mode?
Das Hinzufügen von Tags oder Annotationen zu Rohdaten, etwa das Markieren von Kleidungsarten in Bildern, damit Modelle daraus lernen können.
Kurz erklärt
Data Labelling (Datenannotation) ist der Prozess, Rohdaten mit Tags oder Annotationen zu versehen, etwa Kleidungsarten in Bildern zu markieren oder Retourengründe zu kategorisieren, damit Machine-Learning-Modelle daraus lernen können. Einheitliche Labels sind die Grundlage verlässlicher überwachter KI.
Wie funktioniert es in der Praxis?
Überwachtes Machine Learning braucht gelabelte Beispiele. Jemand, oder ein Tool mit menschlicher Kontrolle, muss markieren, welche Fotos einen V-Ausschnitt zeigen, welche Artikel Strickware sind oder welche Retourenkommentare sich auf die Passform beziehen. Der gelabelte Datensatz wird dann zu Trainingsdaten für ein Klassifikationsmodell.
In der Mode umfassen Labelling-Aufgaben häufig:
- Art des Kleidungsstücks, Ausschnitt, Ärmellänge, Muster und Farbe in Produktbildern.
- Material- und Pflegeattribute aus Lieferantendokumenten.
- Retouren- und Reklamationsgründe aus Nachrichten von Endkunden oder Händlern.
- Qualitätsmängel auf Fotos aus der Fabrikinspektion.
Warum ist das wichtig?
Modelle lernen genau das, was ihnen ihre Labels beibringen. Einheitliche Labelling-Regeln sind entscheidend: Verwenden Teams Navy und Dunkelblau austauschbar, lernt das Modell Verwirrung. Gutes Labelling verbessert zudem Produktdaten über KI hinaus, weil dieselben Attributregeln Suche, Filter und Reporting in B2B-Portalen und Onlineshops verlässlicher machen.
Wie nutzt KI es?
KI unterstützt zunehmend auch das Labelling selbst. Ein Modell schlägt Labels vor, und Menschen bestätigen oder korrigieren sie, was weit schneller geht als Labelling von Grund auf. Grosse Vision- und Sprachmodelle können Bilder und Texte vorab labeln, und Active-Learning-Methoden schicken nur die unsichersten Beispiele an menschliche Prüfer. Das ist ein klassisches Human-in-the-Loop-Setup.
Typische Fallstricke
Typische Probleme sind vage Labelling-Richtlinien, zu viele sich überschneidende Kategorien und Teams oder Agenturen, die Regeln unterschiedlich anwenden. Labels veralten zudem, wenn sich die Attributliste ändert. Praktische Absicherungen sind ein gemeinsames Glossar der Attributwerte mit Bildbeispielen, regelmässige Prüfungen der Übereinstimmung zwischen Labellern und ein klarer Verantwortlicher für das Attributmodell, idealerweise verknüpft mit dem Master Data Management.
Häufige Fragen
Warum ist Data Labelling für KI wichtig?
Überwachte Modelle lernen anhand von Beispielen, und die Labels legen fest, was richtig ist. Uneinheitliche oder falsche Labels führen zu Modellen, die dieselben Fehler wiederholen.
Kann KI Modebilder automatisch labeln?
KI kann viele Bilder mit guter Genauigkeit vorab labeln, besonders bei klaren Attributen wie der Art des Kleidungsstücks. Die meisten Teams lassen unsichere oder wichtige Labels aber weiterhin von Menschen prüfen, bevor sie für das Training verwendet werden.