Datenannotation ist der Prozess, bei dem Rohdaten mit zusätzlichen Informationen versehen werden, damit KI-Modelle Muster erkennen und Zusammenhänge lernen können. Diese Markierungen bilden eine wichtige Grundlage für Training und Qualität.
Ein Modell kann nur dann sinnvoll lernen, wenn die zugrunde liegenden Daten verständlich aufbereitet sind. Bei Bildern, Texten oder Sprache helfen Annotationen dabei, Inhalte korrekt einzuordnen und Kategorien zu erkennen.
Fehlerhafte oder uneinheitliche Kennzeichnungen wirken sich direkt auf die spätere Leistung des Modells aus („Garbage in, Garbage out“). Deshalb ist die Qualität der Annotation oft entscheidend dafür, ob KI-Systeme zuverlässig oder fehleranfällig arbeiten.