Inference ist der Arbeitsmodus eines KI-Modells. Das Modell erhält neue Daten und nutzt seine gelernten Parameter, um daraus Antworten, Vorhersagen oder Entscheidungen abzuleiten.
Während im Training das Modell lernt und angepasst wird, findet in der Inference die konkrete Nutzung statt. Sie ist damit der eigentliche Schritt, in dem KI im Alltag sichtbar und praktisch einsetzbar wird.
Ob Chatbot, Spamfilter oder Empfehlungssystem: Überall dort, wo KI auf neue Eingaben reagiert, läuft Inference ab. Geschwindigkeit, Kosten und Qualität hängen dabei stark von Modell und Infrastruktur ab.