Live ChatGPT verweigert Tool-Calls für app-only MCP-Tools
KI-Lexikon Verfahren

RLHF

Feinschliff von Modellen mit menschlichem Feedback.

Aktualisiert: 18.08.2026

RLHF (Reinforcement Learning from Human Feedback) verbessert Sprachmodelle, indem Menschen Antworten bewerten und diese Bewertungen in ein Belohnungssignal umgesetzt werden. So lernt das Modell, hilfreichere, sicherere und angemessenere Antworten zu geben. RLHF war ein Schlüssel zum Erfolg moderner Chatassistenten.