Zum Inhalt springen
Zurück zum Glossar
Grundlagen

Reinforcement Learning from Human Feedback (RLHF)

Definition

A training technique that refines language model behaviour by learning from human preferences rather than fixed labels. RLHF is a primary method used to align LLMs like ChatGPT and Claude with desired values and reduce harmful outputs.

Verwandte Dienste

Hilfe beim Verständnis von KI Benötigt?

Buchen Sie ein Physical-AI-Eignungsgespräch, um zu besprechen, wie diese KI-Konzepte auf Ihre Branche und Ihre Herausforderungen anwendbar sind.

Reinforcement Learning from Human Feedback (RLHF) | KI-Glossar — LLM, RAG, Fine-Tuning & Kernbegriffe