انتقل إلى المحتوى
العودة إلى القاموس
الأساسيات

Reinforcement Learning from Human Feedback (RLHF)

التعريف

A training technique that refines language model behaviour by learning from human preferences rather than fixed labels. RLHF is a primary method used to align LLMs like ChatGPT and Claude with desired values and reduce harmful outputs.

خدمات ذات صلة

تحتاج مساعدة في فهم الذكاء الاصطناعي؟

احجز مكالمة تقييم ملاءمة Physical AI لمناقشة كيفية تطبيق مفاهيم الذكاء الاصطناعي هذه على قطاعك وتحدياتك.

Reinforcement Learning from Human Feedback (RLHF) | مسرد مصطلحات AI — LLM وRAG والضبط الدقيق والمفاهيم الرئيسية