AI · GTM Glossary
Reinforcement Learning from Human Feedback (RLHF)
Reinforcement Learning from Human Feedback (RLHF)
A training method where humans rate AI responses with thumbs up or thumbs down, and the AI learns from those ratings what 'good' means. ChatGPT learned to be polite and helpful this way, from human feedback instead of programming.
Auf Deutsch
Eine Trainingsmethode, bei der Menschen KI-Antworten mit Daumen hoch oder Daumen runter bewerten und die KI daraus lernt, was 'gut' bedeutet. So wurde ChatGPT höflich und hilfreich: durch menschliches Feedback statt durch Programmierung.
Ready to break into startup GTM?
Apply once, for free, and get matched with startups hiring junior sales, generalist, commercial and techy talent in Berlin, Munich and across Germany.
Apply free