ORBiS Tree

SEARCH · ENGLISH EDITION

Find an AI concept.

Search titles, summaries, article text, source-language titles, and known aliases.

Results for “RLHF”
EN

Fine-tuning

Additional training that adapts a pre-trained model to a narrower task, domain, or behavior.

EN

RLHF

Reinforcement Learning from Human Feedback, a method for aligning model behavior with human preferences.