1
ML Model Development
hard
A company is fine-tuning a large language model using reinforcement learning from human feedback (RLHF). Which THREE components are typically required?
Select 3 answers
MLA-C01
Study mode — explanations shown
ML Model Development
A company is fine-tuning a large language model using reinforcement learning from human feedback (RLHF). Which THREE components are typically required?
Select 3 answers