Learn Before
Within the model-assisted safety pipeline, what specific role do rule-based reward models (RBRMs) perform during reinforcement learning fine-tuning?
0
1
Tags
Prep Sessions
Transformer Architecture and Large Language Model Capabilities @ University of Michigan - Ann Arbor
Ch.3 Model Alignment and Safety - Transformer Architecture and Large Language Model Capabilities @ University of Michigan - Ann Arbor
Model-Assisted Safety and Rule-Based Reward Models - Transformer Architecture and Large Language Model Capabilities @ University of Michigan - Ann Arbor
Related
Which set of failure modes in standard reinforcement learning from human feedback (RLHF) is the model-assisted safety pipeline designed to address?
Within the model-assisted safety pipeline, what specific role do rule-based reward models (RBRMs) perform during reinforcement learning fine-tuning?
Rule-Based Reward Models (RBRMs)