The Fine-Tuning Index / RLHF & Preference / #177

ml-jku/L2M

by ml-jku · RLHF & Preference · updated 1y ago

Learning to Modulate pre-trained Models in RL (Decision Transformer, LoRA, Fine-tuning)

20
momentum
60
stars
7
forks
#177
rank
continual-learningdecision-transformersfine-tuningloramultitask-learningreinforcement-learningrobotics
View on GitHub →