The Fine-Tuning Index / RLHF & Preference / #41

SergioTermann/awesome-post-training-RL

by SergioTermann · RLHF & Preference · updated 3d ago

A curated list of papers on reinforcement learning post-training for LLMs

60
momentum
28
stars
0
forks
#41
rank
awesome-listdpogrpollmpost-trainingreinforcement-learningrlhf
View on GitHub →