The Fine-Tuning Index / RLHF & Preference / #41
SergioTermann/awesome-post-training-RL
by SergioTermann · RLHF & Preference · updated 3d ago
A curated list of papers on reinforcement learning post-training for LLMs
60
momentum
28
stars
0
forks
#41
rank
awesome-listdpogrpollmpost-trainingreinforcement-learningrlhf
View on GitHub →