The Fine-Tuning Index / Training Frameworks / #10

THUDM/slime

by THUDM · Training Frameworks · updated 9d ago

slime is an LLM post-training framework for RL Scaling.

75
momentum
8,446
stars
1,242
forks
#10
rank
View on GitHub →