The Fine-Tuning Index / RLHF & Preference / #15

whitecircle/halo

by whitecircle · RLHF & Preference · updated today

Halo is an open-source framework built by White Circle for training large language and multimodal models

73
momentum
573
stars
24
forks
#15
rank
agentasync-rldistributed-trainingfine-tuninggrpolarge-language-modelsllmloramodel-parallelismmoemultimodalpeft
View on GitHub →