The Fine-Tuning Index / RLHF & Preference / #15
whitecircle/halo
by whitecircle · RLHF & Preference · updated today
Halo is an open-source framework built by White Circle for training large language and multimodal models
73
momentum
573
stars
24
forks
#15
rank
agentasync-rldistributed-trainingfine-tuninggrpolarge-language-modelsllmloramodel-parallelismmoemultimodalpeft
View on GitHub →