The Fine-Tuning Index / RLHF & Preference / #76
LLMBook-zh/LLMBook-zh.github.io
by LLMBook-zh · RLHF & Preference · updated 1y ago
《大语言模型》作者:赵鑫,李军毅,周昆,唐天一,文继荣
41
momentum
4,566
stars
348
forks
#76
rank
artificial-intelligencedeep-learningdeep-neural-networksdeep-reinforcement-learningfine-tuninglanguage-modellarge-language-modelsnatural-language-processingnlppretrained-models
View on GitHub →