The Fine-Tuning Index / RLHF & Preference / #181

gyunggyung/LLM-Ko-Datasets

by gyunggyung ยท RLHF & Preference ยท updated 7mo ago

๐Ÿ‡ฐ๐Ÿ‡ท Korean LLM Datasets | Pre-training, SFT, DPO, RLHF, CoT | ํ•œ๊ตญ์–ด LLM ๋ฐ์ดํ„ฐ์…‹ ํ๋ ˆ์ด์…˜

19
momentum
44
stars
2
forks
#181
rank
View on GitHub โ†’