Model Card for Model ID
AI ์ ๋น ๋ฐ์ดํฐ ๋ถ์ ์ ๋ฌธ ๊ธฐ์ ์ธ Linkbricks์ ๋ฐ์ดํฐ์ฌ์ด์ธํฐ์คํธ์ธ ์ง์ค์ฑ(Saxo) ์ด์ฌ๊ฐ NousResearch/Meta-Llama-3.1-8B-Instruct ๋ฒ ์ด์ค๋ชจ๋ธ์ KT-CLOUD์์ H100-80G 4๊ฐ๋ฅผ ํตํด SFT->RLHF->DPO ํ์ธ ํ๋์ ํ ํ๊ธ ์ธ์ด ๋ชจ๋ธ๋ก ํ๊ตญ์ด-์ค๊ตญ์ด-์์ด-์ผ๋ณธ์ด ๊ต์ฐจ ํ์ต ๋ฐ์ดํฐ์ ๋ก์ง์ปฌ ๋ฐ์ดํฐ๋ฅผ ํตํ์ฌ ํ์ค์ผ์ ์ธ์ด ๊ต์ฐจ ์ฆ๊ฐ ์ฒ๋ฆฌ์ ๋ณต์กํ ํ๊ธ ๋ ผ๋ฆฌ ๋ฌธ์ ์ญ์ ๋์ ๊ฐ๋ฅํ๋๋ก ํ๋ จํ ๋ชจ๋ธ์ด๋ฉฐ ํ ํฌ๋์ด์ ๋ ๋จ์ด ํ์ฅ ์์ด ๋ฒ ์ด์ค ๋ชจ๋ธ ๊ทธ๋๋ก ์ฌ์ฉ. ํนํ ๊ณ ๊ฐ ๋ฆฌ๋ทฐ๋ ์์ ํฌ์คํ ๊ณ ์ฐจ์ ๋ถ์ ๋ฐ ์ฝ๋ฉ๋ฑ์ด ๊ฐํ๋ ๋ชจ๋ธ, 128k-Context Window, Tool Calling ์ง์ Deepspeed Stage=3, rslora, flash attention 2 ๋ฅผ ์ฌ์ฉ
Dr. Yunsung Ji (Saxo), a data scientist at Linkbricks, a company specializing in AI and big data analytics, fine-tuned the NousResearch/Meta-Llama-3.1-8B-Instruct base model with SFT->RLHF->DPO using four H100-80Gs on KT-CLOUD. It is a Korean language model trained to handle complex Korean logic problems through Korean-Chinese-English-Japanese cross-training data and logical data, and Tokenizer uses the base model without word expansion.
- Downloads last month
- 436
Model tree for Saxo/Linkbricks-Horizon-AI-Korean-llama3.1-sft-rlhf-dpo-8B
Base model
NousResearch/Meta-Llama-3.1-8B-Instruct