ko-morph-qwen2.5-0.5b-instruct

ko-morph-qwen2.5-0.5b-cpt๋ฅผ KoAlpaca-v1.1a๋กœ ์ง€์‹œ ํŠœ๋‹(SFT)ํ•œ ๋ชจ๋ธ์ž…๋‹ˆ๋‹ค. CPT ๋ชจ๋ธ ์นด๋“œ์— ์žˆ๋Š” ํ˜•ํƒœ์†Œ ํ† ํฌ๋‚˜์ด์ €ยท๊ฐœํ–‰ ๋ถˆ๊ฐ€ยท๋Œ€์กฐ๊ตฐ ์—†์Œ ๋“ฑ์˜ ์ œ์•ฝ์ด ๊ทธ๋Œ€๋กœ ์ ์šฉ๋ฉ๋‹ˆ๋‹ค.

โš ๏ธ ๊ณต์‹ Qwen2.5-0.5B-Instruct์™€ ๋น„๊ตํ•˜์ง€ ๋งˆ์„ธ์š”. ๊ทธ์ชฝ์€ ๋Œ€๊ทœ๋ชจ ๋น„๊ณต๊ฐœ SFT๋ฅผ ๊ฑฐ์นœ ๋ชจ๋ธ์ด๋ผ 21k๊ฑด์งœ๋ฆฌ ํŠœ๋‹(๋ณธ ๋ชจ๋ธ)๊ณผ์˜ ์ฐจ์ด๋Š” ํ† ํฌ๋‚˜์ด์ €ยทCPT๊ฐ€ ์•„๋‹ˆ๋ผ SFT ๊ทœ๋ชจ์—์„œ ์˜ต๋‹ˆ๋‹ค. ์ด ๋ชจ๋ธ์˜ ๊ณต์ •ํ•œ ๋น„๊ต ๋Œ€์ƒ์€ ๊ฐ™์€ ์กฐ๊ฑด์œผ๋กœ SFTํ•œ Qwen2.5-0.5B ์›๋ณธ ๋ฒ ์ด์Šค์ž…๋‹ˆ๋‹ค (ํ‰๊ฐ€ ๊ฒฐ๊ณผ ์•„๋ž˜).

SFT ์„ค์ •

  • ๋ฐ์ดํ„ฐ: beomi/KoAlpaca-v1.1a (์ง€์‹iN ์งˆ๋ฌธ + GPT ์ƒ์„ฑ ๋‹ต๋ณ€)
  • ํ”„๋กฌํ”„ํŠธ ํฌ๋งท: ### ์งˆ๋ฌธ: {instruction} ### ๋‹ต๋ณ€: {output} โ€” ๊ฐœํ–‰ ์—†์Œ (ํ† ํฌ๋‚˜์ด์ €๊ฐ€ \n์„ ์ธ์ฝ”๋”ฉ ๋ชป ํ•จ)
  • seq 768, micro-bs 4, accum 4, 3 epoch, lr 2e-5, ํ”„๋กฌํ”„ํŠธ ๋งˆ์Šคํ‚น (๋‹ต๋ณ€์—๋งŒ loss)
  • Qwen ๋Œ€์กฐ๊ตฐ๊ณผ ๊ต์ง‘ํ•ฉ ์˜ˆ์‹œ๋งŒ ์‚ฌ์šฉ (21,067๊ฑด/99.6%) โ€” ๋‘ ํ† ํฌ๋‚˜์ด์ €์˜ ๊ธธ์ด ์ฐจ์ด๋กœ ์ธํ•œ ํ•™์Šต์…‹ ์˜ค์—ผ ๋ฐฉ์ง€

ํ‰๊ฐ€ (๋™์ผ SFT ์กฐ๊ฑด์˜ Qwen2.5-0.5B ๋ฒ ์ด์Šค์™€ ๋น„๊ต)

ํ‰๊ฐ€ ๋ณธ ๋ชจ๋ธ Qwen ์›๋ณธ
๋ฌธ๋ฒ• ์ตœ์†Œ๋Œ€๋ฆฝ์Œ (334์Œ) 327/334 (97.9%) 293/334 (87.7%)
ํ•œ๊ตญ์–ด ์ง€์‹ยท์ƒ์‹ (8๋ฌธํ•ญ) ์ •ํ™• 3 / ๋ถ€๋ถ„ 3 / ์˜ค๋‹ต 2 ์˜ค๋‹ต 8
์ผ๋ฐ˜ ์ถ”๋ก  (10๋ฌธํ•ญ) ์ •๋‹ต 2 / ๋ถ€๋ถ„ 1 ์ •๋‹ต 3

McNemar p = 1.95ร—10โปโธ (๋ฌธ๋ฒ• ํ‰๊ฐ€). ์ด ๊ฒฉ์ฐจ๊ฐ€ ํ˜•ํƒœ์†Œ ํ† ํฌ๋‚˜์ด์ € ๋•Œ๋ฌธ์ธ์ง€, 2.5B ํ† ํฐ ํ•œ๊ตญ์–ด CPT ์ž์ฒด ๋•Œ๋ฌธ์ธ์ง€๋Š” ๋ถ„๋ฆฌ๋˜์ง€ ์•Š์Šต๋‹ˆ๋‹ค โ€” ๋Œ€์กฐ๊ตฐ(์ผ๋ฐ˜ BPE + ๋™์ผ CPT)์ด ์—†๊ธฐ ๋•Œ๋ฌธ์ž…๋‹ˆ๋‹ค.

์‚ฐ์ˆ ยทํ˜•์‹๋…ผ๋ฆฌ ์ถ”๋ก ์€ Qwen ์›๋ณธ์ด ๋” ๋‚ซ์Šต๋‹ˆ๋‹ค (300ร—4=1200 ๋“ฑ). Qwen2.5๋Š” ์ˆ˜ํ•™ยท์ฝ”๋“œ๋ฅผ ๋Œ€๋Ÿ‰ ์‚ฌ์ „ํ•™์Šตํ–ˆ๋Š”๋ฐ ๊ทธ ์œ„์— ํ•œ๊ตญ์–ด ์›น ํ…์ŠคํŠธ๋งŒ ์–น์€ CPT๋ผ catastrophic forgetting ์ •ํ™ฉ์œผ๋กœ ๋ณด์ž…๋‹ˆ๋‹ค.

์‚ฌ์šฉ๋ฒ•

from transformers import AutoModelForCausalLM, AutoTokenizer
import torch

tok = AutoTokenizer.from_pretrained("wwwcomcom/ko-morph-qwen2.5-0.5b-instruct")
model = AutoModelForCausalLM.from_pretrained("wwwcomcom/ko-morph-qwen2.5-0.5b-instruct", dtype=torch.float16)

prompt = "### ์งˆ๋ฌธ: ํ•œ๊ตญ์˜ ์ˆ˜๋„๋Š” ์–ด๋””์•ผ? ### ๋‹ต๋ณ€:"
ids = tok(prompt, return_tensors="pt").input_ids
out = model.generate(ids, max_new_tokens=128, do_sample=False)
print(tok.decode(out[0], skip_special_tokens=True))

๊ฐœํ–‰์ด ์žˆ๋Š” ํ”„๋กฌํ”„ํŠธ๋‚˜ ChatML ํฌ๋งท์€ ์“ฐ์ง€ ๋งˆ์„ธ์š” โ€” ํ•™์Šต ๋•Œ ๋ณธ ์ ์ด ์—†์–ด ์„ฑ๋Šฅ์ด ๋–จ์–ด์ง‘๋‹ˆ๋‹ค.

๋ผ์ด์„ ์Šค

Qwen2.5-0.5B ๊ธฐ๋ฐ˜ ํŒŒ์ƒ ๋ชจ๋ธ๋กœ Apache 2.0์„ ๋”ฐ๋ฆ…๋‹ˆ๋‹ค.

Downloads last month
221
Safetensors
Model size
0.4B params
Tensor type
F16
ยท
Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support

Model tree for wwwcomcom/ko-morph-qwen2.5-0.5b-instruct

Finetuned
(1)
this model