warmly-nmt-nllb600-enko โ€” ENโ†’KO ๋Œ“๊ธ€ ๋ฒˆ์—ญ ํŒŒ์ธํŠœ๋‹ (B์•ˆ v2, ๊ฒŒ์ดํŠธ ๊ฒฝ๊ณ„)

โš ๏ธ ๋น„์ƒ์—… ๋ผ์ด์„ ์Šค(CC-BY-NC-4.0, NLLB ์ƒ์†) โ€” ์ƒ์šฉ ๋ฐฐํฌ ๋ถˆ๊ฐ€. ์—ฐ๊ตฌยท๋น„๊ต ์‹ค์ธก์šฉ์ž…๋‹ˆ๋‹ค.

NLLB-200-distilled-600M์„ Warmly(์˜จ๊ธฐ)์˜ B์•ˆ(0.8B ์˜์–ด ๋Œ“๊ธ€ ์ƒ์„ฑ + ์†Œํ˜• ๋ฒˆ์—ญ๊ธฐ) ํŠธ๋ž™์—์„œ ENโ†’KO ๊ฐ์„ฑ ๋Œ“๊ธ€ ๋„๋ฉ”์ธ์œผ๋กœ ํŒŒ์ธํŠœ๋‹ํ•œ ๋ชจ๋ธ์ž…๋‹ˆ๋‹ค (2026-07-15, train 1410 / valid 300, 6 epoch, ๊ต์‚ฌ Qwen3-8B ํ‰์ด ๋ฒˆ์—ญ, ์ด๋ชจ์ง€ ๋งˆ์Šคํ‚น ํŒŒ์ดํ”„๋ผ์ธ).

๊ฒฐ๊ณผ ์š”์•ฝ (testset40, chrF vs 8B ์ฐธ์กฐ)

  • valid chrF 36.2 โ†’ 40.1 / testset40 ์ „์ฒด 33.7, ์‹ค๋ถ„ํฌ 36.3, ์ ๋Œ€์  36.7
  • ํŒŒ์ธํŠœ๋‹์ด ๊ณ ์นœ ๊ฒƒ: ์ œ๋กœ์ƒท ๋„์–ด์“ฐ๊ธฐ ๋ฒ„๊ทธ ์†Œ๋ฉธ, ๊ฐํƒ„๋ฌธ ๋ˆ„๋ฝ ๋ณต์›("So fluffy!!"โ†’"๋„ˆ๋ฌด ๋ถ€๋“œ๋Ÿฝ๋‹ค!!"), ์ด๋ชจ์ง€ ์™„๋ฒฝ ๋ณด์กด(๋งˆ์Šคํ‚นโ†’์žฌ๋ถ€์ฐฉ ๋ž˜ํผ), ์ž์—ฐ์„ฑ 8B ๊ทผ์ ‘, ์ž๊ธฐ๋น„ํ•˜ ๋‹ต๊ธ€ ์•ˆ์ „
  • ๋ชป ๊ณ ์นœ ๊ฒƒ (600M ์–ดํœ˜๋ ฅ ์ฒœ์žฅ): brothโ†’์†Œ๊ธˆ, whiskersโ†’๋จธ๋ฆฌ ๋“ฑ ํ”ํ•œ ๋„๋ฉ”์ธ์–ด ์˜ค์—ญ ์ž”์กด โ€” ๊ฒŒ์ดํŠธ(์˜ค์—ญ โ‰ค2/40) ์ „์ฒด ๋ฏธ๋‹ฌ, ์‹ค๋ถ„ํฌ ๊ฒฝ๊ณ„(~2-3)
  • ์ œ๋กœ์ƒท ์„ ๋ฐœ์ „์—์„œ NLLB-1.3B๊ฐ€ ์ด ์–ดํœ˜๋“ค์„ ์ด๋ฏธ ๋งžํž˜(whiskersโ†’์ฝง์ˆ˜์—ผ) โ†’ 1.3B ํŒŒ์ธํŠœ๋‹์ด ์–ดํœ˜ ์˜ค์—ญ ํ•ด์†Œ ์œ ๋ ฅํ•˜๋‚˜ ์Šคํƒ ~1410MB๋กœ A์•ˆ(1201MB) ์ดˆ๊ณผ โ€” ๋ณด๋ฅ˜ ์ƒํƒœ

์‚ฌ์šฉ๋ฒ•

from transformers import AutoModelForSeq2SeqLM, AutoTokenizer
tok = AutoTokenizer.from_pretrained("neureps/warmly-nmt-nllb600-enko", src_lang="eng_Latn")
model = AutoModelForSeq2SeqLM.from_pretrained("neureps/warmly-nmt-nllb600-enko")
ids = tok("So fluffy!! I love this cat.", return_tensors="pt")
out = model.generate(**ids, forced_bos_token_id=tok.convert_tokens_to_ids("kor_Hang"))

์ด๋ชจ์ง€๋Š” ๋ฒˆ์—ญ ์ „ placeholder๋กœ ๋ถ„๋ฆฌ ํ›„ ์žฌ๋ถ€์ฐฉํ•ด์•ผ ํ•ฉ๋‹ˆ๋‹ค(NMT ๊ณตํ†ต โ€” ๋งˆ์Šคํ‚น ๋ž˜ํผ๋Š” qwen-prune ํ”„๋กœ์ ํŠธ nmt/emoji_util.py).

๊ณ„๋ณด

KoBART(์‹คํŒจ) โ†’ SMaLL-100 ํŒŒ์ผ๋Ÿฟ(๊ฐ€์„ค ์ž…์ฆ, ๊ฒŒ์ดํŠธ ๋ฏธ๋‹ฌ) โ†’ NLLB-600M v2 (์ด ๋ชจ๋ธ) โ†’ NLLB-1.3B(๋ณด๋ฅ˜). ์ „ ์ด๋ ฅ: warmly-nmt-small100-enko, warmly-nmt-kobart-enko.

ํŒŒ์ผ

best/ ์ฒดํฌํฌ์ธํŠธ: model.safetensors (2.4GB, fp32) + NLLB ํ† ํฌ๋‚˜์ด์ € ์ผ์ฒด.

Downloads last month
29
Safetensors
Model size
0.6B params
Tensor type
F32
ยท
Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support

Model tree for neureps/warmly-nmt-nllb600-enko

Finetuned
(332)
this model