Prototie AI v2 โ€” ํ•œ๊ตญ์–ด ์ถ”๋ก  ํŠนํ™” AI (K-AI ๋ฆฌ๋”๋ณด๋“œ #1 ๋ชฉํ‘œ)

Qwen3-32B ๊ธฐ๋ฐ˜ 3๋‹จ๊ณ„(SFTโ†’GRPOโ†’DARE-TIES) ํ•™์Šต ํŒŒ์ดํ”„๋ผ์ธ์œผ๋กœ ๊ฐœ๋ฐœ๋œ ํ•œ๊ตญ์–ด AI์ž…๋‹ˆ๋‹ค.

ํ•™์Šต ํŒŒ์ดํ”„๋ผ์ธ v2

  • STEP1 SFT: KMMLU + CLIcK + ํ•œ๊ตญ์–ด ์ˆ˜ํ•™ 25K + GSM8K + ๋…ผ๋ฆฌ์ถ”๋ก  ํ•ฉ์„ฑ (Qwen3-32B, LoRA r=64)
  • STEP2 GRPO: 5์ค‘ ๋ณด์ƒ ํ•จ์ˆ˜ ๊ฐ•ํ™”ํ•™์Šต (accuracy / korean / format / reasoning_depth / kmmlu_format)
  • STEP3 DARE-TIES: GRPO(w=0.75) + SFT(w=0.25) ๋ชจ๋ธ ๋ณ‘ํ•ฉ โ€” ์ถ”๋ก  ๋น„์ค‘ ๊ฐ•ํ™”

v2 ์ฃผ์š” ๊ฐœ์„ ์ 

ํ•ญ๋ชฉ v1 v2
๋ฒ ์ด์Šค ๋ชจ๋ธ Qwen3-14B Qwen3-32B (+128% ํŒŒ๋ผ๋ฏธํ„ฐ)
GRPO ๋ณด์ƒ ํ•จ์ˆ˜ 3์ค‘ 5์ค‘ (+reasoning_depth, +kmmlu_format)
DARE-TIES ๋น„์ค‘ GRPO 0.70 GRPO 0.75 (์ถ”๋ก  ๊ฐ•ํ™”)
ํ•™์Šต ๋ฐ์ดํ„ฐ ๋ฒ”์šฉ KMMLU-Pro + MuSR-style + HLE-style ์ถ”๊ฐ€

์‚ฌ์šฉ ์˜ˆ์‹œ

from transformers import AutoModelForCausalLM, AutoTokenizer
import torch

tokenizer = AutoTokenizer.from_pretrained("prototie/prototie-ai-final-v2", trust_remote_code=True)
model = AutoModelForCausalLM.from_pretrained(
    "prototie/prototie-ai-final-v2",
    torch_dtype=torch.bfloat16, device_map="auto", trust_remote_code=True,
)

ํ‰๊ฐ€ ๋Œ€์ƒ ๋ฒค์น˜๋งˆํฌ (K-AI ๋ฆฌ๋”๋ณด๋“œ)

  • KMMLU-Pro: ์ „๋ฌธ์ง ๊ณ ๋‚œ๋„ ์ง€์‹ (๋ฒ•๋ฅ , ์˜ํ•™, ๊ณตํ•™ ๋“ฑ)
  • CLIcK: ํ•œ๊ตญ ๋ฌธํ™”ยท์–ธ์–ดยท์ƒ์‹
  • HLE(Ko): ๊ณ ๋‚œ๋„ ์ถ”๋ก 
  • MuSR(Ko): ๋‹ค๋‹จ๊ณ„ ๋…ผ๋ฆฌ ์ถ”๋ก 
  • Com2-main(ko): ์ƒ์‹ ์ถ”๋ก 
Downloads last month
1
Safetensors
Model size
33B params
Tensor type
BF16
ยท
Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support

Model tree for prototie/prototie-ai-final-v2

Base model

Qwen/Qwen3-32B
Finetuned
(524)
this model