AX-3.1-Light-sft_declare_v1 (동전)

skt/A.X-3.1-Light 기반, v0.21과 동일한 5,801건 데이터로 LoRA SFT한 모델입니다. v0.21 대비 target을 자연스러운 선언형("정답은 X입니다.")으로 바꾸고, 프롬프트 지시문 없이도 답을 선언하도록 데이터를 재구성했습니다. 로컬 벤치마크 지표 검증용 실험 모델입니다.

  • 베이스 모델: skt/A.X-3.1-Light
  • 학습 방법: LoRA(r=16, alpha=32, q/k/v/o+gate/up/down proj), lr 5e-5, 1 epoch
  • 목적: 자유 프롬프트에서의 "정답 선언율"이 실제 K-AI 점수와 상관(Spearman +0.90, n=5)이 있다는 로컬 관찰을 검증하기 위한 실험 모델

이전 업로드(AX-3.1-Light-sft_declare_v1)는 병합 과정의 결함으로 가중치에 NaN이 섞여 정상 동작하지 않았습니다. 본 repo가 수정된 정상 아티팩트입니다.

사용 데이터셋 (v0.21과 동일)

Downloads last month
-
Safetensors
Model size
7B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for jwg0830/AX-3.1-Light-sft_declare_v1_fix

Finetuned
(23)
this model