cs-v3-adapter-natural-45

概述 (Overview)

本模型為基於 google/gemma-3-4b-it 進行 LoRA 微調之 Adapter 權重。 屬於科展研究 CS-V3 階段(交叉隨機種子評測)之實驗產物。

實驗資訊 (Experiment Details)

  • Base Model: google/gemma-3-4b-it
  • 實驗組別: Natural-language reasoning formatting (Seed 45 Supplementary)
  • 隨機種子 (Seed): 45
  • 資料集: GSM8K 數學推理子集
  • 微調方式: LoRA (Rank 64 / Alpha 128)

狀態註記 (Status & Archival Notice)

  • 目前狀態: 公開存檔 (Public Archive / Historical Benchmark)
  • 用途與說明: 本權重為 CS-V3 階段多隨機種子對照研究的原始微調權重。後續研究已由 CS-V3R 及正式論文實驗 (Formal Runs) 推進。為確保實驗可重現性與數據查核完整性,此處予以公開存檔。
  • 重現與使用:
    from transformers import AutoModelForCausalLM, AutoTokenizer
    from peft import PeftModel
    
    base = AutoModelForCausalLM.from_pretrained("google/gemma-3-4b-it", device_map="auto")
    model = PeftModel.from_pretrained(base, "Yuivdldk/cs-v3-adapter-natural-45")
    
Downloads last month
8
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for Yuivdldk/cs-v3-adapter-natural-45

Adapter
(485)
this model