gpt2-124m-variants-sft

Research artifacts: GPT-2 (124M, trained from scratch) supervised-finetuning variants produced under controlled data-composition differences; per-arm, per-seed subfolders; intended for reproducibility and membership/contamination research. Details and provenance will be documented in a future update.

Subfolders

  • sftC_seed20260901
  • sftC_seed20260902
  • sftF_seed20260901
  • sftF_seed20260902
  • sftC1_seed20260901
  • sftC1_seed20260902
  • sftC16_seed20260901
  • sftC16_seed20260902

Loading

from transformers import AutoModelForCausalLM, AutoTokenizer

repo = "XUUUUSID/gpt2-124m-variants-sft"
sub = "sftC_seed20260901"
tok = AutoTokenizer.from_pretrained(repo, subfolder=sub)
model = AutoModelForCausalLM.from_pretrained(repo, subfolder=sub)
Downloads last month

-

Downloads are not tracked for this model. How to track
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support