OneBee companion training corpora: PMB probes, behavioral probe sets, and the SFT / DPO / distillation data behind the Study 001 checkpoints.
Arjhine Ty
arjhinety
AI & ML interests
MoE, Distillation
Recent Activity
updated a collection 1 day ago
OneBee Datasets updated a collection 1 day ago
OneBee Datasets updated a collection 1 day ago
OneBee DatasetsOrganizations
OpenGrad — datasets and evaluation records
Canonical training corpora for OpenGrad experiments, plus evaluation evidence for a run whose weights no longer exist.
-
arjhinety/OpenGrad-ToolPolicy-Canonical-v2
Viewer • Updated • 173k • 94 -
arjhinety/OpenGrad-ToolPolicy-Canonical-v1
Viewer • Updated • 214k • 301 -
arjhinety/OpenGrad-ToolPolicy-Canonical-v2-M0-snapshot
Viewer • Updated • 103k • 181 -
arjhinety/OpenGrad-Qwen3.5-2B-M0-SFT-CorpusV1-evaluation
Preview • Updated • 38
SchemaForge Models
SchemaForge models for structured JSON extraction and schema-aware generation.
OpenGrad Study 001
Qwen3.5-2B tool-policy post-training: every Study 001 checkpoint and corpus, negative results included. Frozen 2026-09-13.
-
arjhinety/OpenGrad-Qwen3.5-2B-M1-DPO-CanonicalV2-Final-v2
Updated -
arjhinety/OpenGrad-Qwen3.5-2B-M1-DPO-CanonicalV2-Final-v2-GGUF
Text Generation • 2B • Updated • 761 -
arjhinety/OpenGrad-Qwen3.5-2B-M0-SFT-CanonicalV2-Final
Text Generation • 2B • Updated • 376 -
arjhinety/OpenGrad-ToolPolicy-Canonical-v2
Viewer • Updated • 173k • 94
OpenGrad — models
Post-training checkpoints for tool-use policy research. Each card states the measured behaviour, rejected checkpoints, and what was not measured.
OneBee Models
OneBee multimodal companion checkpoints: SFT, DPO, distilled, and GGUF releases.
OneBee Datasets
OneBee companion training corpora: PMB probes, behavioral probe sets, and the SFT / DPO / distillation data behind the Study 001 checkpoints.
OpenGrad Study 001
Qwen3.5-2B tool-policy post-training: every Study 001 checkpoint and corpus, negative results included. Frozen 2026-09-13.
-
arjhinety/OpenGrad-Qwen3.5-2B-M1-DPO-CanonicalV2-Final-v2
Updated -
arjhinety/OpenGrad-Qwen3.5-2B-M1-DPO-CanonicalV2-Final-v2-GGUF
Text Generation • 2B • Updated • 761 -
arjhinety/OpenGrad-Qwen3.5-2B-M0-SFT-CanonicalV2-Final
Text Generation • 2B • Updated • 376 -
arjhinety/OpenGrad-ToolPolicy-Canonical-v2
Viewer • Updated • 173k • 94
OpenGrad — datasets and evaluation records
Canonical training corpora for OpenGrad experiments, plus evaluation evidence for a run whose weights no longer exist.
-
arjhinety/OpenGrad-ToolPolicy-Canonical-v2
Viewer • Updated • 173k • 94 -
arjhinety/OpenGrad-ToolPolicy-Canonical-v1
Viewer • Updated • 214k • 301 -
arjhinety/OpenGrad-ToolPolicy-Canonical-v2-M0-snapshot
Viewer • Updated • 103k • 181 -
arjhinety/OpenGrad-Qwen3.5-2B-M0-SFT-CorpusV1-evaluation
Preview • Updated • 38
OpenGrad — models
Post-training checkpoints for tool-use policy research. Each card states the measured behaviour, rejected checkpoints, and what was not measured.
SchemaForge Models
SchemaForge models for structured JSON extraction and schema-aware generation.
OneBee Models
OneBee multimodal companion checkpoints: SFT, DPO, distilled, and GGUF releases.