FiscalOxLLM — Stage 0 + 1

Llama-3.1-8B-Instruct fine-tuned sequentially on Stage 0 (SMILES) + Stage 1 (ADMET) datasets using QLoRA.

Details

Property Value
Base Model meta-llama/Meta-Llama-3.1-8B-Instruct
Fine-Tuning Stage Stage 0 → 1
Method QLoRA (r=16, alpha=32)
Precision bfloat16

Usage

from transformers import AutoModelForCausalLM, AutoTokenizer

model = AutoModelForCausalLM.from_pretrained("LLMOX/FiscalOxLLM-stage01")
tokenizer = AutoTokenizer.from_pretrained("LLMOX/FiscalOxLLM-stage01")

inputs = tokenizer("Your prompt here", return_tensors="pt")
outputs = model.generate(**inputs, max_new_tokens=256)
print(tokenizer.decode(outputs[0], skip_special_tokens=True))

Part of Fiscal Ox LLM Research

This model is part of a multi-stage fine-tuning comparison study.

Downloads last month
8
Safetensors
Model size
8B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for LLMOX/FiscalOxLLM-stage01

Finetuned
(3187)
this model