Instructions to use Only1Billy/qwen3-4b-quantvortex-lora with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- PEFT
How to use Only1Billy/qwen3-4b-quantvortex-lora with PEFT:
from peft import PeftModel from transformers import AutoModelForCausalLM base_model = AutoModelForCausalLM.from_pretrained("unsloth/Qwen3-0.6B-unsloth-bnb-4bit") model = PeftModel.from_pretrained(base_model, "Only1Billy/qwen3-4b-quantvortex-lora") - Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- Unsloth Desktop
Qwen3-0.6B QuantVortex Analytics (LoRA)
Descrição do Caso de Negócio
Modelo ajustado via QLoRA para atuar como assistente virtual oficial da QuantVortex Analytics, uma fintech fictícia especializada em análise quantitativa de risco (VortexRisk Engine), rastreamento de proventos (YieldRadar Pro).
- Modelo Base: unsloth/Qwen3-0.6B-unsloth-bnb-4bit
- Dataset de Treinamento: Only1Billy/quantvortex-b3-qna-dataset
- Técnica de Fine-Tuning: PEFT / QLoRA (4-bit, r=8, lora_alpha=16, 3 épocas)
Como Carregar para Inferência
from unsloth import FastLanguageModel
model, tokenizer = FastLanguageModel.from_pretrained(
model_name="Only1Billy/qwen3-4b-quantvortex-lora",
max_seq_length=384,
dtype=None,
load_in_4bit=True,
)
FastLanguageModel.for_inference(model)
messages = [
{"role": "system", "content": "Você é o assistente virtual especializado da QuantVortex Analytics, uma fintech brasileira focada em inteligência quantitativa, análise automatizada de risco e rastreamento de dividendos."},
{"role": "user", "content": "Quais são os planos da VortexCopilot API?"}
]
inputs = tokenizer.apply_chat_template(messages, tokenize=True, add_generation_prompt=True, return_tensors="pt").to("cuda")
outputs = model.generate(input_ids=inputs, max_new_tokens=200, temperature=0.2)
print(tokenizer.decode(outputs[0][inputs.shape[1]:], skip_special_tokens=True))
- Downloads last month
- 24
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support
Model tree for Only1Billy/qwen3-4b-quantvortex-lora
Base model
Qwen/Qwen3-0.6B-Base Finetuned
Qwen/Qwen3-0.6B Quantized
unsloth/Qwen3-0.6B-unsloth-bnb-4bit