Instructions to use dougdotcon/douvras-ptbr-enterprise-assistant-lora with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- PEFT
How to use dougdotcon/douvras-ptbr-enterprise-assistant-lora with PEFT:
from peft import PeftModel from transformers import AutoModelForCausalLM base_model = AutoModelForCausalLM.from_pretrained("HuggingFaceTB/SmolLM2-360M-Instruct") model = PeftModel.from_pretrained(base_model, "dougdotcon/douvras-ptbr-enterprise-assistant-lora") - Notebooks
- Google Colab
- Kaggle
Douvras PT-BR Enterprise Assistant — LoRA experimental
Adaptador LoRA experimental para HuggingFaceTB/SmolLM2-360M-Instruct. Ele foi treinado em
CPU com exemplos sintéticos de saída estruturada. Este repositório contém somente o adaptador,
tokenizer e metadados; os pesos do modelo-base devem ser baixados do repositório original.
Importante: este é um checkpoint de pesquisa, não um modelo pronto para produção. Na
avaliação local registrada em 07_PTBR_ENTERPRISE_AI_EVAL, o adaptador marcou 0/12 no
recorte de structured_output usado para a seleção. Publiquei o resultado justamente para que
essa falha seja reproduzível e não seja confundida com uma melhoria comercial.
Uso
from peft import PeftModel
from transformers import AutoModelForCausalLM, AutoTokenizer
base = "HuggingFaceTB/SmolLM2-360M-Instruct"
tokenizer = AutoTokenizer.from_pretrained(base)
model = AutoModelForCausalLM.from_pretrained(base)
model = PeftModel.from_pretrained(model, "dougdotcon/douvras-ptbr-enterprise-assistant-lora")
Treino e avaliação
- 80 exemplos sintéticos de SFT, uma época, rank LoRA 8, alpha 16, dropout 0,05.
- Learning rate
2e-4, batch efetivo 1, comprimento máximo 768, AdamW, CPU bf16. - Tempo registrado: 66.052 s; custo financeiro direto: zero (máquina local).
- O benchmark público relacionado é
dougdotcon/douvras-ptbr-enterprise-ai-evaluation. - O conjunto de teste do benchmark não foi usado no treino.
O resultado negativo e os arquivos brutos permanecem no laboratório local. Não há alegação de ganho sobre o modelo-base; o uso recomendado é inspeção, reprodução e melhoria controlada.
Escopo e segurança
O adaptador não diagnostica, não decide por profissionais e não deve enviar mensagens, executar pagamentos, publicar conteúdo ou operar sistemas sem revisão humana. O benchmark é sintético e não mede desempenho em produção.
Licença
Os arquivos do adaptador neste repositório são publicados sob Apache-2.0. O modelo-base mantém
a licença e os termos de HuggingFaceTB/SmolLM2-360M-Instruct; consulte o repositório upstream
antes de redistribuir ou oferecer serviço comercial.
- Downloads last month
- -
Model tree for dougdotcon/douvras-ptbr-enterprise-assistant-lora
Base model
HuggingFaceTB/SmolLM2-360M