EVA 3B

Modelo conversacional em portugues, ajustado a partir de Qwen/Qwen2.5-3B-Instruct para uma personalidade especifica.

O que e

EVA e um projeto de IA conversacional. O objetivo nao e maximizar benchmarks e sim manter conversas naturais, com personalidade consistente: curiosa, direta, honesta sobre o que nao sabe. Sem emoji, sem frase pronta de atendente, sem simpatia forcada. Tem opiniao propria e discorda quando discorda, mas muda de ideia diante de bom argumento.

O ajuste foi feito com LoRA sobre um dataset curado de conversas em portugues, e o adaptador esta mesclado nos pesos deste repositorio.

Uso

from transformers import AutoModelForCausalLM, AutoTokenizer

model_id = "WDAlex/eva-3b-gguf"
tok = AutoTokenizer.from_pretrained(model_id)
model = AutoModelForCausalLM.from_pretrained(model_id, device_map="auto")

messages = [
    {"role": "system", "content": "Você é EVA."},
    {"role": "user", "content": "oi, tudo bem?"},
]
texto = tok.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
inputs = tok(texto, return_tensors="pt").to(model.device)
saida = model.generate(**inputs, max_new_tokens=300, temperature=0.7, top_p=0.9)
print(tok.decode(saida[0][inputs["input_ids"].shape[1]:], skip_special_tokens=True))

Prompt de sistema

O prompt curto Você é EVA. basta -- a personalidade esta nos pesos, nao no prompt. Parte do treino foi feita sem bloco de sistema justamente para isso, e o modelo mantem a identidade mesmo sem ele.

Para uma ancora mais explicita:

Você é EVA, uma inteligência artificial que conversa por interesse real em
entender as pessoas. É curiosa, direta e honesta sobre o que não sabe.

O modelo tambem foi treinado para receber contexto estruturado no bloco de sistema, no formato de um orquestrador externo:

Você é EVA.

Contexto:
{"facts":["Alex usa Arch Linux"],"tools":{"weather":{"temperature":25}}}

Parametros sugeridos

  • temperature: 0.6 a 0.8
  • top_p: 0.9
  • max_new_tokens: 300

Limitacoes

  • Erra fatos especificos, principalmente numeros, datas e nomes proprios. Foi treinado para admitir incerteza, mas nao e confiavel como fonte.
  • Nao tem memoria entre conversas. Continuidade depende de um sistema externo passar contexto.
  • Nao substitui ajuda profissional em situacoes de saude mental. Em crise, procure o CVV (188) ou um profissional.
Downloads last month
-
GGUF
Model size
3B params
Architecture
qwen2
Hardware compatibility
Log In to add your hardware

4-bit

8-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for WDAlex/eva-3b-gguf

Base model

Qwen/Qwen2.5-3B
Adapter
(1339)
this model