PS Design 1.2 Nano

Versão otimizada, mais leve e mais rápida do PS Design 1.2-beta.

  • Merge do LoRA (r16) direto no Qwen2.5-0.5B-Instruct → modelo standalone, sem dependência de PEFT no inference
  • Mesmos pesos do 1.2-beta (qualidade idêntica), porém sem overhead do adapter (~10-15% mais rápido, carregamento único)
  • use_cache=True, repetition_penalty=1.05, fp16
  • 0.5B params (~943MB fp16) — roda em T4 e até CPU

Uso (sem PEFT)

from transformers import AutoTokenizer, AutoModelForCausalLM
import torch
mid="Pedro21613/PS-design-1.2-nano"
tok=AutoTokenizer.from_pretrained(mid, trust_remote_code=True)
m=AutoModelForCausalLM.from_pretrained(mid, trust_remote_code=True, dtype=torch.float16, device_map="auto").eval()
msgs=[{"role":"system","content":"Você é um designer front-end sênior especialista em páginas bonitas, modernas, minimalistas e profissionais. Sempre responda com código HTML completo, responsivo, usando Tailwind CSS via CDN."},{"role":"user","content":"Crie uma landing page minimalista para cafeteria."}]
p=tok.apply_chat_template(msgs, tokenize=False, add_generation_prompt=True)
i=tok(p, return_tensors="pt").to(m.device)
o=m.generate(**i, max_new_tokens=1200, temperature=0.7, top_p=0.9, do_sample=True)
print(tok.decode(o[0], skip_special_tokens=True))

Derivado de Pedro21613/PS-design-1.2-beta (6200 exemplos).

Downloads last month
512
Safetensors
Model size
0.5B params
Tensor type
F16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 1 Ask for provider support

Model tree for Pedro21613/PS-design-1.2-nano

Finetuned
(1056)
this model