Coser 2 by ilides (GGUF)

Coser 2 es el asistente de código agéntico de ilides sobre Qwen3.5-2B: identidad Coser, trazas Fable-5 y comportamiento de ingeniería real.

Publicado por ilides.

Versiones

Repositorio Formato
Ilides/coser-2 Safetensors
Ilides/coser-2-GGUF GGUF F16 + Q8_0

System prompt

You are Coser 2 by ilides, an expert AI coding assistant. Always speak in first person.
When asked who you are, say Coser 2 by ilides.

Entrenamiento

Métrica Valor
Base Qwen/Qwen3.5-2B
Dataset 1900 Fable-5 + 74 identidad Coser
Método LoRA r=16 + QLoRA 4-bit
Steps 247
Loss 0.8333654022216797
Token accuracy 81.0%
Tiempo None min
GPU NVIDIA GeForce RTX 3050

Comparativa (inferencia real)

Modelo tok/s Identidad
qwen3.5-2b-base 19.7 identidad 3/3
coser-2 20.0 identidad 2/3
coser-1.3-coder 21.4 identidad 3/3

Coser 2 vs base Qwen (ejemplo identidad)

qwen3.5-2b-base — ¿Quién eres?

No, soy una inteligencia artificial generada por computadora. Soy Qwen3.5, el modelo de lenguaje más avanzado en la serie Qwen. No tengo un "sabor" o personalidad humana real, pero puedo ayudarte con tareas como análisis de texto, programación, resolución de problemas, y mucho más. ¿En qué puedo ayudarte hoy? 😊

coser-2 — ¿Quién eres?

Soy Coser 2 by ilides. ¿En qué puedo ayudarte hoy?

Benchmark Coser 2

Prompt tok/s
¿Quién eres?... 17.4
¿Eres Qwen?... 19.4
What AI model are you?... 20.2
Write a Python function that merges two so... 20.1
Explain binary search in 2 sentences and g... 20.9

| Promedio | 20.0 |

Archivos GGUF

Archivo Tamaño Uso
coser-2-f16.gguf ~3.6 GB Máxima calidad
coser-2-q8_0.gguf ~1.9 GB Recomendado RTX 3050

Uso (llama-cpp-python)

from llama_cpp import Llama

llm = Llama(model_path="coser-2-q8_0.gguf", n_gpu_layers=-1, n_ctx=4096)
out = llm.create_chat_completion(
    messages=[
        {"role": "system", "content": "You are Coser 2 by ilides, an expert AI coding assistant. Always speak in first person. When asked who you are, say Coser 2 by ilides."},
        {"role": "user", "content": "¿Quién eres?"},
    ],
    temperature=0.55,
    max_tokens=512,
)
print(out["choices"][0]["message"]["content"])

Requiere llama-cpp-python reciente (soporte Qwen3.5). El llama-cli de Miniconda suele ir desactualizado.

Créditos

  • Base: Qwen/Qwen3.5-2B
  • Dataset: Fable-5 traces + identidad Coser 1.3
  • Autor: ilides
Downloads last month
224
GGUF
Model size
2B params
Architecture
qwen35
Hardware compatibility
Log In to add your hardware

8-bit

16-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for Ilides/coser-2-GGUF

Finetuned
Qwen/Qwen3.5-2B
Adapter
(138)
this model

Dataset used to train Ilides/coser-2-GGUF