Apolo Korax

Apolo Korax es un modelo pequeño especializado en la extracción conservadora de requisitos explícitos desde avisos laborales en español.

Este repositorio contiene la distribución GGUF utilizada por el harness Apolo Korax.

Modelo

  • Base oficial: Qwen/Qwen3.5-4B
  • Fuente usada para entrenamiento: unsloth/Qwen3.5-4B
  • Fine-tuning: LoRA
  • Rank: 8
  • Alpha: 16
  • Dropout: 0.05
  • Épocas: 4
  • Learning rate: 3e-5
  • Entrenamiento: BF16/FP16, sin QLoRA
  • Exportación: LoRA fusionado a 16-bit, convertido a GGUF y cuantizado
  • Cuantización publicada: Q4_K_M
  • Modalidad: texto

Aunque el modelo base incluye capacidades multimodales, esta exportación fue producida como un modelo exclusivamente textual. No incluye proyector visual ni debe presentarse como un modelo de visión.

Archivo

apolo-korax-qwen3.5-4b-lora-r08-v0.1.0-Q4_K_M.gguf

  • Tamaño: 2708804576 bytes
  • SHA-256: e599efff5aa935f1582b2b6e23de034ed497b031b73432fb78e25e5ee790d85d

Uso previsto

El modelo está diseñado para:

  • extraer requisitos explícitos desde avisos laborales;
  • conservar evidencia textual literal;
  • generar objetos JSON compatibles con el schema de Apolo;
  • apoyar pre-etiquetado y revisión humana;
  • ejecutarse localmente mediante llama.cpp.

Uso no previsto

No debe utilizarse para:

  • inferir requisitos que no aparecen en el texto;
  • tomar decisiones de contratación;
  • predecir empleabilidad individual;
  • recomendar una única carrera correcta;
  • reemplazar revisión humana;
  • procesar imágenes o audio.

Evaluación

En el benchmark inicial sobre un conjunto dev pequeño, la configuración Qwen3.5-4B LoRA r=8 obtuvo:

  • Evidence F1: 0.2581
  • Critical error rate: 0.9500
  • Rendimiento medido en una NVIDIA L4: aproximadamente 101.69 jobs/h

Estos resultados corresponden a un conjunto pequeño y no representan una garantía de desempeño productivo. El modelo todavía presenta diferencias de granularidad y normalización respecto del conjunto gold.

El harness añade validación estructural, constrained decoding, recuperación mecánica y comprobaciones de evidencia. El desempeño del modelo no debe confundirse con el cumplimiento del contrato impuesto por el harness.

Ejecución

llama-server \
  -m apolo-korax-qwen3.5-4b-lora-r08-v0.1.0-Q4_K_M.gguf \
  --reasoning off \
  -c 4096 \
  -t 8 \
  --host 127.0.0.1 \
  --port 8080

Licencia

Este modelo deriva de Qwen/Qwen3.5-4B, publicado bajo Apache License 2.0.

Consulte además la licencia y el model card del modelo base.

Downloads last month
7
GGUF
Model size
4B params
Architecture
qwen35
Hardware compatibility
Log In to add your hardware

4-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for astrla/apolo-korax

Finetuned
Qwen/Qwen3.5-4B
Adapter
(479)
this model