⚡ OzyAssist Model Family (GGUF Quantized Models)

Modelos oficiales afinados y destilados para operar como el cerebro autónomo de OzyAssist en Windows.

🏆 Comparativa de la Familia OzyAssist

Modelo Tamaño GGUF Arquitectura Velocidad Consumo VRAM Caso de Uso Recomendado
OzyAssist-3B-v6-q4_k_m.gguf 1.80 GB Qwen2.5-Coder-3B + CoT + Office P2P ~20-28 t/s ~2.3 GB 🌟 RECOMENDADO (v6 Flagship): Manejo completo de Suite Office (Word 10-20 páginas con saltos nativos OpenXML, Excel multi-hoja con fórmulas nativas =SUM/=AVG, PDFs ejecutivos), búsqueda sub-100ms y trato colaborativo P2P.
OzyAssist-7B-v3-q4_k_m.gguf 4.68 GB Qwen2.5-Coder-7B ~8-14 t/s ~4.3 GB Cerebro Pesado (Maestro): Tareas complejas de programación, redacción extensa y análisis profundo.
OzyAssist-1.5B-v3-q4_k_m.gguf 986 MB Qwen2.5-Coder-1.5B ~50-65 t/s ~1.3 GB Ultra-Ligero Turbo / Voice: Diseñado para comandos rápidos por voz y equipos con recursos muy limitados.

🚀 Mejoras Clave de OzyAssist-3B-v6

  • Suite Office Avanzada: Generación nativa de documentos Word (.docx) de 10 a 20 páginas con capítulos, formateo OpenXML y saltos de página genuinos; libros Excel (.xlsx) de múltiples hojas con fórmulas nativas (=SUM, =AVERAGE, etc.); y generación de informes ejecutivos en PDF.
  • Interacción Conversacional Persona a Persona (P2P): Ante peticiones abiertas o ambiguas, actúa proactivamente como un colega técnico ofreciendo preguntas de seguimiento, recomendaciones y próximos pasos.
  • Búsqueda Ultrarrápida Sub-100ms: Indexación y navegación instantánea por el sistema de archivos de Windows con telemetría de latencia.
  • Destilación CoT (Chain-of-Thought): Razonamiento antes de invocar herramientas para validar precondiciones del sistema Windows.
  • Ultra-Bajo Consumo de VRAM: Requiere solo ~2.3 GB de VRAM, permitiendo operar en conjunto con tareas de desarrollo, streaming o juegos.
Downloads last month
59
GGUF
Model size
2B params
Architecture
qwen2
Hardware compatibility
Log In to add your hardware

4-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for Xangel0s/OzyAssist-7B

Base model

Qwen/Qwen2.5-7B
Quantized
(242)
this model