Qwen2.5-Coder-7B-Instruct GGUF (Q3_K_M)

Esta es una versión cuantizada en formato GGUF (Q3_K_M) del modelo original Qwen/Qwen2.5-Coder-7B-Instruct.

Optimizada especialmente para correr de forma ultra fluida en GPUs con espacio de VRAM ajustado (como las tarjetas de 4 GB de VRAM), manteniendo un equilibrio excelente en tareas de desarrollo de software y programación.

Uso directo en Ollama

Puedes descargar e interactuar con este modelo directamente usando Ollama ejecutando:

ollama run hf.co/sarayar/Qwen2.5-Coder-7B-Instruct-GGUF-Q3_K_M
Downloads last month
146
GGUF
Model size
8B params
Architecture
qwen2
Hardware compatibility
Log In to add your hardware

3-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for sarayar/Qwen2.5-Coder-7B-Instruct-GGUF-Q3_K_M

Base model

Qwen/Qwen2.5-7B
Quantized
(210)
this model