Logo

๐Ÿš€ Qwen2.5-Coder-7B-Instruct-Uncensored-GGUF

Optimized quantized models for efficient inference

๐Ÿ“‹ Overview

A collection of optimized GGUF quantized models derived from BlossomsAI/Qwen2.5-Coder-7B-Instruct-Uncensored, providing various performance-quality tradeoffs.

๐Ÿ’Ž Model Variants

Variant Use Case Download
Q2_K Basic text completion tasks ๐Ÿ“ฅ
Q3_K_M Memory-efficient quality operations ๐Ÿ“ฅ
Q4_K_S Balanced performance and quality ๐Ÿ“ฅ
Q4_K_M Balanced performance and quality ๐Ÿ“ฅ
Q5_K_S Enhanced quality text generation ๐Ÿ“ฅ
Q5_K_M Enhanced quality text generation ๐Ÿ“ฅ
Q6_K Superior quality outputs ๐Ÿ“ฅ
Q8_0 Maximum quality, production-grade results ๐Ÿ“ฅ

๐Ÿค Contributors

Developed with โค๏ธ by BlossomAI


Star โญ๏ธ this repo if you find it valuable!
Downloads last month
7,048
GGUF
Model size
8B params
Architecture
qwen2
Hardware compatibility
Log In to add your hardware

2-bit

3-bit

4-bit

5-bit

6-bit

8-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support

Model tree for BlossomsAI/Qwen2.5-Coder-7B-Instruct-Uncensored-GGUF