Code-Trainer โ€” Phase 5 GGUF

LoRA adapter from cmndcntrlcyber/qwen14b-code-trainer-v7_mixed merged into Qwen/Qwen2.5-Coder-14B-Instruct and quantized via llama.cpp. Use with llama-cli, llama-server, Ollama, LM Studio, vLLM (experimental GGUF), or text-generation-webui.

Files

  • Qwen2.5-Coder-14B-Instruct-Q4_K_M.gguf
  • Qwen2.5-Coder-14B-Instruct-Q5_K_M.gguf

Quick start (llama-server)

llama-server -m <file>.gguf --host 0.0.0.0 --port 8080 --ctx-size 8192

See src/phase6_inference/server/vllm_serve.sh for the full vLLM serving config used in this project's inference stack.

Downloads last month
-
GGUF
Model size
15B params
Architecture
qwen2
Hardware compatibility
Log In to add your hardware

4-bit

5-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support

Model tree for cmndcntrlcyber/qwen14b-code-trainer-gguf

Base model

Qwen/Qwen2.5-14B
Quantized
(117)
this model