Qwen3.8-27B RVN + visão + MTP (embutido)

Cérebro RVN de 0bserverx (3 passadas ARA, o ficheiro RVN-Q4_K_M.gguf que eles publicaram sem NextN) + cabeça MTP/NextN enxertada (15/15 tensores blk.64.*, os mesmos que o Qwen original — a ARA não os altera) + projector de visão oficial.

Este combo (RVN 3-pass + NextN dentro + mmproj) não existe no repo do 0bserverx: eles converteram com --no-nextn.

Ficheiros

ficheiro o que é
RVN-Q4_K_M-MTP.gguf texto RVN Q4_K_M com blk.64.nextn 15/15 (~16.8 GB)
mmproj-Qwen3.8-27B-Q8_0.gguf visão oficial ggml-org

Não uses -md / sidecar MTP. O acelerador já está no principal (~251 MiB, não 2.95 GB).

Correr

llama-server \
  -m RVN-Q4_K_M-MTP.gguf \
  --mmproj mmproj-Qwen3.8-27B-Q8_0.gguf \
  --jinja --reasoning off --device CUDA0

24 GB VRAM (RTX 3090 Ti): o Q4 + NextN embutido + mmproj Q8 cabe. Contexto longo come KV à parte.

Linhagem

Qwen/Qwen3.8-27Btrohrbaugh/Qwen3.8-27B-heretic-ara (1× ARA) → 0bserverx RVN (mais 2× ARA, --no-nextn) → este repo (NextN reposto a partir do dador Qwen/pass2 + mmproj oficial).

Apache-2.0. Não afiliado a Qwen, trohrbaugh ou 0bserverx.

Downloads last month
273
GGUF
Model size
0.5B params
Architecture
clip
Hardware compatibility
Log In to add your hardware

4-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for cfigueiroa/Qwen3.8-27B-RVN-vision-MTP