Z-Image-Turbo โ€” OpenVINO INT8

OpenVINO IR (INT8) conversion of Tongyi-MAI/Z-Image-Turbo (6B single-stream DiT, 8-step).

Why OpenVINO?

  • Runs on any CPU with no CUDA/NVIDIA dependency, plus GPU acceleration where available (AMD, Nvidia, Intel)
  • INT8 weights fit 8GB VRAM cards; 8-step Turbo stays sub-second
  • Smaller downloads vs BF16 checkpoints

Conversion

Parameter Value
Tool optimum-cli export openvino --weight-format int8 (device-neutral, no vendor passes)
Precision INT8 weights
Source Tongyi-MAI/Z-Image-Turbo (Apache-2.0)

Usage (any device)

import openvino as ov
core = ov.Core()  # auto-picks CPU/GPU available on your machine
model = core.read_model("model.xml")
compiled = core.compile_model(model, "AUTO")
Downloads last month

-

Downloads are not tracked for this model. How to track
Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support