YAML Metadata Warning:empty or missing yaml metadata in repo card

Check out the documentation for more information.

int4-xpu

面向 Intel Arc(A770/DG2)XPU 的 INT4 量化扩散模型集合,由 int4-omnixpu 统一加载(需 omni_xpu_kernel 加速后端)。

目录结构

目录 格式 加载方式
w4a16xpu/ wa4 打包 u4(对称 int4,per-group f16 scale) wa4ModelLoader backend=w4a16
tint4/ torchao int4(int32 qdata + per-block zp/scale,支持 QuaRot) wa4ModelLoader(原生 tint4 kernel)或原版 tint4 加载器

两目录内同名/对应模型为同一基底的不同量化格式(1024×1024 输出相似度 corr 0.69-0.92,数值路径不同,非逐字节一致)。

环境与参数

  • 量化前原模型在各自官方仓库;这里只发布量化产物。
  • 测试环境:ComfyUI + 融合加载器 + omni-xpu-kernel(A770/DG2), w4a16 后端 20/20 模型加载通过,显存无溢出(1024×1024,同 seed)。

说明

  • 各模型大小 4-10GB,已启用 Git LFS;全部 20 个已测模型分批上传。
  • tint4/ns/ 为 NSFW 变体,与其它模型同机制加载。
  • 上传中的批次以 ?download=true 外链/仓库文件列表为准,未完成批次稍后补齐。
Downloads last month

-

Downloads are not tracked for this model. How to track
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support