YAML Metadata Warning:empty or missing yaml metadata in repo card
Check out the documentation for more information.
int4-xpu
面向 Intel Arc(A770/DG2)XPU 的 INT4 量化扩散模型集合,由
int4-omnixpu 统一加载(需
omni_xpu_kernel 加速后端)。
目录结构
| 目录 | 格式 | 加载方式 |
|---|---|---|
w4a16xpu/ |
wa4 打包 u4(对称 int4,per-group f16 scale) | wa4ModelLoader backend=w4a16 |
tint4/ |
torchao int4(int32 qdata + per-block zp/scale,支持 QuaRot) | wa4ModelLoader(原生 tint4 kernel)或原版 tint4 加载器 |
两目录内同名/对应模型为同一基底的不同量化格式(1024×1024 输出相似度 corr 0.69-0.92,数值路径不同,非逐字节一致)。
环境与参数
- 量化前原模型在各自官方仓库;这里只发布量化产物。
- 测试环境:ComfyUI + 融合加载器 + omni-xpu-kernel(A770/DG2), w4a16 后端 20/20 模型加载通过,显存无溢出(1024×1024,同 seed)。
说明
- 各模型大小 4-10GB,已启用 Git LFS;全部 20 个已测模型分批上传。
tint4/ns/为 NSFW 变体,与其它模型同机制加载。- 上传中的批次以
?download=true外链/仓库文件列表为准,未完成批次稍后补齐。
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support