firela-pa PC — 本地财务隐私路由器(GGUF + 一键安装)

firela-pa 的 PC 形态分发仓:Qwen3-1.7B 任务微调隐私路由模型(fmt-v1.1 五意图: tx 查账 / pf 资产全景 / mkt 行情 / l 本地闲聊 / c 涂黑上云),W8A8 板载同源权重的 GGUF 版(Q4_K_M 为默认分发档,Q8_0 为质量档——两者在 eval200 200 题上门禁逐题全同, G4 97%)。基座 Qwen3-1.7B(Apache-2.0),LoRA 合并权重可再分发。

一键安装(macOS / Linux / WSL2)

bash <(curl -fsSL https://huggingface.co/fxiafx/firela-pa-pc/resolve/main/install.sh)

自动完成:装/起 Ollama → 下载本仓应用与路由模型(sha256 校验)→ 注册 firela-router → 拉生成模型 qwen2.5:3b-instruct(非思考原生 ~1s;--no-gen 可跳过,可在 config 换 qwen3:4b 等思考模型——Ollama think 参数对库版 qwen3 模板不生效,慎用)→ 交互式生成 0600 配置 (vlt / relay 凭证,回车可留空后补)→ Time Machine 排除 → firela-pa 命令 → 冒烟。

隐私边界:推理不出门——路由/闲聊生成全本地;查账走用户自己的 vlt 令牌;上云问句 先经确定性涂黑(身份四类整段替换,详见应用仓设计文档)。

文件 用途
pc-app.tar.gz 编排器 + 涂黑器 + 评测/解析(纯 stdlib Python)
router-merged-Q4_K_M.gguf 路由模型默认档(1.1GB)
router-merged-Q8_0.gguf 路由模型质量档(1.9GB,可选)
install.sh 一键安装脚本
Downloads last month
87
GGUF
Model size
2B params
Architecture
qwen3
Hardware compatibility
Log In to add your hardware

4-bit

8-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support