yuwen-v1: 语文阅读理解微调模型 (GGUF)

模型简介

yuwen-v1 是柠檬桶 (lemonbucket) 的第一个语文微调模型,基于 Qwen3-0.6B 进行 LoRA 微调。

本仓库仅包含 GGUF 格式文件,适合通过 Ollama / llama.cpp 部署,不支持 Transformers 直接加载。

基座模型

项目 说明
模型 Qwen/Qwen3-0.6B
参数量 ~0.6B
微调方式 LoRA (PEFT)

仓库文件

文件 说明 大小
yuwen-v1-f16.gguf F16 半精度 GGUF ~1.1 GB
Modelfile Ollama 部署配置 -

快速开始

Ollama 部署(推荐)

# 1. 下载本仓库的 GGUF 文件和 Modelfile
# 2. 创建 Ollama 模型
ollama create yuwen-v1 -f Modelfile

# 3. 运行
ollama run yuwen-v1

# 或直接通过 API 调用
curl http://localhost:11434/api/generate -d '{
  "model": "yuwen-v1",
  "prompt": "请分析《荷塘月色》中通感手法的运用。",
  "stream": false
}'

llama.cpp

# llama.cpp 基本用法
./llama-cli   -m yuwen-v1-f16.gguf   --temp 0.3 --top-k 20 --top-p 0.85   -p "请分析《荷塘月色》中通感手法的运用。"

系统提示词

你是 yuwen-v1,一个由柠檬桶(LemonBucket)基于 Qwen3-0.6B 通过 LoRA 微调训练的语文知识 AI 助手。你专注于语文知识的解答,包括病句、文章分析、环境描写、叙述顺序、抒情方式等。

评测结果

本系列模型在 2026 年高考语文现代文阅读测试中进行了 9 模型横向评测。

项目 说明
测试标准 2026 年全国 I 卷语文现代文阅读,满分 39 分(选择题 15 分 + 简答题 24 分)
阅卷评判官 GLM-5.2(6 维度评分:答题规范性、长文本处理、基础理解、常识储备、信息准确性、深度分析,满分 60 分)
完整报告 lemonbucket/yuwen-v3 仓库的 yuwen测评/ 目录

关于思考模式 (Thinking Mode)

重要: 由于微调时训练数据中未包含思维链 (<think>) 相关内容,模型的思维链输出存在异常。强烈推荐关闭思考模式使用。

部署方式 关闭方法
Ollama Modelfile 已预配置,无需额外操作
Transformers V3 仓库 chat_template 已修改为默认关闭
其他框架 请勿传入 enable_thinking=True 参数

若上述配置失效(框架升级、模板被覆盖等),请手动修改 Modelfile、chat_template.jinjatokenizer_config.json 中的 chat_template 字段,移除 <think> 相关内容即可。

微调方向

本系列模型专门针对语文现代文阅读理解进行微调,涵盖:

  • 信息类文本阅读(选择题 + 简答题)
  • 文学类文本阅读(选择题 + 简答题 + 续写)
  • 答题规范:分点作答、术语规范、踩分精准

许可证

本模型基于 Apache 2.0 协议开源。

项目 许可
LoRA 适配器权重 Apache 2.0(继承自基座模型)
合并后完整模型权重 Apache 2.0(继承自基座模型)
基座模型 Qwen3-0.6B / Qwen3.5-0.8B Apache 2.0(由 Alibaba Qwen Team 开源)

使用时需同时遵守 Apache 2.0 协议Qwen 模型许可条款

关于作者

我是刚接触模型微调的新手,初次使用 Hugging Face 平台。如果仓库存在不规范之处(文件缺失、配置有误、描述不清等),还请通过邮件反馈:575244421@qq.com,不胜感激!

致谢

Downloads last month
30
GGUF
Model size
0.6B params
Architecture
qwen3
Hardware compatibility
Log In to add your hardware

16-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for lemonbucket/yuwen-v1

Finetuned
Qwen/Qwen3-0.6B
Quantized
(376)
this model