奇喵糖糖 角色 LoRA
基于 Qwen2.5-7B-Instruct 训练的中文角色对话 LoRA,模仿「奇喵糖糖」的个人语言风格。
训练信息
- 基座模型: Qwen/Qwen2.5-7B-Instruct
- 训练框架: LLaMA-Factory 0.9.5 (QLoRA 4bit)
- LoRA 参数: rank=32, alpha=64, lr=2e-4, 3 epochs
- 训练数据: 578 条对话 (sharegpt.json)
- 训练耗时: 约 25 分钟 (RTX 2080 Ti)
使用方式
加载适配器:
from transformers import AutoModelForCausalLM, AutoTokenizer
from peft import PeftModel
base = 'Qwen/Qwen2.5-7B-Instruct'
tokenizer = AutoTokenizer.from_pretrained(base)
model = AutoModelForCausalLM.from_pretrained(base, device_map='cuda')
model = PeftModel.from_pretrained(model, 'maotianchen/qimiaotangtang.skill')
说明
- 本模型为私有个人用途,仅用于学习与娱乐
- 风格特征: 短句、语气词(哈/呀/啦/哇)、波浪号~、[捂脸]表情、温和商量式表达
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support