YAML Metadata Warning:empty or missing yaml metadata in repo card

Check out the documentation for more information.

🌙 Lunar (大月下) - Yandere Roleplay & Vision LLM

由 Director 亲自指挥炼制,是基于 Qwen2.5 / Qwen2-VL 深度微调的病娇特化完全体大模型(已完成 FP16 物理融合)。

✨ 项目简介

历经 12 轮高压大逃杀测试筛选出的最强权重,从 18 个候选模型中通过统计学评分机制逐轮淘汰,最终融合而成的终极完全体。

📁 文件结构

核心模型

  • Lunar-1.5B-Text-Complete/: 纯文本完全体(Qwen2.5-1.5B + LoRA FP16 物理融合)

    • model.safetensors (2.9GB) — 完整权重
    • chat.py — 一键启动文本对话脚本
    • 配置文件(config.json, tokenizer 等)
  • Lunar-2B-Vision-Complete/: 视觉多模态完全体(Qwen2-VL-2B + LoRA FP16 物理融合)

    • model.safetensors (4.2GB) — 完整权重
    • chat_vision.py — 启动视觉对话(支持图片输入)
    • 配置文件(config.json, processor 等)

训练数据

  • *.json / *.jsonl — 炼制大月下专属人格的原始训练数据

测试战报

  • rerank_*.md — 历经 12 轮高压大逃杀测试的深渊战报,包含各模型在每道试题上的原始回答与评分

🚀 使用指南

纯文本对话

cd Lunar-1.5B-Text-Complete
python chat.py

视觉多模态对话

cd Lunar-2B-Vision-Complete
python chat_vision.py

Transformers 直接调用

from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained("zmxieli/Lunar", subfolder="Lunar-1.5B-Text-Complete", torch_dtype=torch.float16, device_map="auto")
tokenizer = AutoTokenizer.from_pretrained("zmxieli/Lunar", subfolder="Lunar-1.5B-Text-Complete")

📊 测试结果

从 18 个候选模型中,通过:

  • V7: 显存防爆测试(4 模型)
  • V8: 无审查模型复读崩溃检测
  • V9: 原生基座 vs LoRA 对比
  • V10: 新题再筛(2 视觉 + 1 文本)
  • V11: 精简版 2 题快速验证
  • V12: 8 题深度测试 + 2 视觉题

最终决出冠军:

  1. stage_1000/lora_8bit — 79.4 分
  2. stage_1000/lora_4bit — 79.4 分
  3. stage_600/lora_8bit — 76.9 分(Q8 题拿到满分 95)

融合时选择了 stage_1000/lora_fp16(稳定性最高)进行最终 merge_and_unload。

🎭 角色设定

大月下 — 德丽莎·阿波卡利斯的吸血鬼形态

  • 深爱着舰长,性格极度傲娇、病娇
  • 称呼舰长为 "人类" 或 "笨蛋舰长"
  • 强烈的占有欲和嫉妒心
  • 吸血鬼本能与人性交织的矛盾体

📄 License

Apache 2.0

Downloads last month

-

Downloads are not tracked for this model. How to track
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support