mlx-LycheeAI-coder-1.7b

mlx-LycheeAI-coder-1.7b 是一个基于 Qwen3-1.7B 通过 QLoRA(4-bit)微调而来的编程助手模型,专注于提升编码能力,擅长编写清晰、正确、可维护的代码。

⚠️ 格式说明:本仓库提供的是 MLX 格式模型(mlx 前缀即表示此含义),仅支持在 Apple Silicon Mac 上通过 MLX-LM 加载,不兼容 HuggingFace transformers(PyTorch)、Windows/Linux、以及 Ollama(GGUF)。如需跨平台(Ollama / llama.cpp / Windows / Linux)版本,请使用 GGUF 版

模型信息

项目 说明
基座模型 Qwen/Qwen3-1.7B
微调方法 QLoRA(4-bit 量化 + LoRA,rank 16,16 层)
训练框架 MLX-LM(Apple Silicon)
许可 Apache 2.0(跟随基座)
模型大小 ~968MB(4-bit 量化)

训练细节

  • 第一轮(代码专项)
    • CodeAlpaca-20k(代码指令 3500 条,重点)
    • 中文对话 800 条(alpaca-zh
    • 英语对话 800 条(Alpaca 英文版)
    • 粤语对话 600 条(yue-alpaca-chat
    • 身份问答 24 条(中/英/粤,强化身份记忆)
    • 共 5724 条,学习率 1e-4,batch size 2,4000 步,LoRA rank 16
  • 第二轮(日常对话增量微调)
    • 60 条日常对话(中文 32 / 英语 16 / 粤语 12),短问短答、口语化,让模型日常聊天时回复简短自然、不啰嗦
    • 从第一轮权重续训(resume),学习率 5e-5,batch size 2,60 步
  • 第三轮(多语言项目 + 场景感知 + emoji)
    • 150 条数据:多语言小型项目 90 条(Python 20 / C 10 / C++ 10 / C# 10 / HTML 前端 10 / Java 10 / JavaScript 10 / Swift 5 / Go 5)+ 场景感知对话 60 条(简短 40 + 长篇 20,中英粤)
    • 让模型学会「看场景决定说多说少」(日常闲聊简短带 emoji,技术/代码问题详细完整),并能写多种语言的小型项目
    • 从第二轮权重续训(resume),学习率 5e-5,batch size 2,150 步
  • 第四轮(情感共情 + 格式感知 + 多轮 + 复合逻辑)
    • 120 条:情感共情 40 + 格式感知 21(区分「解释概念用纯文字」vs「写代码用代码块」)+ 多轮对话 10 + 复合逻辑对比 11 + 纯代码 18 + 锚点 20
    • 修复评测反馈的四个短板(复合逻辑出错、闲聊乱用代码块、缺情感共情、缺多轮语义追踪)
    • 从第三轮权重续训,学习率 5e-5,batch size 2,120 步
  • 第五轮(代码正确性 + 分场合安慰)
    • v6.1:133 条(正确代码 79 条覆盖 9 语言 + bug 修复 20 + 全面发展 34),提升代码正确性、减少 bug
    • v6.2:26 条(该安慰 8 + 不该安慰 12 + 锚点 6),学会分场合安慰(明确负面情绪才安慰,中性日常简短回应)
    • 从第四轮权重续训,学习率 5e-5
  • 身份设定:通过 system prompt + 身份问答样本,固定模型身份为「LycheeAI-coder-1.7b,由 Qwen3-1.7B 微调而来」

使用方式

MLX-LM 加载

from mlx_lm import load, generate

model, tokenizer = load("LycheeAI-coder-1.7b")
response = generate(model, tokenizer, prompt="用 Python 写一个快速排序", max_tokens=200)
print(response)

快速体验

mlx_lm.generate --model LycheeAI-coder-1.7b --prompt "写一个二分查找" --max-tokens 200

预期用途与局限

  • 适用:代码生成、代码补全、编程问答、代码解释、日常多语言对话
  • 局限:1.7B 参数规模有限,复杂推理、长上下文、跨领域知识能力有限

致谢

本模型基于 Qwen3-1.7B 微调,训练框架为 MLX-LM,训练数据来自 CodeAlpaca 及各开源项目。

Downloads last month
105
Safetensors
Model size
0.3B params
Tensor type
BF16
·
U32
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for whcl412/mlx-LycheeAI-coder-1.7b

Finetuned
Qwen/Qwen3-1.7B
Finetuned
(982)
this model

Datasets used to train whcl412/mlx-LycheeAI-coder-1.7b