Configuration Parsing Warning:In config.json: "architectures" must be an array
YAML Metadata Warning:empty or missing yaml metadata in repo card
Check out the documentation for more information.
MiniMind-YuHua-dLM(104M,余华风格扩散语言模型)
余华风格生成模型:MiniMind 104M + Masked Diffusion(A2D 迁移 + MDM 迭代去噪)。
训练:
- pretrain:
dllm_pretrain_yuhua_768.pth(4000 条续写对话,warm-start 自 pretrain_gucheng,loss 6.1→4.8) - SFT:
dllm_sft_yuhua_768.pth(CoT 522 条,5 epochs,loss 3.59→2.95)
加载:config.json + tokenizer + model_minimind_dllm.py + 权重(MiniMindForMaskedDiffusion)。
生成:gen_yuhua_compare.py --model dllm --weight dllm_sft_yuhua(迭代去噪 320 token,64 block × 28 步)。
实证结论(与 AR 对比):正文生成弱于 AR——迭代重写在 104M 上放大循环重复, 同提示 30 条中 42% 被质量过滤。详见 GitHub ChineseHardJudgePoem/doc/COT_YUHUA_EXPERIMENTS_REPORT.md 第 5 节。
- Downloads last month
- 15
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support