🍁 Maple Server for Windows x64 (CUDA 12.8) — RTX 5060 Ti
首个公开可复现的 Windows 11 原生运行 Maple 模型的方案,专为 NVIDIA RTX 5060 Ti (Blackwell sm_120) 优化。
📥 下载预编译二进制包
预编译包已包含全部依赖(CUDA 12.8 运行库、OpenSSL、VC++ 运行库),解压即用。
✨ 核心特性
- ✅ 架构适配:编译参数
CMAKE_CUDA_ARCHITECTURES=120,完美匹配 RTX 5060 Ti 的 Blackwell 架构 - ✅ 模型支持:基于
deepgrove-ai/llama.cpp分支,原生支持maple架构 - ✅ 依赖闭环:静态链接 OpenSSL + VC++ 运行库,开箱即用
- ✅ 云端编译:GitHub Actions 自动构建并发布到 Releases
📋 系统要求
- Windows 11 23H2+
- 支持 CUDA 12.8 的 NVIDIA 驱动(RTX 5060 Ti 用户默认满足)
- Visual C++ 2015-2022 Redistributable (x64)
🚀 快速开始
- 从 [https://github.com/vokj900/maple-windows-rtx50-native/releases) 下载
maple-server-rtx5060ti-cuda12.8.zip并解压到纯英文目录(如D:\maple_run) - 将 Maple 模型权重(如
maple-preview-TQ1_0-head-F16.gguf)放入同目录 - 在该目录打开 PowerShell,运行:
- powershell .\llama-server.exe -m maple-preview-TQ1_0-head-F16.gguf --jinja --host 0.0.0.0 --port 8080 -ngl 999 -t 16 --reasoning-preserve
- 浏览器访问
http://localhost:8080
🔧 自行编译
详情见 GitHub 仓库:[https://github.com/vokj900/maple-windows-rtx50-native)
Fork 后点击 Actions → Run workflow 即可自动编译并发布到 Releases。
📄 许可
- 代码:MIT License (llama.cpp)
- CUDA 组件:NVIDIA EULA
- Maple 模型权重:请遵循 deepgrove-ai 的相关许可
如果你的 RTX 50 系列显卡成功跑起来了,欢迎在 GitHub Issues 里反馈!