🍁 Maple Server for Windows x64 (CUDA 12.8) — RTX 5060 Ti

首个公开可复现的 Windows 11 原生运行 Maple 模型的方案,专为 NVIDIA RTX 5060 Ti (Blackwell sm_120) 优化。

📥 下载预编译二进制包

👉 GitHub Releases 下载最新版

预编译包已包含全部依赖(CUDA 12.8 运行库、OpenSSL、VC++ 运行库),解压即用。

✨ 核心特性

  • 架构适配:编译参数 CMAKE_CUDA_ARCHITECTURES=120,完美匹配 RTX 5060 Ti 的 Blackwell 架构
  • 模型支持:基于 deepgrove-ai/llama.cpp 分支,原生支持 maple 架构
  • 依赖闭环:静态链接 OpenSSL + VC++ 运行库,开箱即用
  • 云端编译:GitHub Actions 自动构建并发布到 Releases

📋 系统要求

🚀 快速开始

  1. 从 [https://github.com/vokj900/maple-windows-rtx50-native/releases) 下载 maple-server-rtx5060ti-cuda12.8.zip 并解压到纯英文目录(如 D:\maple_run
  2. 将 Maple 模型权重(如 maple-preview-TQ1_0-head-F16.gguf)放入同目录
  3. 在该目录打开 PowerShell,运行:
  4. powershell .\llama-server.exe -m maple-preview-TQ1_0-head-F16.gguf --jinja --host 0.0.0.0 --port 8080 -ngl 999 -t 16 --reasoning-preserve
  5. 浏览器访问 http://localhost:8080

🔧 自行编译

详情见 GitHub 仓库:[https://github.com/vokj900/maple-windows-rtx50-native)

Fork 后点击 ActionsRun workflow 即可自动编译并发布到 Releases。

📄 许可

  • 代码:MIT License (llama.cpp)
  • CUDA 组件:NVIDIA EULA
  • Maple 模型权重:请遵循 deepgrove-ai 的相关许可

如果你的 RTX 50 系列显卡成功跑起来了,欢迎在 GitHub Issues 里反馈!

Downloads last month

-

Downloads are not tracked for this model. How to track
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support