概述
本地大模型推理教程直接从 Hugging Face 拉取模型——NAS 网络顺畅时这是最快的方式。本页介绍离线路线:在 PC 上下载模型,再通过 USB 或局域网传到 NAS。
以下步骤使用与主教程相同的模型——Qwen3.6-35B-A3B-UD-IQ3_XXS.gguf,约 12.3 GB——以及相同的目标文件夹。这套「下载 + 传输」流程适用于任何 GGUF 模型。
开始之前
- 一台能上网的 PC
- PC 和 NAS 上各有约 13 GB 可用空间
- 一个 USB 存储设备,或局域网内可访问的 NAS
第一步:在 PC 上下载模型
Hugging Face CLI 最简单,且支持断点续传:
pip install -U huggingface_hub |
也可以在浏览器中从模型页面直接下载。
第二步:把模型传到 NAS
USB 方式:把 models/llm 文件夹复制到 U 盘,插入 NAS,然后在 ZimaOS Files 中把文件夹移动到 NAS 的 models/llm 目录(不存在则先创建)。
局域网方式:在 PC 上用 scp 推送文件。先在 NAS 上创建目标文件夹:
ssh <用户名>@<NAS-IP> mkdir -p models/llm |
第三步:校验文件
大文件下载可能静默损坏。在 NAS 上检查文件大小和校验和:
ls -lh models/llm |
与模型页面上的文件信息比对——文件应约为 12.3 GB。
第四步:继续部署
模型现在位于 models/llm——正是本地大模型推理教程所需的路径。跳过教程中的下载步骤,直接继续启动服务器即可。
参考链接
- Hugging Face – huggingface_hub CLI 文档
- unsloth – Qwen3.6-35B-A3B-GGUF 模型卡