Visão geral
O guia de Inferência LLM local baixa o modelo diretamente do Hugging Face — o caminho mais rápido quando o seu NAS tem uma boa ligação. Esta página cobre o caminho offline: baixe o modelo num PC e mova-o para o NAS por USB ou pela sua LAN.
Os passos abaixo usam o mesmo modelo do guia principal — Qwen3.6-35B-A3B-UD-IQ3_XXS.gguf, cerca de 12,3 GB — e a mesma pasta de destino. O padrão de download e transferência funciona com qualquer modelo GGUF.
Antes de começar
- Um PC com acesso à internet
- Cerca de 13 GB de espaço livre no PC e o mesmo no NAS
- Uma pen USB, ou o NAS acessível pela sua LAN
Passo 1: Baixe o modelo no seu PC
A CLI do Hugging Face é a forma mais simples — retoma downloads interrompidos:
pip install -U huggingface_hub |
Também pode baixar a partir da página do modelo num navegador.
Passo 2: Mova o modelo para o NAS
Por USB: copie a pasta models/llm para a pen, ligue-a ao NAS e, no ZimaOS Files, mova a pasta para o diretório models/llm do NAS (crie-o se não existir).
Por LAN: envie o ficheiro a partir do PC com scp. Crie primeiro a pasta de destino no NAS:
ssh <utilizador>@<ip-do-seu-nas> mkdir -p models/llm |
Passo 3: Verifique o ficheiro
Downloads grandes podem corromper-se silenciosamente. No NAS, verifique o tamanho e o checksum:
ls -lh models/llm |
Compare ambos com a ficha do ficheiro na página do modelo — o ficheiro deve ter cerca de 12,3 GB.
Passo 4: Continue a configuração
O modelo está agora em models/llm — exatamente onde o guia de Inferência LLM local o espera. Salte o passo de download desse guia e continue com o arranque do servidor.
Ligações de referência
- Hugging Face – documentação da CLI huggingface_hub
- unsloth – ficha do modelo Qwen3.6-35B-A3B-GGUF