Este conteúdo ainda está em francês
A página está traduzida, mas o conteúdo detalhado ainda não. As fichas, os guias e os catálogos continuam em francês: preferimos mostrar-lhe o original a uma tradução automática aproximada. Ver o site em francês
Compiler llama.cpp pour tirer le maximum du processeur
Étape 4 sur 7
Récupérer un modèle GGUF
shell
pip install -U "huggingface_hub[cli]"
hf download unsloth/Qwen3-4B-GGUF Qwen3-4B-Q4_K_M.gguf \
--local-dir ./modeles
ls -lh ./modeles
Si Ollama est déjà installé, ses modèles sont sur le disque dans ~/.ollama/models/blobs/ : les fichiers volumineux sont des GGUF utilisables tels quels.