Ir para o conteúdo

Este conteúdo ainda está em francês

A página está traduzida, mas o conteúdo detalhado ainda não. As fichas, os guias e os catálogos continuam em francês: preferimos mostrar-lhe o original a uma tradução automática aproximada. Ver o site em francês

Guide 4 sur 12

Installer Ollama sur un Raspberry Pi 5

L'installation de référence du projet : préparation du système, choix du stockage, service accessible sur le réseau local, et les réglages qui évitent le bridage thermique.

Démarrer le pas à pas 7 étapes · 1 heure · une étape à l'écran, avec Précédent / Suivant

Niveau Débutant
Durée 1 heure
Étapes 7
Catégorie Installation
Avant de commencer
  • Un Raspberry Pi 5 (8 Go recommandé) avec son alimentation officielle
  • Un SSD NVMe sur adaptateur PCIe, ou à défaut une microSD A2
  • Un dissipateur actif — ce n'est pas optionnel
  • Un accès SSH ou un clavier et un écran
1

Préparer le système

Installez Raspberry Pi OS Lite 64 bits avec Raspberry Pi Imager. La version Lite, sans bureau graphique, libère environ un gigaoctet de RAM — ce qui, sur cette machine, se traduit directement en taille de modèle utilisable.

64 bits obligatoireUne image 32 bits ne fait pas tourner Ollama et plafonne l'adressage mémoire. Vérifiez avec uname -m : la réponse doit être aarch64.
shell
sudo apt update && sudo apt full-upgrade -y
sudo apt install -y curl htop

# Contrôles de base
uname -m          # attendu : aarch64
free -h           # attendu : ~8 Go
vcgencmd measure_temp
2

Démarrer sur SSD

C'est le seul changement matériel qui transforme réellement l'expérience. Charger un modèle de 2,5 Go depuis une microSD prend une trentaine de secondes ; depuis un NVMe, quelques secondes.

config
# Activer le PCIe et sa deuxième génération
sudo rpi-eeprom-config --edit
# ajouter :  PCIE_PROBE=1

# Dans /boot/firmware/config.txt
dtparam=pciex1
dtparam=pciex1_gen=3

sudo reboot

Copiez ensuite le système sur le SSD avec l'outil SD Card Copier de Raspberry Pi OS, ou clonez la partition, puis changez l'ordre de démarrage dans l'EEPROM.

3

Installer Ollama

shell
curl -fsSL https://ollama.com/install.sh | sh

# Le service démarre automatiquement
systemctl status ollama
ollama --version

L'installeur détecte l'architecture ARM64 et pose le binaire adapté. Aucune compilation n'est nécessaire.

4

Choisir le modèle

Sur un Pi 5 8 Go sans interface graphique, le point d'équilibre se situe autour de 3 à 4 milliards de paramètres.

shell
# Recommandé : bon français, licence Apache 2.0
ollama run qwen3:4b

# Plus rapide, pour un usage question-réponse court
ollama run llama3.2:3b

# Sur un Pi 4 en 4 Go, rester ici
ollama run llama3.2:1b
ModèlePoidsDébit indicatif sur Pi 5Ressenti
Llama 3.2 1B0,8 Go12 à 18 tok/sInstantané
Llama 3.2 3B2,0 Go5 à 7 tok/sConfortable
Qwen3 4B2,5 Go4 à 6 tok/sVitesse de lecture
Qwen3 8B4,7 Go1,5 à 2,5 tok/sTrop lent en interactif

Ces valeurs sont des ordres de grandeur : mesurez les vôtres, la méthode est dans le guide Mesurer avant d'optimiser.

5

Ouvrir le service sur le réseau local

Par défaut, Ollama n'écoute que sur la machine elle-même. Pour que les postes de la salle y accèdent, il faut le faire écouter sur le réseau local — et seulement sur le réseau local.

shell
sudo systemctl edit ollama
systemd
[Service]
Environment="OLLAMA_HOST=0.0.0.0:11434"
Environment="OLLAMA_KEEP_ALIVE=10m"
Environment="OLLAMA_NUM_PARALLEL=1"
shell
sudo systemctl daemon-reload
sudo systemctl restart ollama

# Depuis un autre poste du réseau
curl http://IP-DU-PI:11434/api/tags
Ne l'exposez jamais sur internetL'API d'Ollama n'a ni authentification ni limitation de débit. Elle est faite pour un réseau de confiance. Si le Pi est derrière une box, ne redirigez aucun port vers le 11434.
6

Thermique et mémoire

Un Pi 5 sans refroidissement actif se bride au bout de quelques minutes de génération continue, et le débit chute d'un tiers. Le dissipateur officiel suffit.

shell
# Surveiller pendant une génération longue
watch -n 2 'vcgencmd measure_temp; vcgencmd get_throttled'

# 0x0 = aucun bridage. Toute autre valeur = problème thermique ou d'alimentation.

Côté mémoire, activez zram plutôt qu'un fichier d'échange sur disque : la compression en RAM absorbe les pics sans détruire le SSD.

shell
sudo apt install -y zram-tools
echo -e 'ALGO=zstd\nPERCENT=50' | sudo tee -a /etc/default/zramswap
sudo systemctl restart zramswap
7

Vérification finale

  1. systemctl status ollama indique active (running).
  2. ollama ps montre le modèle chargé et sa taille en mémoire.
  3. Une requête depuis un autre poste du réseau reçoit une réponse.
  4. Câble réseau débranché, la génération fonctionne toujours.
  5. vcgencmd get_throttled renvoie 0x0 après cinq minutes de charge.
Et ensuiteAjoutez une interface web pour que les utilisateurs n'aient pas besoin du terminal : un serveur d'IA pour toute une classe.
Raspberry Pi Ollama ARM installation