Un serveur d'IA pour toute une classe
Étape 5 sur 7
Dimensionner pour trente élèves
Trente élèves ne posent pas trente questions simultanées. En pratique, la charge se répartit et une file d'attente d'une à deux requêtes suffit — à condition que chaque réponse arrive vite.
| Serveur | Modèle | Élèves simultanés confortables |
|---|---|---|
| Raspberry Pi 5 · 8 Go | Llama 3.2 3B | 3 à 5 |
| Mini-PC N100 · 16 Go | Qwen3 4B | 8 à 12 |
| Mini-PC N100 · 16 Go | Qwen3 8B | 4 à 6 |
| Poste + GPU 8 Go | Qwen3 8B | 20 à 30 |
Si la classe entière doit interroger le modèle en même temps, deux options : un modèle plus petit, ou deux serveurs et une répartition par demi-groupe. La seconde revient souvent moins cher qu'une carte graphique.