この内容はまだフランス語です
ページ自体は翻訳済みですが、詳細な内容はまだです。機器の解説、ガイド、カタログはフランス語のまま表示されます。粗い機械翻訳よりも原文をお見せするほうがよいと考えました。 フランス語版を見る
Mesurer avant d'optimiser
Étape 1 sur 6
Avant de commencer
- llama.cpp compilé, ou au minimum Ollama installé
- Un wattmètre de prise (environ 15 €) pour la partie énergie
Les trois chiffres
| Chiffre | Ce qu'il mesure | Ce qu'il détermine |
|---|---|---|
| pp — prompt eval (tok/s) | Vitesse de lecture de la question et du contexte | Le délai avant le premier mot |
| tg — text generation (tok/s) | Vitesse de production de la réponse | Le confort de lecture |
| W — watts à la prise | Consommation réelle en charge | Le coût, l'autonomie, l'argument écologique |
Le seuil du confortableEn dessous de 5 tokens par seconde, l'utilisateur attend visiblement. Entre 5 et 10, la réponse arrive à peu près à la vitesse de lecture. Au-delà de 15, la différence ne se perçoit plus.