本文へ移動

この内容はまだフランス語です

ページ自体は翻訳済みですが、詳細な内容はまだです。機器の解説、ガイド、カタログはフランス語のまま表示されます。粗い機械翻訳よりも原文をお見せするほうがよいと考えました。 フランス語版を見る

Mesurer avant d'optimiser Étape 1 sur 6
Avant de commencer
  • llama.cpp compilé, ou au minimum Ollama installé
  • Un wattmètre de prise (environ 15 €) pour la partie énergie

Les trois chiffres

ChiffreCe qu'il mesureCe qu'il détermine
pp — prompt eval (tok/s)Vitesse de lecture de la question et du contexteLe délai avant le premier mot
tg — text generation (tok/s)Vitesse de production de la réponseLe confort de lecture
W — watts à la priseConsommation réelle en chargeLe coût, l'autonomie, l'argument écologique
Le seuil du confortableEn dessous de 5 tokens par seconde, l'utilisateur attend visiblement. Entre 5 et 10, la réponse arrive à peu près à la vitesse de lecture. Au-delà de 15, la différence ne se perçoit plus.