本文へ移動

この内容はまだフランス語です

ページ自体は翻訳済みですが、詳細な内容はまだです。機器の解説、ガイド、カタログはフランス語のまま表示されます。粗い機械翻訳よりも原文をお見せするほうがよいと考えました。 フランス語版を見る

Régler la latence

Sur un Raspberry Pi 5, comptez environ : deux à quatre secondes de transcription, une à deux secondes avant le premier mot du modèle, moins d'une seconde de synthèse. Le total reste sous les dix secondes, ce qui est acceptable pour un dialogue posé.

  • Passer whisper de small à base divise la transcription par deux, au prix de quelques erreurs.
  • Contraindre la réponse à deux phrases dans le prompt réduit fortement le temps de génération.
  • Découper la réponse en phrases et lancer la synthèse au fil de l'eau donne l'impression d'une réaction immédiate.
  • Garder le modèle chargé (OLLAMA_KEEP_ALIVE) évite plusieurs secondes de rechargement à chaque tour.