Este conteúdo ainda está em francês
A página está traduzida, mas o conteúdo detalhado ainda não. As fichas, os guias e os catálogos continuam em francês: preferimos mostrar-lhe o original a uma tradução automática aproximada. Ver o site em francês
Dictée et lecture à voix haute, sans connexion
Étape 6 sur 6
Régler la latence
Sur un Raspberry Pi 5, comptez environ : deux à quatre secondes de transcription, une à deux secondes avant le premier mot du modèle, moins d'une seconde de synthèse. Le total reste sous les dix secondes, ce qui est acceptable pour un dialogue posé.
- Passer whisper de
smallàbasedivise la transcription par deux, au prix de quelques erreurs. - Contraindre la réponse à deux phrases dans le prompt réduit fortement le temps de génération.
- Découper la réponse en phrases et lancer la synthèse au fil de l'eau donne l'impression d'une réaction immédiate.
- Garder le modèle chargé (
OLLAMA_KEEP_ALIVE) évite plusieurs secondes de rechargement à chaque tour.