この内容はまだフランス語です
ページ自体は翻訳済みですが、詳細な内容はまだです。機器の解説、ガイド、カタログはフランス語のまま表示されます。粗い機械翻訳よりも原文をお見せするほうがよいと考えました。 フランス語版を見る
Interroger ses propres documents hors ligne
Étape 1 sur 6
Avant de commencer
- Ollama fonctionnel avec un modèle de génération
- Python 3.10 ou plus récent
- Un dossier de documents en texte, Markdown ou PDF converti
Ce que fait réellement un RAG
Le modèle ne connaît pas vos documents et on ne va pas le réentraîner. On procède autrement : on découpe le corpus en passages, on les indexe, et à chaque question on retrouve les passages pertinents pour les coller dans le prompt. Le modèle répond alors sur pièces.
- Découper les documents en passages de quelques centaines de mots.
- Vectoriser chaque passage avec un modèle d'embedding.
- Stocker les vecteurs dans une base interrogeable.
- Chercher les passages les plus proches de la question.
- Générer la réponse à partir de ces passages, en citant les sources.
Pourquoi ça tient sur petite machineL'indexation est le seul moment coûteux, et elle se fait une fois. Ensuite, chaque question ne coûte qu'une vectorisation — quelques millisecondes — et une génération normale.