Le chunking est le découpage d'un document en morceaux plus petits (« chunks ») avant de les transformer en embeddings et de les indexer dans une base vectorielle.
C'est une étape clé d'un système RAG : un découpage trop grossier noie l'information pertinente ; trop fin, il perd le contexte. Les stratégies vont du découpage par taille fixe au chunking sémantique ou hiérarchique (parent-child).
La qualité du chunking conditionne directement la pertinence des réponses d'un assistant IA.
→ Les stratégies de chunking sont détaillées dans notre guide RAG en production.
Équipe Origin 137Origin 137