Ordbog · AI
Chunking
Opdeling af lange dokumenter i mindre stykker, før de gemmes som embeddings, så søgningen kan finde det relevante afsnit.
Chunking afgør kvaliteten af en RAG-løsning mere end valget af model. For store stykker gør, at søgningen henter meget irrelevant med. For små stykker river sammenhængen i stykker, så modellen mangler kontekst.
Vi opdeler typisk efter struktur i stedet for efter tegn: afsnit, overskrifter eller produktfelter, med et lille overlap mellem stykkerne. Derefter tester vi med rigtige spørgsmål og justerer, indtil de rigtige afsnit kommer med.
I praksis
Vil I se, hvordan vi arbejder med chunking? Det hører til under AI.
Relaterede begreber