RAG
Retrieval-Augmented Generation: a modell a válasz előtt releváns dokumentumrészleteket kap egy keresőből.
Mi ez?
A RAG a saját adatokat nem tanítja bele a modellbe, hanem lekérdezéskor keresi ki (jellemzően vektoros kereséssel) és a promptba teszi. Olcsóbb és frissebb, mint a finomhangolás, a minősége viszont a keresés minőségén múlik.
Egyszerű példa
Egy ügyfélszolgálati bot a belső tudásbázis cikkeiből idéz a válaszában.