RAG (Retrieval-Augmented Generation) je technika, pri ktorej jazykový model pred generovaním odpovede najprv vyhľadá relevantné informácie vo vonkajšej databáze, dokumentoch alebo na webe a svoju odpoveď postaví práve na týchto nájdených faktoch. Tento prístup výrazne znižuje riziko halucinácií a umožňuje modelu pracovať s aktuálnymi informáciami alebo internými firemnými dátami, ktoré neboli súčasťou jeho pôvodného trénovania. RAG je dnes štandardnou architektúrou pri budovaní firemných AI chatbotov a asistentov pracujúcich s vlastnou znalostnou bázou.