RAG (Retrieval-Augmented Generation — erişimle güçlendirilmiş üretim), dil modelinin soruyu cevaplamadan önce bir bilgi tabanında arama yapıp bulduğu belgeleri bağlam olarak kullanması tekniğidir. Model artık yalnızca eğitim bilgisine değil, sizin güncel ve özel verinize dayanarak cevap verir.
Şirket içi doküman asistanlarının çoğu RAG mimarisiyle çalışır: belgeler önce embedding'e çevrilip vektör veritabanına yazılır, soru geldiğinde en alakalı parçalar bulunup modele verilir. Halüsinasyonu azaltır, modeli yeniden eğitmeden güncel tutar ve "bu cevap hangi belgeden geldi" sorusuna kaynak gösterebilir.