RAG (Retrieval-Augmented Generation) conecta LLMs a mecanismos de busca semântica: indexa documentos em vetores, recupera os mais relevantes, injeta-os no prompt e gera respostas mais precisas, atualizadas e com menos alucinações. É ideal para chatbots corporativos, suporte jurídico, educação e help desk. Desafios: curadoria de fontes, latência, custo computacional e segurança dos dados.