RAG (geração aumentada por recuperação)
O RAG (do inglês retrieval-augmented generation, "geração aumentada por recuperação") é uma técnica que combina um modelo de linguagem Um LLM é um modelo de IA treinado com enormes quantidades de texto para entender e gerar linguagem. É o motor de assistentes como o ChatGPT. Mais no glossário → com uma busca em uma fonte de dados externa. Antes de responder, o sistema busca os trechos relevantes em documentos, uma base de conhecimento ou na web, e os entrega ao modelo como contexto para que ele redija a resposta a partir deles. Assim se conseguem duas coisas importantes: o modelo pode usar informação atualizada ou privada que não estava em seu treinamento, e reduzem-se as alucinações Uma alucinação é quando uma IA apresenta como verdadeira uma informação inventada ou incorreta, mas com tom seguro. Por isso convém verificar as suas respostas. Mais no glossário → , porque ele responde apoiando-se em textos reais que, além disso, pode citar. É a base de muitos assistentes que respondem sobre a documentação de uma empresa ou sobre um conjunto específico de arquivos. Não elimina totalmente os erros, mas torna as respostas muito mais confiáveis e verificáveis.