RAG é a tecnologia por trás do Perplexity, ChatGPT Search, Google AI Overviews e da maioria dos sistemas de IA conectados à web. Em vez de depender só do conhecimento do treinamento, o LLM consulta documentos em tempo real e cita as fontes na resposta.
Como funciona
- Usuário faz pergunta.
- Sistema converte a pergunta em embedding (vetor numérico).
- Busca semântica em um índice vetorial encontra os trechos mais relevantes.
- Trechos recuperados são injetados no contexto do LLM.
- LLM gera resposta citando as fontes.
Implicações para SEO/GEO
Para ser recuperado por RAG, seu conteúdo precisa ser:
- Chunkable: trechos autocontidos de 200-500 palavras com sentido próprio.
- Semanticamente claro: uma ideia central por parágrafo.
- Indexável: HTML acessível, sem dependência de JavaScript pesado.
- Citável: autoridade da fonte é checada antes da citação.