
RAG (geração com recuperação, em inglês retrieval-augmented generation) é a técnica por trás de quase todos os assistentes que «respondem com base nos nossos documentos». Em vez de treinar um modelo com os seus textos, o sistema procura os excertos relevantes e entrega-os ao modelo junto com a pergunta. O modelo responde a partir deles. Reduz as respostas inventadas, mas não as elimina.
Como funciona, em cinco passos
|
|
|
|
|
RAG ou outra coisa
| Abordagem | Serve para | Limite |
| Colar o texto na conversa | Um documento, uma vez | Não escala, e paga-se o texto inteiro em cada pedido |
| RAG | Muitos documentos, que mudam, e perguntas variadas | Só é tão bom como os documentos e a forma de os cortar |
| Afinar um modelo (fine-tuning) | Ensinar um estilo ou um formato | Não é uma boa maneira de lhe ensinar factos que mudam |
O que precisa para o montar
|
|
|
|
| Cuidado com quem pode ver o quê. Se pôr no mesmo índice documentos públicos e internos, o assistente pode citar os internos a qualquer pessoa. Separe os índices ou controle o acesso por utilizador. |
| Ainda pode inventar. Se os excertos não trazem a resposta, um modelo mal instruído completa com o que «sabe». Mande-o dizer «não encontrei» e mostre sempre de que documento veio a resposta. Veja alucinações de IA. |
| Comece com poucos documentos e uma lista de perguntas de teste que conhece a resposta. Se não acerta nessas, não está pronto para os clientes. |
|
Quer pôr um assistente destes num VPS seu? Veja os planos e escolha o tamanho. Ver planos de VPS |
|
VEJA TAMBÉM Pôr um assistente de IA a conversar no seu site Tokens explicados: como se contam as APIs de IA Um agente de IA precisa de um VPS, não de hospedagem partilhada |
PRODUTO RECOMENDADO Alojamento de sites com cPanel Domínio e SSL incluídos, cópias diárias e o painel que já conhece. desde 321,75 MT/mês (plano de 3 anos, com cupão) Ver planos |
- 0 Utilizadores acharam útil











