Faça a mesma pergunta para o ChatGPT, o Perplexity e o Google. As respostas costumam citar fontes diferentes. Não é aleatório: cada sistema pesquisa de um jeito, em índices diferentes, e escolhe trechos com critérios próprios.
As etapas que todas têm em comum
- Interpretar a pergunta e decidir se precisa pesquisar.
- Gerar consultas de busca, às vezes várias para uma pergunta só. Isso é chamado de "fan-out".
- Recuperar páginas de um índice de busca.
- Ler e selecionar trechos relevantes.
- Escrever a resposta e indicar parte das fontes usadas.
A etapa 2 explica por que conteúdo de cauda longa ganhou valor: a pergunta "qual o melhor plano de saúde para MEI em SP" pode virar consultas como "plano de saúde MEI preço" e "plano de saúde empresarial pequena empresa São Paulo".
Plataforma por plataforma
Google: AI Overviews e AI Mode
Usam o índice da Pesquisa Google. O Google afirma que não há requisito extra além de estar indexado e elegível a snippet, e que as visitas vindas desses recursos entram no relatório de desempenho do Search Console. Os controles de snippet (nosnippet, max-snippet) também valem para eles. Mais em AI Overviews e AI Mode.
ChatGPT
Quando pesquisa, o ChatGPT usa provedores de busca e o próprio robô de busca da OpenAI. A OpenAI separa seus robôs: o OAI-SearchBot serve para aparecer nos resultados de busca do ChatGPT, o GPTBot para treinar modelos e o ChatGPT-User para ações que o usuário pede, como abrir um link. Bloquear o OAI-SearchBot tira você das respostas com fonte.
Perplexity
É um buscador com resposta gerada. Cita fontes em quase todas as respostas e tende a privilegiar páginas recentes e bem estruturadas. Tem o robô PerplexityBot.
Claude
A Anthropic também separa robôs de treinamento (ClaudeBot), de busca (Claude-SearchBot) e de ações do usuário (Claude-User).
Copilot
Apoia-se no índice do Bing. Por isso, não ignore o Bing Webmaster Tools: enviar o sitemap lá é um passo de cinco minutos que muita empresa nunca deu.
O que isso muda no seu robots.txt
A decisão mais comum que ajudo empresas a tomar: liberar os robôs de busca e decidir separadamente sobre os de treinamento. Um exemplo de configuração que libera tudo, como neste site:
User-agent: OAI-SearchBot Allow: / User-agent: GPTBot Allow: / User-agent: PerplexityBot Allow: / User-agent: ClaudeBot Allow: /
Se a empresa não quiser que seu conteúdo treine modelos, pode bloquear só o GPTBot e o ClaudeBot, mantendo os de busca. Atenção: robôs acionados por usuários, como o ChatGPT-User, podem não seguir o robots.txt, segundo a própria OpenAI. Veja mais em robots.txt e sitemap.
O que faz um trecho ser escolhido
Pela minha observação em monitoramento, trechos que:
- respondem a pergunta na primeira frase;
- trazem número, prazo ou critério concreto;
- estão sob um título que repete a pergunta;
- vêm de páginas que já aparecem bem na busca para aquele tema.
Isso é o que trabalho em conteúdo citável.
Fontes
- Google Search Central — AI features and your website (acesso em 05/10/2026)
- OpenAI — Overview of OpenAI crawlers (acesso em 05/10/2026)
- Bing Webmaster Tools (acesso em 05/10/2026)
Este guia faz parte do que aplico em GEO. Faço um diagnóstico gratuito de como sua empresa aparece hoje no Google, no Maps e nas IAs.
