Como Aparecer nas Respostas do ChatGPT, Gemini e Perplexity em 2026
O que faz um site ser citado por ChatGPT, Gemini, Perplexity e Google com IA em 2026: crawlers, resposta direta, dados estruturados e o que ignorar.
· 11 min de leitura
Em 2026, uma parte relevante das buscas termina numa resposta gerada por IA, e não numa lista de links. O Google anunciou na I/O de maio que o AI Overviews ultrapassou 2,5 bilhões de usuários mensais, o AI Mode está disponível no Brasil, e ChatGPT, Gemini e Perplexity respondem perguntas comerciais ("qual oficina de câmbio automático em Montes Claros?", "quanto custa um site para clínica?") citando páginas específicas.
Isso criou uma indústria de siglas (GEO, AEO, LLMO) e uma quantidade grande de conselho sem evidência. Este artigo separa o que está documentado pelas próprias plataformas, o que estudos independentes mediram e o que é especulação. Tudo o que afirmamos sobre comportamento atual tem fonte com link.
Primeiro, o que mudou de fato
As respostas de IA reduzem o clique, mas os cliques que sobram valem mais
O Pew Research Center analisou o comportamento real de 900 usuários americanos em março de 2025. Quando aparecia um resumo de IA, o usuário clicava em um resultado tradicional em 8% das visitas, contra 15% quando não aparecia. E clicava em um link dentro do resumo em apenas 1% das visitas.
O Google, no seu guia oficial sobre recursos de IA, reconhece a mudança de outro ângulo: afirma que os cliques vindos de páginas com AI Overviews são "de maior qualidade", com mais tempo no site.
A leitura prática: ser citado importa, mas o volume de tráfego por citação é menor do que era por posição. O que a citação entrega é presença na decisão, especialmente para serviço local e B2B, onde o cliente pesquisa antes de ligar.
Cada plataforma escolhe fontes de um jeito
Uma análise da Leapd sobre 680 milhões de citações encontrou que apenas 11% dos domínios são citados tanto pelo ChatGPT quanto pelo Perplexity. AI Overviews e AI Mode do Google compartilham fontes entre si, mas divergem das demais. Ou seja: não existe uma otimização única. Existe uma base comum e ajustes por plataforma.
O Google agora mede isso no Search Console
Em junho de 2026, o Google lançou relatórios de desempenho em IA generativa no Search Console, com impressões, páginas, países e dispositivos dentro de AI Overviews e AI Mode. Ainda em liberação gradual, mas é o primeiro dado oficial de visibilidade em IA que um site pode acompanhar.
Como cada IA chega até a sua página
Isso é o que mais gente erra, porque confunde treinamento com busca. Os crawlers são diferentes e a configuração do robots.txt precisa refletir isso.
| Plataforma | Crawler de busca (o que gera citação) | Crawler de treinamento | Agente acionado pelo usuário |
|---|---|---|---|
| OpenAI / ChatGPT | OAI-SearchBot | GPTBot | ChatGPT-User |
| Anthropic / Claude | Claude-SearchBot | ClaudeBot | Claude-User |
| Perplexity | PerplexityBot | (não usa para treinamento, segundo a própria documentação) | Perplexity-User |
| Google (AI Overviews / AI Mode) | Googlebot (o mesmo da busca) | Google-Extended controla uso em Gemini fora da busca | — |
Fontes: documentação de crawlers da OpenAI, documentação de bots da Perplexity, central de ajuda da Anthropic e guia do Google.
Três consequências diretas:
- Bloquear
GPTBotnão tira você do ChatGPT search. A OpenAI documenta que as configurações são independentes: dá para permitirOAI-SearchBot(aparecer nas respostas) e bloquearGPTBot(não treinar modelo). A recíproca também vale: se o seurobots.txtou o firewall bloqueiaOAI-SearchBot, você não aparece nas respostas com busca do ChatGPT, e a OpenAI avisa que a mudança leva cerca de 24 horas para ser lida. - Para o Google, não existe configuração separada. O AI Overviews e o AI Mode usam o índice normal da busca. Se a página é indexável e elegível a snippet, ela é elegível a aparecer em IA. O Google afirma que "não há requisitos técnicos adicionais".
- Agentes acionados por usuário podem ignorar o robots.txt.
ChatGPT-User,Claude-UserePerplexity-Userbuscam a página porque uma pessoa pediu. A Perplexity documenta explicitamente que oPerplexity-User"geralmente ignora regras do robots.txt". Isso significa que bloqueio na camada de rede (Cloudflare, WAF) é a única barreira real, e também o que mais derruba visibilidade sem que ninguém perceba.
O robots.txt mínimo para aparecer
User-agent: OAI-SearchBot
Allow: /
User-agent: PerplexityBot
Allow: /
User-agent: Claude-SearchBot
Allow: /
User-agent: Googlebot
Allow: /
Sitemap: https://seusite.com.br/sitemap.xml
Permitir ou não os crawlers de treinamento (GPTBot, ClaudeBot, Google-Extended) é decisão de negócio sobre uso do seu conteúdo, não sobre visibilidade em busca. Para a maioria das empresas de serviço, permitir os dois grupos é o padrão razoável, porque a menção da marca dentro do modelo também tem valor.
Depois de configurar, confira nos logs do servidor se esses user-agents estão chegando e recebendo status 200. Bloqueio por proteção anti-bot do provedor não aparece no robots.txt.
O que as IAs citam, e por quê
Texto que responde a pergunta em um parágrafo
Sistemas de IA montam a resposta a partir de trechos, não de páginas inteiras. O trecho escolhido é aquele que responde à pergunta de forma completa em poucas frases, com o termo da pergunta presente. Página que demora quatro parágrafos para chegar ao ponto perde para página que responde no primeiro e desenvolve depois.
Estrutura que funciona: subtítulo em forma de pergunta ou de tópico direto, primeiro parágrafo com a resposta em até três frases, depois o detalhe. É o padrão que o Search Engine Land observou nos sites que cresceram em tráfego de IA: tabelas comparativas extraíveis, páginas de perguntas frequentes e conteúdo estruturado por intenção.
Especificidade em vez de amplitude
"Sites para clínicas" concorre com milhares de páginas. "Site para clínica de fisioterapia com agendamento online e conformidade com o CFM" concorre com poucas, e é exatamente o tipo de pergunta longa que gera resposta de IA. O Pew encontrou que buscas com 10 palavras ou mais geram resumo de IA em 53% dos casos, contra 8% para buscas de uma ou duas palavras.
Isso favorece páginas por nicho, cidade e situação, que é a lógica das Paginações SEO. O que muda em relação a 2023 é a exigência de conteúdo real em cada uma: página programática com texto duplicado e cidade trocada não é citada e pode derrubar o resto do site.
Dados estruturados coerentes com o texto
O Google lista, entre as práticas para aparecer em IA, "garantir que os dados estruturados correspondam ao texto visível na página". Não é "ter Schema", é ter Schema que bate. FAQ marcada sem as perguntas na página, LocalBusiness com horário diferente do rodapé e Article sem autor visível são ignorados.
Para as outras plataformas, não há documentação de que Schema.org seja lido diretamente. O efeito indireto existe: as mesmas práticas melhoram a extração do texto e a consistência de entidade (nome, endereço, serviço).
Autor, data e fonte
Página com autor nomeado, data de atualização e links para fontes primárias é preferida por dois motivos: os sistemas do Google já pesam isso (E-E-A-T), e os modelos, ao escolher entre trechos parecidos, favorecem o que parece verificável.
Menções fora do seu site
O estudo da Leapd e a análise de 30 milhões de citações da Peec AI, citada pela SEO Sherpa, apontam o mesmo: Reddit, Wikipedia, YouTube e portais de avaliação estão entre as fontes mais citadas. Para negócio local, isso se traduz em perfil do Google completo e com avaliações recentes, presença em diretórios do setor e menções em veículos regionais. A IA cruza o que o seu site diz com o que os outros dizem sobre você.
O que ignorar ou tratar como secundário
llms.txt
O arquivo llms.txt foi proposto como um "sitemap para IAs". Em setembro de 2026, o estado é este:
- Nenhuma plataforma (OpenAI, Anthropic, Google, Perplexity) declarou que o usa para busca ou citação.
- John Mueller, do Google, afirmou que nenhum sistema de IA o utiliza e que os logs dos sites mostram que os crawlers nem o requisitam, segundo o Search Engine Land. O mesmo estudo acompanhou 10 sites por 90 dias antes e depois de implementar o arquivo: 8 não tiveram mudança, e os 2 que cresceram tinham outras causas identificáveis.
- Em maio de 2026, o Google passou a declarar explicitamente que o arquivo não é necessário para seus recursos de IA, conforme relatado pela Backlinko, que também cita um levantamento de logs da OtterlyAI em que 0,1% das requisições de bots de IA pediram o arquivo.
Ter o arquivo não prejudica e custa pouco (este site tem um). Mas é a última coisa da lista, não a primeira. Quem vende "otimização com llms.txt" como diferencial está vendendo o item de menor evidência.
Texto oculto "para a IA"
Blocos de texto invisíveis, resumos escondidos em atributos ou conteúdo diferente para crawler e para usuário são cloaking. O Google penaliza, e para as demais IAs o texto que vale é o que está visível no HTML, então não há ganho.
Checklist prático
Em ordem de impacto, pelo que está documentado:
- Página indexada no Google, com canonical correto e elegível a snippet (sem
nosnippetoumax-snippetrestritivo) -
OAI-SearchBot,PerplexityBoteClaude-SearchBotpermitidos norobots.txte não bloqueados no firewall ou CDN - Conteúdo principal no HTML servido pelo servidor, não montado por JavaScript no navegador
- Cada seção começa com a resposta em até três frases
- Uma página por intenção específica (serviço + público + cidade), com conteúdo próprio
- Tabela comparativa ou lista verificável quando o tema comporta comparação
- Autor nomeado, data de publicação e de atualização visíveis
- Toda estatística de terceiros com link para a fonte primária
- Schema.org (
Organization,Article,Service,FAQPage) coerente com o texto visível - Perfil do Google Business Profile completo e com avaliações recentes, para negócio local
- Nome, endereço, telefone e descrição de serviços idênticos no site, no Google e nos diretórios
- Search Console verificado, para acompanhar o relatório de IA generativa quando liberado para o seu site
-
llms.txtpublicado, como último item, sem expectativa de efeito direto
Como medir
Tráfego de IA aparece no Google Analytics como referência de chatgpt.com, perplexity.ai, gemini.google.com e claude.ai. Crie um segmento com esses domínios e acompanhe mensalmente. Para o Google, o relatório de IA generativa no Search Console é a fonte, quando disponível; enquanto não é, as impressões em AI Overviews já estão somadas no relatório de desempenho normal.
Complementarmente, monte um conjunto fixo de 20 a 30 perguntas que o seu cliente faria, rode nas quatro plataformas uma vez por mês e registre se o seu site é citado e por qual página. É manual, mas é o único dado que mostra o que a IA responde de fato sobre o seu setor na sua região.
Perguntas frequentes
GEO substitui SEO?
Não. O Google afirma que os mesmos fundamentos de SEO valem para AI Overviews e AI Mode, sem requisitos adicionais. Para ChatGPT e Perplexity, a página precisa antes ser encontrada pelos crawlers deles, que se comportam como buscadores. GEO é SEO com mais peso em resposta direta, estrutura extraível e consistência de entidade.
Quanto tempo leva para aparecer nas respostas?
Não há prazo documentado por nenhuma plataforma, e ninguém sério promete um. O que dá para dizer: a OpenAI informa cerca de 24 horas para ler mudanças no robots.txt; a indexação no Google segue o ritmo normal de rastreamento; e a citação depende de a página ser a melhor resposta disponível para a pergunta, o que é uma questão de conteúdo e concorrência, não de tempo.
Preciso bloquear os crawlers de treinamento para proteger meu conteúdo?
É uma decisão de negócio. Bloquear GPTBot, ClaudeBot e Google-Extended impede o uso em treinamento, mas não afeta a aparição em busca se os crawlers de busca continuarem permitidos. Para empresa de serviço que quer ser lembrada pela IA quando alguém pergunta sobre o setor, permitir costuma ser vantajoso.
Site pequeno de cidade do interior tem chance contra portais grandes?
Para perguntas locais e específicas, sim, porque os portais não têm página sobre "guincho na BR-251 entre Montes Claros e Salinas" e você pode ter. A especificidade é a vantagem do negócio local nesse cenário. Para perguntas genéricas ("o que é SEO"), não, e não vale o esforço.
Se quer saber o que as IAs respondem hoje sobre o seu setor na sua região, e quais páginas seriam necessárias para mudar isso, esse levantamento faz parte do diagnóstico de Paginações SEO da Anixt.