✨ Garanta 50% OFFno primeiro mês do Pro. Use o cupom:

OAI-SearchBot: o que é o crawler da busca do ChatGPT e como difere do GPTBot

Por Tiago CostaAtualizado em 2 de julho de 2026

Ilustração de um robô com lupa indexando páginas para um balão de conversa com fontes, representando o OAI-SearchBot da busca do ChatGPT.
Definição

OAI-SearchBot é o rastreador da OpenAI dedicado à busca do ChatGPT. Na prática, ele:

  • descobre e indexa páginas para que possam ser citadas na busca do ChatGPT;
  • é distinto do GPTBot (treino) e do ChatGPT-User (ações a pedido do usuário);
  • se identifica pelo user-agent OAI-SearchBot nos registros do servidor;
  • respeita o robots.txt, então cada bot da OpenAI pode ser controlado em separado.

O que é o OAI-SearchBot

O OAI-SearchBot é o rastreador que a OpenAI usa para a funcionalidade de busca do ChatGPT. Quando o ChatGPT precisa responder com informação atual, ele consulta um índice de páginas da web, e é o OAI-SearchBot que descobre, visita e mantém esse índice. Em outras palavras, ele é para o ChatGPT mais ou menos o que o Googlebot é para o Google.

Como qualquer crawler, o OAI-SearchBot percorre páginas públicas e lê o conteúdo. A diferença crucial está na finalidade: ele não coleta texto para treinar um modelo, e sim para que o seu site possa ser encontrado e citado quando o ChatGPT faz uma busca. Aparecer nesse índice é o que dá ao seu conteúdo a chance de virar uma das fontes exibidas ao usuário, com link de volta.

Essa separação de papéis é a grande novidade da OpenAI e o motivo pelo qual vale a pena conhecer o nome desse bot em detalhe.

OAI-SearchBot, GPTBot e ChatGPT-User: os três bots da OpenAI

A OpenAI opera três agentes diferentes, e confundi-los leva a decisões erradas de bloqueio. Cada um tem um propósito próprio:

BotPara que serve
OAI-SearchBotDescobre e indexa páginas para a busca do ChatGPT. Liberá-lo ajuda a aparecer como fonte citada.
GPTBotColeta conteúdo público para treinar os modelos da OpenAI. Bloqueá-lo tira o seu site do treino.
ChatGPT-UserFaz uma visita pontual quando um usuário pede uma ação que exige acessar aquela página na hora.

A consequência prática é poderosa: como cada bot tem seu próprio nome, você pode escolher exatamente o que permitir. É possível, por exemplo, deixar o seu conteúdo aparecer na busca do ChatGPT enquanto o mantém fora do treinamento dos modelos, algo que a próxima seção mostra na prática.

Infográfico comparando os três bots da OpenAI: OAI-SearchBot para busca, GPTBot para treino e ChatGPT-User para ações a pedido do usuário, controlados pelo robots.txt.
Os três bots da OpenAI lado a lado: busca (OAI-SearchBot), treino (GPTBot) e ação do usuário (ChatGPT-User).

Qual é o user-agent do OAI-SearchBot

Nos registros (logs) do servidor, esse rastreador aparece com um user-agent que contém o texto OAI-SearchBot, num formato parecido com OAI-SearchBot/1.0 seguido de um endereço de contato da OpenAI. Os outros dois agentes aparecem como GPTBot e ChatGPT-User, cada um com sua própria linha.

Ler esses três identificadores com atenção evita erros comuns. Muita gente bloqueia o GPTBot achando que assim some da busca do ChatGPT, quando na verdade quem controla a presença na busca é o OAI-SearchBot. Como o user-agent é apenas um texto declarado, a confirmação definitiva de que um acesso é legítimo vem de cruzar o nome com as faixas de IP publicadas pela OpenAI, e não só da linha do log.

Como aparecer na busca do ChatGPT sem liberar o treino

Esta é a jogada mais interessante que a separação de bots permite. Como as regras do robots.txt são escritas por user-agent, dá para tratar cada bot da OpenAI de um jeito. Para bloquear o treino, mas permanecer na busca do ChatGPT, você bloqueia o GPTBot e libera o OAI-SearchBot:

  • User-agent: GPTBot
  • Disallow: /
  • User-agent: OAI-SearchBot
  • Allow: /

Para o cenário oposto, sair da busca do ChatGPT, use Disallow: / no bloco do OAI-SearchBot. E lembre que bloquear o GPTBot não remove o seu site da busca, assim como liberar o OAI-SearchBot não autoriza o uso do seu conteúdo em treino. São controles independentes, e é justamente essa independência que torna a política de acesso uma escolha estratégica, não um botão de liga e desliga geral.

Ilustração de um robots.txt liberando o robô de busca e bloqueando o robô de treino, representando o controle separado dos bots da OpenAI.

Quanto a OpenAI rastreia e quanto devolve

Antes de decidir, vale olhar os números da troca. A OpenAI é hoje um dos rastreadores mais ativos da web. Segundo a análise da Cloudflare, o GPTBot chegou a responder por cerca de 30% de todo o tráfego de rastreadores de IA na sua rede, a maior fatia entre os bots de IA acompanhados.

O outro lado da conta é o retorno em visitas. A mesma Cloudflare estimou que, em julho de 2025, os rastreadores da OpenAI visitaram cerca de 1.091 páginas para cada visitante encaminhado de volta a um site. É uma proporção bem menos desigual do que a de outros players de IA, o que faz sentido para quem opera uma busca que exibe e linka fontes, mas ainda mostra que o volume de rastreamento supera de longe o tráfego devolvido.

A leitura prática é equilibrada: a busca do ChatGPT já tem escala suficiente para valer a presença, e a política de acesso ideal costuma ser liberar o OAI-SearchBot para ganhar visibilidade e decidir com calma o que fazer com o GPTBot.

OAI-SearchBot e GEO: ser citado na busca do ChatGPT

Para o GEO (Generative Engine Optimization), o OAI-SearchBot é o bot que importa. Ele é a porta de entrada para a busca do ChatGPT, e liberá-lo é o pré-requisito para disputar espaço entre as fontes citadas. Bloqueá-lo, ao contrário, é abrir mão dessa vitrine.

Liberar o acesso, porém, é só o começo. Ganhar a citação por IA depende de aplicar as práticas de otimização para motores generativos: responder a pergunta de forma direta e no topo, sustentar afirmações com dados de fonte clara, usar títulos e listas que facilitam a extração e cobrir o tema com profundidade real. Quanto mais fácil for para o modelo entender e confiar na sua resposta, maior a chance de ele escolher o seu link.

Um recurso que complementa essa estratégia é o arquivo de llms.txt, proposto para orientar modelos de linguagem sobre qual conteúdo do site priorizar. Ele não substitui o robots.txt, mas reforça o sinal de organização e ajuda quem quer ser bem representado nas respostas de IA, e não apenas indexado.

Dúvidas frequentes

Perguntas frequentes

O que é o OAI-SearchBot?

O OAI-SearchBot é o rastreador da OpenAI usado pela busca do ChatGPT. Ele descobre e indexa páginas para que possam ser citadas quando o ChatGPT busca informação atual. Diferente do GPTBot (treino), o foco dele é colocar o seu site na busca, com link de volta.

O OAI-SearchBot é o mesmo que o GPTBot?

Não. O OAI-SearchBot alimenta a busca do ChatGPT e ajuda o seu site a ser citado; o GPTBot coleta conteúdo para treinar os modelos da OpenAI. São bots com user-agents distintos, então dá para permitir um e bloquear o outro no robots.txt.

Quanto custa para aparecer no OAI-SearchBot?

Nada. Ser rastreado e indexado pelo OAI-SearchBot é gratuito: basta não bloquear o bot no robots.txt e ter conteúdo público de qualidade. O que faz diferença não é pagar, e sim liberar o acesso e otimizar o conteúdo para ser citado.

Como bloquear o OAI-SearchBot?

No robots.txt, adicione User-agent: OAI-SearchBot e Disallow: / para tirar o seu site da busca do ChatGPT. Lembre que isso é independente do GPTBot: bloquear a busca não impede o treino, e vice-versa. Cada bot precisa da sua própria regra.

O que é um AI bot como o OAI-SearchBot?

Um AI bot é um rastreador operado por uma empresa de inteligência artificial para descobrir, indexar ou coletar conteúdo da web. O OAI-SearchBot faz isso para a busca do ChatGPT; outros exemplos são o ClaudeBot, da Anthropic, e o PerplexityBot, do Perplexity.

Apareça na busca do ChatGPT no automático

A Automarticles cria e otimiza os artigos do seu blog sozinha, com respostas objetivas e fontes claras que ajudam o seu site a ser encontrado e citado por buscas de IA como a do ChatGPT.

Começar teste grátis
Continue aprendendo

Conceitos relacionados

ClaudeBotClaudeBot é o rastreador (crawler) da Anthropic, a empresa por trás do assistente de IA Claude. Ele percorre páginas públicas da web para coletar conteúdo que ajuda a treinar e a alimentar os modelos Claude. Assim como o Googlebot faz pela busca, o ClaudeBot se identifica por um user-agent próprio, respeita o arquivo robots.txt e pode ser liberado ou bloqueado por qualquer site. Decidir o que fazer com ele virou parte da estratégia de quem quer, ou não quer, aparecer nas respostas de IA.PerplexityBotPerplexityBot é o rastreador (crawler) do Perplexity, o mecanismo de resposta que combina busca e IA para responder perguntas citando fontes. Ele visita páginas públicas para construir o índice que o Perplexity consulta ao montar suas respostas. Diferente de um bot de treino, o foco do PerplexityBot é indexar conteúdo atual e apontar de volta para as origens. Ele se identifica por um user-agent próprio e, em tese, respeita o robots.txt, embora o rastreio do Perplexity já tenha gerado polêmica.CrawlerCrawler é um programa robô que percorre a web de link em link, baixando e lendo páginas para alimentar o índice de um buscador. Também chamado de spider, robô ou bot, o exemplo mais conhecido é o Googlebot. O crawler é a primeira etapa da busca: antes de uma página poder ser indexada e ranqueada, ela precisa ser encontrada e lida por um desses rastreadores.GEOGEO, sigla de Generative Engine Optimization (otimização para motores generativos), é o conjunto de práticas para fazer o seu conteúdo ser citado e usado por buscadores de inteligência artificial, como o ChatGPT, os AI Overviews do Google, o Perplexity e o Gemini. Em vez de disputar apenas uma posição na lista de links, o objetivo do GEO é virar uma das fontes que o modelo escolhe para montar a resposta gerada.