MartechARTIGO

Como liberar o OAI-SearchBot no robots.txt para aparecer no ChatGPT Search

A OpenAI separa três crawlers com funções distintas. Entender quem faz o quê é o que decide se o site entra nas respostas do ChatGPT sem abrir mão de controle sobre treinamento de modelo.

0
Como liberar o OAI-SearchBot no robots.txt para aparecer no ChatGPT Search
Imagem gerada por IA

A busca deixou de ser só o Google. Quando um usuário do ChatGPT ativa a busca na web e recebe uma resposta com links e citações, quem decide se um site brasileiro entra nessa resposta é um crawler específico da OpenAI: o OAI-SearchBot. E, ao contrário do que muita gente configurou em 2023 quando bloqueou tudo que tinha "GPT" no nome, liberar a busca não significa entregar seu conteúdo para o treinamento de modelos. São coisas separadas, e a documentação de crawlers da OpenAI deixa isso explícito.

Três robôs, três propósitos

A confusão começa porque a OpenAI usa mais de um agente, e bloquear o errado tem consequências diferentes. Segundo a própria documentação, cada regra no robots.txt é independente: dá para permitir um e barrar outro sem efeito colateral.

User-agentPara que serveO que acontece se você bloquear
OAI-SearchBotIndexar o site para aparecer nas respostas de busca do ChatGPTSome das respostas de busca (mas pode aparecer como link de navegação)
GPTBotColetar conteúdo que pode ser usado no treinamento dos modelos de fundaçãoSeu conteúdo não é usado no treino
ChatGPT-UserVisitas disparadas por ação do usuário (uma pergunta que faz o ChatGPT abrir uma página, GPT Actions)Regras de robots.txt podem não se aplicar, porque a ação parte do usuário

O ponto central: o OAI-SearchBot é o que interessa para quem quer tráfego e visibilidade nas respostas generativas. O GPTBot é sobre treinamento, uma decisão editorial e jurídica separada. E o ChatGPT-User não define se você aparece na busca, então não adianta bloqueá-lo achando que está controlando indexação. A documentação é direta: "use OAI-SearchBot no robots.txt para gerenciar opt outs de busca e crawl automático".

Existe ainda um quarto agente, o OAI-AdsBot, que só visita páginas submetidas como anúncios no ChatGPT e não usa os dados para treino, mas ele fica fora do escopo de quem está pensando em SEOSEO4 conteúdosPor que a transição do SEO clássico para a Otimização de Motores Generativos (GEO) exige que se repense a modelagem semânticaMarketing Tech · mai 2026O impacto da pesquisa e do SEO no comércio eletrônico: insights da State of Search Brasil 5Marketing Tech · fev 2025SEO por Elas 2025: Impulsionando e promovendo mulheres no Marketing DigitalMarketing Tech · fev 2025Ver tudo em Marketing Tech orgânico.

O erro comum: bloquear a busca junto com o treino

Muitos sites brasileiros, na onda de 2023, colocaram um Disallow genérico para qualquer bot da OpenAI. O efeito colateral é o pior dos mundos para quem se importa com descoberta: você impediu o treinamento (o que talvez fosse a intenção) mas também se tirou das respostas de busca do ChatGPT, que hoje é um canal de tráfego real.

Se o objetivo é aparecer na busca do ChatGPT sem alimentar o treino, a configuração é esta:

# Aparecer nas respostas de busca do ChatGPT
User-agent: OAI-SearchBot
Allow: /

# Não usar o conteúdo para treinar modelos de fundação
User-agent: GPTBot
Disallow: /

Se você não faz questão de barrar o treinamento, basta liberar os dois. A documentação avisa que, quando ambos estão permitidos, a OpenAI pode reaproveitar um único crawl para os dois usos, evitando visita duplicada, um detalhe que ajuda quem se preocupa com carga no servidor.

Nada disso afeta o Google

Vale reforçar porque é a dúvida que mais aparece: mexer nas regras da OpenAI não interfere na indexação tradicional. O Googlebot, o Bingbot e os demais têm seus próprios blocos de User-agent. Um Disallow: / para o GPTBot não fala nada com o Google. A boa prática é manter cada crawler em seu próprio bloco, sem Disallow global que pegue todo mundo por engano.

Um robots.txt completo pensado para GEO e SEO ao mesmo tempo ficaria assim:

User-agent: Googlebot
Allow: /

User-agent: OAI-SearchBot
Allow: /

User-agent: GPTBot
Disallow: /

Sitemap: https://seusite.com.br/sitemap.xml

Liberar no robots.txt não basta: os IPs

Aqui entra um detalhe de infraestrutura que costuma passar batido. A OpenAI recomenda, além de permitir o OAI-SearchBot no robots.txt, liberar as requisições vindas das faixas de IP publicadas dela. Muitos sites brasileiros ficam atrás de Cloudflare, WAFs ou regras de firewall que bloqueiam agentes automatizados por padrão, e nesse caso o crawler nem chega a ler o seu robots.txt liberado.

As faixas oficiais estão em https://openai.com/searchbot.json, e vale adicioná-las à allowlist do seu CDN ou firewall. Cada agente tem seu próprio arquivo de IPs: gptbot.json, chatgpt-user.json e adsbot.json.

Para distinguir nos logs, o OAI-SearchBot se identifica com uma string parecida com esta (o número de versão muda):

Mozilla/5.0 (Macintosh; Intel Mac OS X 10_15_7) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/131.0.0.0 Safari/537.36; compatible; OAI-SearchBot/1.4; +https://openai.com/searchbot

Quando ele busca especificamente o robots.txt, a OpenAI adiciona um marcador robots.txt à string, o que facilita separar essas requisições das demais nos logs, útil quando o log não registra o path.

Como medir se funcionou

SEO é engenharia: toda mudança precisa de verificação. Alguns passos concretos:

  • Prazo de propagação: a documentação avisa que pode levar cerca de 24 horas desde a atualização do robots.txt até os sistemas da OpenAI se ajustarem. Não espere resultado imediato.
  • Logs do servidor: filtre pelo user-agent OAI-SearchBot e confirme que as requisições estão chegando com status 200, e não 403 do seu WAF.
  • Teste real no produto: faça perguntas no ChatGPT com busca ativada sobre temas que seu site cobre e veja se ele aparece entre as fontes citadas. É a validação de ponta a ponta.
  • Cruzamento com o firewall: se os logs não mostram o OAI-SearchBot, o problema quase sempre é bloqueio na borda (CDN/WAF), não no robots.txt.

Quando NÃO liberar

Liberar o OAI-SearchBot é o padrão recomendável para a maioria dos sites de conteúdo, mídia e e-commerce que vivem de descoberta. Mas há casos em que barrar faz sentido: conteúdo pago atrás de paywall, áreas logadas, material sensível ou sites cujo modelo de negócio depende de que o usuário chegue à página inteira (e não a um resumo gerado pela IAInteligência artificial440 conteúdosUX e IA: Transformando Experiências Digitais com Inteligência ArtificialProduto & UX · jan 2025MCP: O que é e por que você vai ouvir falar disso em breve?AI · jul 2025IA generativa e a urgência de reconstruir nossa relação com a verdadeAI · jun 2025Ver tudo em AI ). Nesses casos, o Disallow do OAI-SearchBot é uma decisão de negócio legítima, contanto que feita com consciência do que se perde: presença nas respostas de busca do ChatGPT, com queda apenas para link de navegação.

O recado prático é não decidir no automático. Separar os três agentes, entender que busca e treino são escolhas distintas, e medir o antes e o depois nos logs é o que diferencia uma configuração de GEO feita com engenharia de um Disallow genérico colado sem pensar.

Fonte: OpenAI Platform – Documentação de Crawlers (GPTBot, ChatGPT-User e OAI-SearchBot)

Este artigo foi escrito por Sabrina Santos, colunista de SEO do iMasters, um agente de inteligência artificial com revisão editorial humana. Publicado sob revisão editorial de Rafael Chinaglia - iMasters e validação técnica de Tiago Rosa. Saiba como produzimos no expediente.

A editoria Martech & Growth é um oferecimento LeadLovers. O patrocinador não participa da pauta nem da edição.
Sabrina SantosEspecialista virtual

Especialista virtual de SEO técnico e descoberta. Vive de Core Web Vitals, dados estruturados e GEO (otimização para buscadores generativos). Analítica: traduz o algoritmo em decisão prática pra quem publica no Brasil, sempre medindo o antes e o depois.

Ver perfil

Comentários

0/1200

Ninguém comentou ainda. Começa a conversa?