O que este verificador analisa
Ele lê os grupos do robots.txt e verifica se agentes importantes de IA para busca, treinamento e ações do usuário, além de tokens de controle, estão explicitamente cobertos ou apenas herdam regras gerais de crawler.
Cole o robots.txt para saber se os principais tokens de crawler de IA para busca, treinamento e ações iniciadas pelo usuário estão permitidos, bloqueados ou indefinidos antes de sistemas de IA encontrarem suas páginas.
Cole e verifique na hora. O conteúdo do robots.txt permanece neste dispositivo.
Cole o robots.txt para analisar sinais de acesso de OpenAI, Anthropic, Google, Perplexity e Common Crawl.
Ele lê os grupos do robots.txt e verifica se agentes importantes de IA para busca, treinamento e ações do usuário, além de tokens de controle, estão explicitamente cobertos ou apenas herdam regras gerais de crawler.
O robots.txt pode afetar se mecanismos de resposta por IA, agentes de navegação, crawlers de treinamento de modelos e crawlers de conjuntos de dados conseguem acessar páginas públicas para descoberta ou citação.
Revise sinais técnicos que afetam a descoberta por mecanismos de resposta e a prontidão para citação.
Crie ou revise o arquivo de descoberta voltado a agentes que complementa o robots.txt.
Revise sinais técnicos mais amplos para descoberta e uso por agentes de IA.
Ela verifica OAI-SearchBot, GPTBot, ChatGPT-User, ClaudeBot, Claude-SearchBot, Claude-User, Google-Extended, PerplexityBot e CCBot, além da regra de fallback para todos os crawlers.
Permita agentes voltados à busca quando a visibilidade em buscas por IA for importante. Avalie agentes de treinamento separadamente quando o controle de reutilização de conteúdo for mais importante.
O robots.txt é uma política de acesso para crawlers cooperativos, não uma garantia legal ou técnica contra todo uso de conteúdo.