GEO Rankings
← Blog
Publicado

O que é pay per crawl? O padrão HTTP 402 que decide quais motores de IA podem ler o seu site

O pay per crawl cobra dos crawlers de IA por busca usando respostas HTTP 402. Veja o mecanismo, as categorias de bots de propósito declarado e as datas de lançamento em 2026.

Resumo

O pay per crawl é um sistema de pagamento por busca, pioneiro da Cloudflare, que permite aos donos de site cobrar dos crawlers de IA por cada página que eles buscam. Bots que não pagam recebem uma resposta HTTP 402 Payment Required no lugar da página, e bots de propósito declarado, como crawlers de busca, de agente ou de treinamento, podem ter preços diferentes.

Última atualização em setembro de 2026.

Por 30 anos, um crawler podia buscar qualquer página pública de graça. Ele enviava uma requisição. O servidor respondia com um 200 e o conteúdo. Essa era toda a transação.

O pay per crawl quebra essa premissa. O código de status HTTP 402, Payment Required, existe desde 1997 e quase nunca foi usado. A Cloudflare o transformou em infraestrutura ativa que decide se um crawler de IA chega ou não ao seu conteúdo.

Veja o que mudou, como funciona essa troca e o que isso significa para o rastreamento de visibilidade em IA agora.

Os números que definem o momento

  • Mais de 1 milhão: clientes da Cloudflare que ativaram o AI Crawl Control, a opção que inclui os preços de pay per crawl (Cloudflare, 2026).
  • Mais de 1 bilhão: respostas HTTP 402 que a rede da Cloudflare envia a crawlers de IA todos os dias (Cloudflare Blog, “Introducing AI Crawl Control”).
  • 35,7%: a parcela dos 1.000 maiores sites do mundo que bloqueiam o GPTBot, o crawler de IA mais bloqueado rastreado, ante cerca de 5% no seu lançamento em agosto de 2023 (Originality.AI, agosto de 2024).

Há três anos, nenhum desses números existia. Hoje os publishers têm uma alavanca entre deixar todo bot entrar de graça e bloquear todo bot por completo.

Como a troca via HTTP 402 funciona na prática

O pay per crawl funciona com uma troca simples entre um crawler e um servidor. A implementação da Cloudflare oferece dois caminhos.

O fluxo reativo. O crawler solicita uma página sem nenhum acordo de preço. Se a página tem um preço e o crawler ainda não pagou, o servidor responde com HTTP 402. A resposta traz um header crawler-price informando o custo.

O crawler pode tentar de novo a mesma URL com um header crawler-exact-price que corresponda a esse preço. Se o valor bater, o servidor entrega a página com HTTP 200 e um header crawler-charged confirmando a cobrança.

O fluxo proativo. O crawler pula essa ida e volta por completo. Ele envia um header crawler-max-price já na primeira requisição, informando o valor máximo que está disposto a pagar. Se o preço da página fica nesse teto ou abaixo dele, o servidor entrega o conteúdo na hora, com HTTP 200.

Crawler de IA                             Site
    |                                        |
    |--- GET /article -------------------->  |
    |                                        |
    |<-- 402 Payment Required -------------  |
    |    crawler-price: $0.01                |
    |                                        |
    |--- GET /article -------------------->  |
    |    crawler-exact-price: $0.01          |
    |                                        |
    |<-- 200 OK ---------------------------  |
    |    crawler-charged: $0.01              |
    |    [conteúdo da página]                |

O crawler não se identifica apenas com uma string de user-agent. Ele se autentica com um par de chaves criptográficas assinado. Assim, o servidor sabe exatamente qual bot está fazendo a requisição e pode cobrar dele o preço que ele aceitou pagar. Essa identidade assinada é o que torna possível o resto do sistema: a precificação por propósito do bot.

Bots de propósito declarado: por que “crawler de IA” já não é uma categoria só

No começo, o controle de crawlers era binário: permitir o GPTBot ou bloqueá-lo. O modelo atual da Cloudflare classifica cada crawler de IA em uma categoria de propósito declarado, e os donos de site definem regras por propósito, não por bot.

  • Search: crawlers que indexam conteúdo para responder perguntas depois. Os donos de site geralmente querem esse tráfego, porque ele pode gerar referências. Permitido por padrão.
  • Agent: crawlers que agem em tempo real em nome de uma pessoa, como um assistente que controla o navegador para concluir uma tarefa. Bloqueado por padrão em páginas monetizadas por anúncios a partir de 15 de setembro de 2026.
  • Training: crawlers que coletam conteúdo para treinar ou fazer fine-tuning de um modelo, onde o conteúdo é absorvido de forma permanente em vez de ser usado para responder em tempo real. Bloqueado por padrão em páginas monetizadas por anúncios a partir da mesma data.

Um único bot pode carregar mais de uma tag de propósito. A Cloudflare aplica a regra mais restritiva entre as que se aplicam. Um crawler marcado como Search e Training ao mesmo tempo é bloqueado se Training estiver bloqueado, mesmo que o comportamento de Search dele seja bem-vindo.

O que mudou, e quando

EventoDataFonte
A Cloudflare lança o Pay Per Crawl em beta privado, introduzindo a troca de preços baseada no 4021º de julho de 2025Cloudflare Blog
O AI Crawl Control chega à disponibilidade geralAgosto de 2025Cloudflare Blog
O AI Crawl Control é consolidado em um único console, disponível em todos os planos, incluindo o gratuito13 a 17 de abril de 2026Cloudflare Blog, Agents Week 2026
A Cloudflare muda o modelo comercial de preço por busca para pagar publishers quando o conteúdo é citado, com lançamento junto a Ceramic.ai e You.com1º de julho de 2026Cloudflare, segundo a TechCrunch
Crawlers das categorias Agent e Training passam a ser bloqueados por padrão em páginas monetizadas por anúncios15 de setembro de 2026Cloudflare Blog

O pay per crawl não ficou parado desde o lançamento. O preço por busca foi a primeira versão.

O próprio anúncio da Cloudflare em julho de 2026 apontou o ponto fraco. Mais da metade do tráfego de rastreamento de bots que ela classifica como legítimos vai para buscar de novo páginas que não mudaram desde a última visita. Um preço fixo por busca recompensa esse desperdício tanto quanto recompensa o uso real.

O modelo mais recente de pay-per-citation, ainda em fase de lançamento com parceiros, precifica o resultado em vez da requisição.

A Cloudflare não é a única empresa construindo essa camada. A TollBit opera uma plataforma separada de licenciamento e medição que fica entre publishers e empresas de IA, rastreando o tráfego de bots e intermediando acordos de acesso pago fora da rede da própria Cloudflare. As duas são infraestrutura, não ferramentas de GEO: elas decidem se um crawler chega ao seu conteúdo, não se um motor escolhe citá-lo depois que chega.

Por que isso importa para o rastreamento de visibilidade em IA

O pay per crawl acrescenta uma camada que o rastreamento de citações não precisava considerar antes. Uma página pode estar perfeitamente otimizada e, mesmo assim, nunca ser lida, se o crawler que a buscaria esbarrar em um 402 que não está disposto a pagar.

Isso torna a visibilidade no nível de crawler, e não só a contagem de citações, parte do problema de medição agora.

Profound se encaixa aqui de forma mais direta. O produto Agent Analytics dele rastreia a atividade de crawlers no nível da requisição, mostrando quais bots chegam às suas páginas e com que frequência. É a leitura mais próxima dos dados de pay-per-crawl e 402 como sinal de GEO.

Temso aborda o mesmo problema por um ângulo tudo-em-um. Ele inclui analytics de bots de IA dentro da assinatura mais ampla de rastreamento de citações, a partir de $89/mês, então um time que quer visibilidade de crawlers junto com share de citações e execução de conteúdo não precisa rodar uma ferramenta separada para cada coisa.

Scrunch adota um ângulo de prontidão. Em vez de só reportar o que já aconteceu, ele avalia se a estrutura e as regras de acesso do seu site estão prontas para agentes de IA navegarem por ele antes de mais nada, o que importa diretamente agora que os crawlers da categoria Agent enfrentam bloqueios por padrão em páginas monetizadas por anúncios.

Nenhuma das três substitui as outras. Leia a metodologia de pontuação por trás de como as plataformas de GEO são avaliadas neste site.

A conclusão

O pay per crawl transforma o acesso de crawlers em uma transação precificada, aplicada com respostas HTTP 402 e identidade de bot assinada criptograficamente. Não é, por si só, um sinal de ranking ou de citação. Ele decide se um crawler sequer chega à sua página, e isso agora vem antes de qualquer outra métrica de GEO que você acompanha.

Verifique se os crawlers de IA conseguem realmente chegar ao seu conteúdo. O Temso rastreia a atividade de bots de IA junto com o share de citações entre motores a partir de $89/mês, então um crawler bloqueado aparece antes de custar uma citação. Veja a comparação completa no ranking de ferramentas de GEO, ou consulte termos relacionados no glossário.

Perguntas frequentes

O que é pay per crawl?

Pay per crawl é um sistema de pagamento, lançado pela Cloudflare em julho de 2025, que permite aos donos de site cobrar dos crawlers de IA um preço por cada página que eles buscam. Um crawler que não paga recebe uma resposta HTTP 402 Payment Required no lugar do conteúdo. Um crawler que paga o preço informado recebe uma resposta HTTP 200 com a página.

Como a resposta HTTP 402 funciona de fato no pay per crawl?

Um crawler solicita uma página. Se a página tem um preço e o crawler não concordou em pagar, o servidor retorna HTTP 402 Payment Required com um header crawler-price informando o custo. O crawler pode repetir a mesma requisição com um header crawler-exact-price que corresponda a esse preço, e o servidor então retorna HTTP 200 com o conteúdo e um header crawler-charged. Os crawlers também podem enviar um header crawler-max-price desde o início para pular por completo essa ida e volta do 402.

O que são bots de propósito declarado?

Bots de propósito declarado são crawlers que identificam não só o próprio nome, mas a intenção por trás de cada requisição. A Cloudflare organiza o tráfego de crawlers de IA em categorias como Search (indexar conteúdo para responder perguntas depois), Agent (agir em tempo real em nome de uma pessoa) e Training (coletar conteúdo para treinar ou fazer fine-tuning de um modelo). Os donos de site podem permitir, bloquear ou precificar cada categoria separadamente, em vez de tratar todo o tráfego de IA da mesma forma.

Qual crawler de IA é mais bloqueado?

O GPTBot, crawler da OpenAI, é o crawler de IA mais bloqueado entre os rastreados em pesquisas sobre robots.txt. A análise da Originality.AI de agosto de 2024 sobre os 1.000 maiores sites do mundo encontrou o GPTBot bloqueado por 35,7% dos sites, ante cerca de 5% quando o bot foi lançado em agosto de 2023. Essa taxa de bloqueio é maior do que a do CCBot, do Google-Extended ou do ChatGPT-User no mesmo estudo.

Pay per crawl é a mesma coisa que robots.txt ou llms.txt?

Não. O robots.txt diz a um crawler se ele pode ou não acessar uma página, usando uma diretiva de permitir ou negar que muitos bots simplesmente ignoram. O llms.txt cura quais URLs um site considera canônicas para sistemas de IA, sem nenhuma aplicação forçada. O pay per crawl fica abaixo dos dois: é uma camada de pagamento aplicada pelo próprio servidor, usando o código de status HTTP 402, então um bot não consegue a página sem pagar, independentemente do que o robots.txt ou o llms.txt digam.

Quantos sites usam pay per crawl?

A Cloudflare relata que mais de 1 milhão de seus clientes ativaram o AI Crawl Control, a opção gratuita que inclui os preços de pay per crawl, e que a rede da Cloudflare agora envia mais de 1 bilhão de respostas HTTP 402 a crawlers de IA todos os dias. A adoção está concentrada entre os clientes da Cloudflare por enquanto; o padrão ainda não é aceito em todo o setor.