A empresa vê o tráfego automatizado ultrapassar o humano e tenta criar regras para que sites recebam por conteúdo lido por agentes.
A web foi construída sobre uma troca relativamente simples: pessoas visitam páginas, anúncios financiam parte da infraestrutura e os sites competem pela atenção de leitores. A inteligência artificial está alterando cada etapa desse acordo. Agentes digitais agora acessam páginas para pesquisar, comparar preços, preencher tarefas e responder perguntas sem necessariamente levar o usuário até a fonte original. Para Matthew Prince, CEO da Cloudflare, esse deslocamento exige uma nova forma de pagar pelo trabalho de quem publica informação.
Em entrevista publicada pelo The Verge em 26 de setembro de 2026, Prince disse que o tráfego não humano já ultrapassou o tráfego humano na rede observada pela empresa. A Cloudflare funciona como uma camada entre sites e visitantes, entregando conteúdo, filtrando ataques e registrando padrões de acesso. A companhia pretende usar essa posição para ajudar os donos de sites a decidir quais agentes podem ler suas páginas, quais devem ser bloqueados e quais poderiam pagar pelo acesso.
O que mudou com a chegada dos agentes
Um mecanismo de busca tradicional também usa robôs, mas costuma encaminhar o usuário para uma página de resultados e, muitas vezes, para o site que produziu a informação. Um agente de IA pode fazer algo diferente. Ele coleta dados de dezenas de páginas, resume o material e entrega uma resposta dentro de outra interface. O usuário recebe conveniência, mas o site de origem pode perder visita, assinatura, cadastro ou oportunidade de mostrar publicidade.
Esse processo é conhecido como raspagem de dados. A prática não é nova, porém a escala e a frequência mudaram. Um robô que indexa uma página para atualizar um catálogo opera de maneira diferente de milhares de agentes que repetem a leitura para responder perguntas em tempo real. O custo de banda, armazenamento e processamento fica com quem mantém o site, enquanto o valor econômico pode ser capturado por outro serviço.
O problema não afeta apenas grandes veículos. Documentações de software, fóruns, blogs técnicos, páginas de lojas e bancos de dados comunitários também dependem de tráfego para continuar existindo. Se os leitores passam a consumir o conteúdo exclusivamente por respostas sintéticas, a motivação para criar e manter essas fontes diminui. É uma ameaça indireta à qualidade da informação disponível para todos, inclusive para os próprios modelos que dependem de dados públicos.
A proposta de uma web com pedágio
A Cloudflare defende uma combinação de controle e micropagamentos. Um site poderia permitir o acesso de agentes identificados, bloquear sistemas que ignoram regras ou cobrar uma fração de centavo por consulta. O pagamento seria feito por empresas de IA que desejam utilizar o conteúdo em nome de seus usuários. Para a Cloudflare, a lógica se parece com uma assinatura de música: o serviço que concentra a experiência paga para que a infraestrutura criativa continue produzindo.
A ideia aproveita um código pouco usado da web, o status HTTP 402, criado para representar pagamento necessário. Durante anos, o padrão ficou associado a uma promessa difícil de executar, porque cobrar valores muito pequenos exigia sistemas de pagamento caros e complexos. Com carteiras digitais e APIs de cobrança, a barreira técnica diminuiu, embora ainda restem questões de identidade, impostos, conversão de moeda e contestação de transações.
Para um site brasileiro, a cobrança por consulta teria de considerar o custo de operar em reais, a emissão de notas, a proteção de dados e a capacidade de distinguir uma requisição legítima de uma tentativa de abuso. O modelo também precisaria impedir que uma página vire um conteúdo fechado para pessoas que não podem pagar. A web aberta só continua aberta se o acesso humano direto permanecer simples e se os termos forem compreensíveis.
O risco de uma nova camada de intermediários
O plano parece promissor, mas cria uma dependência adicional. Se uma plataforma de infraestrutura decide quais agentes são confiáveis e qual é o preço do acesso, ela ganha poder sobre a circulação da informação. Sites pequenos podem aceitar regras padronizadas porque não têm equipe para negociar com cada laboratório. Agentes independentes podem ficar de fora por não conseguirem cumprir exigências de autenticação ou pagamento.
Também existe uma dificuldade de medir o valor de cada acesso. Uma consulta simples pode consumir pouco processamento, enquanto outra pode provocar dezenas de requisições encadeadas. Alguns agentes podem armazenar a resposta e reutilizá-la durante semanas; outros precisam de atualização constante. O preço precisa ser transparente o bastante para que desenvolvedores saibam quanto uma integração vai custar antes de colocá-la em produção.
A identificação do agente é outro ponto sensível. Um identificador pode ajudar o site a aplicar regras, mas não deve virar um mecanismo de rastreamento de cada pergunta feita por uma pessoa. O desenho precisa separar a identidade do serviço automatizado do conteúdo pessoal do usuário. Caso contrário, a tentativa de financiar a web pode ampliar a coleta de dados sobre hábitos de navegação.
O que profissionais digitais devem acompanhar
Para equipes que mantêm sites e APIs, a primeira medida prática é observar o tráfego automatizado. Logs de acesso podem mostrar agentes que ignoram limites, fazem muitas requisições ou exploram rotas que não deveriam ser públicas. Regras no arquivo robots.txt continuam úteis, mas não bastam para aplicações que precisam autenticar usuários ou aplicar condições por tipo de cliente.
Também vale separar conteúdo público, conteúdo licenciado e dados que nunca deveriam aparecer em respostas automatizadas. Uma API com escopo claro é mais segura do que deixar um agente navegar por toda a aplicação. Limites de velocidade, chaves revogáveis e registro de finalidade reduzem o impacto de uma credencial vazada. Para empresas brasileiras, essa organização ajuda a cumprir princípios de necessidade e segurança previstos na legislação de proteção de dados.
Quem consome serviços de IA também deve perguntar de onde vêm as respostas. Um resumo sem link pode esconder uma cadeia de fontes frágeis e retirar do leitor a possibilidade de conferir o contexto. Produtos confiáveis precisam informar a origem das informações, respeitar instruções de acesso e deixar claro quando uma resposta foi baseada em material pago, incompleto ou antigo.
Uma mudança no contrato da internet
A discussão da Cloudflare não é apenas sobre cobrar por robôs. Ela expõe a tensão entre uma web que funciona como biblioteca pública e uma web que serve de matéria-prima para empresas de IA. O primeiro modelo depende de circulação livre. O segundo depende de acesso intenso e automatizado. Sem uma forma de dividir custos e benefícios, o incentivo para publicar material original pode continuar caindo.
A solução não será decidida por uma única empresa. Provedores de infraestrutura, editores, desenvolvedores de agentes, anunciantes e usuários terão de definir padrões para identificação, pagamento e privacidade. O Brasil pode participar dessa conversa ao exigir transparência, preservar o acesso humano e estimular APIs que deem aos criadores controle sobre o uso do próprio conteúdo.
O cenário mais saudável é uma web em que agentes possam ajudar sem apagar as fontes. Para isso, a automação precisa levar links, reconhecer permissões e financiar os sistemas que sustentam a informação. A proposta ainda está em formação, mas a pergunta já chegou: quem paga quando um agente lê a internet em nome de milhões de pessoas?
Fonte original: The Verge, Can Cloudflare CEO Matthew Prince save the web from AI?



