Cloudflare lança Web Search API para dar busca em tempo real a agentes de IA
Em beta desde 2 de outubro, a Web Search API roda dentro do AI Gateway e deixa Workers e agentes consultarem a internet ao vivo, sem depender do corte de treino do modelo.

A Cloudflare anunciou em 2 de outubro de 2026 a Web Search API, em beta, uma forma de dar a agentes e aplicações de IA↳Inteligência artificial440 conteúdosUX e IA: Transformando Experiências Digitais com Inteligência ArtificialProduto & UX · jan 2025MCP: O que é e por que você vai ouvir falar disso em breve?AI · jul 2025IA generativa e a urgência de reconstruir nossa relação com a verdadeAI · jun 2025Ver tudo em AI → acesso a busca ao vivo na internet. A ideia, segundo o changelog oficial, é resolver dois problemas clássicos de quem constrói sobre LLM: o modelo "chutar" uma URL que não existe e respostas baseadas só no que entrou no treino, já desatualizadas no dia em que o produto vai para produção.
Para quem desenvolve no Brasil, isso é relevante além do hype de agente de IA. Se o seu produto já usa AI Gateway para rotear chamadas a modelos, a busca na web passa a ser só mais uma chamada dentro da mesma esteira de logs, cache e billing que você já monitora, em vez de mais uma integração solta com SDK e chave de API separados.
O que a API resolve na prática
Atualizações de modelo têm um corte de treino: perguntar sobre um evento de ontem, um preço atual ou a versão mais recente de uma biblioteca gera resposta inventada ou desatualizada. A saída comum até aqui era implementar RAG com um provedor de busca à parte, cada um com contrato, autenticação e formato de resposta próprios.
A Web Search API empacota essa busca como uma chamada só, com três provedores à escolha no lançamento: Ceramic.ai, Exa e Linkup. Os três suportam Zero Data Retention (ZDR) para requisições feitas através da Cloudflare, e todos assinaram os padrões de crawling de bot verificado da própria Cloudflare. Para quem lida com dados sensíveis ou precisa justificar conformidade com a LGPD↳LGPD14 conteúdosComo utilizar a LGPD com o objetivo de conformidade e inovação?Gestão Dev & TI · out 2021LGPD coloca pressão inédita nos responsáveis pela tecnologia das empresasData · ago 2021Proteção de dados: LGPD é sancionada e começa a valerData · set 2020Ver tudo em Gestão Dev & TI → em auditoria, o ZDR nativo nos três provedores é um detalhe que evita ter que caçar essa garantia caso a caso com cada fornecedor.
Uma chamada, três provedores
A chamada acontece por dentro do AI Gateway: as requisições de busca aparecem nos logs do gateway e são cobradas dos créditos de AI Gateway ao preço de lista de cada provedor, sem markup da Cloudflare. Também é possível usar sua própria chave de API do provedor em vez de depender do crédito da Cloudflare.
Na prática, isso significa trocar de provedor sem reescrever a lógica de chamada: o parâmetro muda, o resto do pipeline de observabilidade↳Observabilidade11 conteúdosObservabilidade para APIs: os desafios e benefícios dessa abordagemDev (Back & Front) · jan 2025Falhas em Observabilidade afetam os Apps e a Segurança das OrganizaçõesDev (Back & Front) · nov 2023ADK Java 1.0: O Google quer que você pare de gambiarra Python no seu backendMarketing Tech · abr 2026Ver tudo em DevSecOps → continua igual. Para quem já roda múltiplos modelos no mesmo AI Gateway, a busca entra no mesmo painel de custo e latência que hoje mostra as chamadas de inferência.
Como chamar a API
O exemplo via REST, direto do changelog, mostra a chamada básica:
curl https://api.cloudflare.com/client/v4/accounts/$CLOUDFLARE_ACCOUNT_ID/ai/websearch/ \
--request POST \
--header "Authorization: Bearer $CLOUDFLARE_API_TOKEN" \
--header "Content-Type: application/json" \
--data '{
"query": "What are some fun things to do in Salt Lake City as fall approaches?",
"provider": "ceramic",
"limit": 5,
"options": { "gateway": { "id": "default" } }
}'Para quem já tem Worker rodando com o binding AI, a chamada fica ainda mais curta, sem precisar montar requisição HTTP manual:
const response = await env.AI.websearch({
gatewayId: "default",
query: "What are some fun things to do in Salt Lake City as fall approaches?",
provider: "exa",
limit: 5,
});
const results = await response.json();O parâmetro limit controla quantos resultados voltam por consulta, e provider é o único campo que muda ao trocar entre Ceramic.ai, Exa e Linkup. Quem já usa AI Gateway para outras chamadas de modelo reconhece o padrão: mesmo gatewayId, mesma estrutura de resposta em JSON, sem SDK novo para aprender.
O que ainda fica em aberto
A documentação de referência, How to use Web Search API, traz os detalhes de uso, mas o changelog não entra em comparação de qualidade entre os três provedores nem em limites de taxa por plano. Como a API está em beta, é esperado que preço, limites e até a lista de provedores mudem antes da versão estável.
Também não há, até o momento, informação pública sobre latência típica de cada provedor dentro do AI Gateway, nem sobre suporte a filtros de busca mais finos (data, domínio, idioma) além do parâmetro limit. Para quem for adotar agora, em beta, vale tratar a escolha de provedor como algo a revisitar quando a Cloudflare publicar dados de uso em produção.
Na prática, o recorte que a Cloudflare está vendendo é menos "mais um provedor de busca" e mais "busca como parte do mesmo pipeline de observabilidade e billing que você já usa para IA". Para times que já roteiam tudo pelo AI Gateway, isso tende a poupar a integração extra; para quem não usa a Cloudflare como camada de IA, a Web Search API só compensa se o resto da stack também migrar para lá.
Fonte: Hacker News
Este artigo foi escrito por Redação iMasters. Conteúdo produzido por agente de IA da redação iMasters, sob revisão editorial humana. Saiba como produzimos no expediente.
Modelo de 125 bilhões de parâmetros roda em GPU de 12 GB com o Strata
O projeto de código aberto Strata faz o modelo Qwen3.8-Flash-Next, de 125 bilhões de parâmetros, funcionar em placas de vídeo comuns, dividindo o trabalho entre GPU, RAM e processador.














