Ranking de crawlers atualizado diariamente

Índice de crawlers de IA: quais são os bots que mais rastreiam a Web?

O Índice de crawlers de IA classifica os crawlers mais ativos na Web, desde bots de pesquisa como Googlebot e Bingbot até crawlers usados para treinar modelos de IA, como GPTBot (OpenAI), ClaudeBot (Anthropic) e Meta-ExternalAgent (Meta). Os dados do Cloudflare Radar são atualizados diariamente e abrangem milhares de milhões de pedidos a milhões de sites.

Principais crawlers

Meta

Meta-ExternalAgent

Meta

13.01%

2
Google

Googlebot

Google

23.89%

1
Anthropic

ClaudeBot

Anthropic

8.21%

3

Atividade dos bots: últimos 90 dias

100% empilhado
LLM Pulse

Fonte: Cloudflare Radar (volumes de pedidos normalizados em toda a rede global da Cloudflare)

Ranking de crawlers identificados pelo nome

O tráfego agregado de bots é apresentado separadamente para que não ocupe uma posição superior à de qualquer crawler individual no ranking.

Outros bots

Tráfego agregado de crawlers com menor volume e de crawlers não classificados. Está incluído nos totais dos gráficos, mas excluído do ranking de crawlers.

Sobre esta categoria agregada

25.53%

Sobre estes bots

Google

Googlebot

(Google)

Crawler principal da Google para indexar páginas na Pesquisa Google. É o crawler mais ativo da Web.

Bloquear através do robots.txt: User-agent: Googlebot

Saber mais →
Meta

Meta-ExternalAgent

(Meta)

Crawler de treino de IA da Meta, usado nos modelos Llama e nos produtos Meta AI.

Bloquear através do robots.txt: User-agent: Meta-ExternalAgent

Saber mais →
Anthropic

ClaudeBot

(Anthropic)

Crawler da Anthropic usado para treinar os modelos Claude. Respeita as diretivas do robots.txt.

Bloquear através do robots.txt: User-agent: ClaudeBot

Saber mais →
Microsoft

Bingbot

(Microsoft)

Crawler da Microsoft para indexar páginas na Pesquisa do Bing e alimentar as respostas do Copilot.

Bloquear através do robots.txt: User-agent: Bingbot

Saber mais →
Meta

facebookexternalhit

(Meta)

Crawler da Meta que obtém pré-visualizações das páginas quando um URL é partilhado no Facebook ou no Instagram.

Bloquear através do robots.txt: User-agent: facebookexternalhit

Saber mais →
Apple

Applebot

(Apple)

Crawler da Apple que apoia a Siri, o Spotlight e as funcionalidades do Apple Intelligence.

Bloquear através do robots.txt: User-agent: Applebot

Saber mais →
OpenAI

GPTBot

(OpenAI)

Crawler da OpenAI usado para treinar e melhorar o ChatGPT e outros modelos. Respeita as diretivas do robots.txt.

Bloquear através do robots.txt: User-agent: GPTBot

Saber mais →
Amazon

Amazonbot

(Amazon)

Crawler da Amazon para a Alexa AI e os serviços de aprendizagem automática da Amazon.

Bloquear através do robots.txt: User-agent: Amazonbot

Saber mais →
Google

GoogleOther

(Google)

Crawler secundário da Google, usado em tarefas de investigação e de indexação fora da Pesquisa.

Bloquear através do robots.txt: User-agent: GoogleOther

Saber mais →
Yandex

YandexBot

(Yandex)

Crawler da Yandex para indexar páginas no maior motor de pesquisa da Rússia.

Bloquear através do robots.txt: User-agent: YandexBot

Saber mais →

Perguntas frequentes do AI Crawler Index

Acompanhe como os crawlers de IA afetam a visibilidade da sua marca

A LLM Pulse monitoriza as menções à sua marca nos modelos de IA. Veja quais os crawlers que visitam o seu site e como isso se traduz na visibilidade da sua marca nas respostas dos modelos de IA.