Ranking de crawlers atualizado diariamente
Índice de crawlers de IA: quais são os bots que mais rastreiam a Web?
O Índice de crawlers de IA classifica os crawlers mais ativos na Web, desde bots de pesquisa como Googlebot e Bingbot até crawlers usados para treinar modelos de IA, como GPTBot (OpenAI), ClaudeBot (Anthropic) e Meta-ExternalAgent (Meta). Os dados do Cloudflare Radar são atualizados diariamente e abrangem milhares de milhões de pedidos a milhões de sites.
Principais crawlers
Meta-ExternalAgent
Meta
13.01%
Googlebot
23.89%
ClaudeBot
Anthropic
8.21%
Atividade dos bots: últimos 90 dias
Fonte: Cloudflare Radar (volumes de pedidos normalizados em toda a rede global da Cloudflare)
Ranking de crawlers identificados pelo nome
O tráfego agregado de bots é apresentado separadamente para que não ocupe uma posição superior à de qualquer crawler individual no ranking.
Googlebot
23.89%
Meta-ExternalAgent
Meta
13.01%
ClaudeBot
Anthropic
8.21%
Bingbot
Microsoft
6.02%
facebookexternalhit
Meta
5.57%
Applebot
Apple
5.39%
GPTBot
OpenAI
4.0%
Amazonbot
Amazon
3.6%
GoogleOther
2.35%
PetalBot
Huawei
1.5%
YandexBot
Yandex
0.93%
Outros bots
Tráfego agregado de crawlers com menor volume e de crawlers não classificados. Está incluído nos totais dos gráficos, mas excluído do ranking de crawlers.
Sobre esta categoria agregada25.53%
Sobre estes bots
Googlebot
(Google)Crawler principal da Google para indexar páginas na Pesquisa Google. É o crawler mais ativo da Web.
Bloquear através do robots.txt:
User-agent: Googlebot
Meta-ExternalAgent
(Meta)Crawler de treino de IA da Meta, usado nos modelos Llama e nos produtos Meta AI.
Bloquear através do robots.txt:
User-agent: Meta-ExternalAgent
ClaudeBot
(Anthropic)Crawler da Anthropic usado para treinar os modelos Claude. Respeita as diretivas do robots.txt.
Bloquear através do robots.txt:
User-agent: ClaudeBot
Bingbot
(Microsoft)Crawler da Microsoft para indexar páginas na Pesquisa do Bing e alimentar as respostas do Copilot.
Bloquear através do robots.txt:
User-agent: Bingbot
facebookexternalhit
(Meta)Crawler da Meta que obtém pré-visualizações das páginas quando um URL é partilhado no Facebook ou no Instagram.
Bloquear através do robots.txt:
User-agent: facebookexternalhit
Applebot
(Apple)Crawler da Apple que apoia a Siri, o Spotlight e as funcionalidades do Apple Intelligence.
Bloquear através do robots.txt:
User-agent: Applebot
GPTBot
(OpenAI)Crawler da OpenAI usado para treinar e melhorar o ChatGPT e outros modelos. Respeita as diretivas do robots.txt.
Bloquear através do robots.txt:
User-agent: GPTBot
Amazonbot
(Amazon)Crawler da Amazon para a Alexa AI e os serviços de aprendizagem automática da Amazon.
Bloquear através do robots.txt:
User-agent: Amazonbot
GoogleOther
(Google)Crawler secundário da Google, usado em tarefas de investigação e de indexação fora da Pesquisa.
Bloquear através do robots.txt:
User-agent: GoogleOther
YandexBot
(Yandex)Crawler da Yandex para indexar páginas no maior motor de pesquisa da Rússia.
Bloquear através do robots.txt:
User-agent: YandexBot
Perguntas frequentes do AI Crawler Index
Acompanhe como os crawlers de IA afetam a visibilidade da sua marca
A LLM Pulse monitoriza as menções à sua marca nos modelos de IA. Veja quais os crawlers que visitam o seu site e como isso se traduz na visibilidade da sua marca nas respostas dos modelos de IA.