Clasificación de rastreadores en directo, actualizada a diario

Índice de rastreadores de IA: ¿qué bots rastrean más la web?

El Índice de rastreadores de IA clasifica los rastreadores más activos de la web, desde bots de buscadores como Googlebot y Bingbot hasta rastreadores de entrenamiento de IA como GPTBot (OpenAI), ClaudeBot (Anthropic) y Meta-ExternalAgent (Meta). Se actualiza a diario con datos de Cloudflare Radar que abarcan miles de millones de solicitudes a millones de sitios web.

Principales rastreadores

Meta

Meta-ExternalAgent

Meta

10.0%

2
Google

Googlebot

Google

24.53%

1
Anthropic

ClaudeBot

Anthropic

7.55%

3

Actividad de bots: últimos 90 días

Apilado al 100%
LLM Pulse

Fuente: Cloudflare Radar (volúmenes de solicitudes normalizados a través de la red global de Cloudflare)

Clasificación de rastreadores con nombre

El tráfico agregado de bots se muestra aparte para que no aparezca por delante de ningún rastreador individual.

Otros bots

Tráfico combinado de rastreadores de menor volumen y sin clasificar. Se incluye en los totales del gráfico, pero queda fuera de la clasificación de rastreadores.

Acerca de esta categoría agregada

25.4%

Acerca de estos bots

Google

Googlebot

(Google)

Rastreador web principal de Google que indexa páginas para Google Search. Es el rastreador más activo de la web.

Bloquear mediante robots.txt: User-agent: Googlebot

Más información →
Meta

Meta-ExternalAgent

(Meta)

Rastreador de entrenamiento de IA de Meta, utilizado para los modelos Llama y los productos de Meta AI.

Bloquear mediante robots.txt: User-agent: Meta-ExternalAgent

Más información →
Anthropic

ClaudeBot

(Anthropic)

Rastreador web de Anthropic utilizado para entrenar los modelos de IA Claude. Respeta las directivas de robots.txt.

Bloquear mediante robots.txt: User-agent: ClaudeBot

Más información →
Apple

Applebot

(Apple)

Rastreador web de Apple que da soporte a Siri, Spotlight y las funciones de Apple Intelligence.

Bloquear mediante robots.txt: User-agent: Applebot

Más información →
Microsoft

Bingbot

(Microsoft)

Rastreador web de Microsoft que indexa páginas para Bing Search y alimenta las respuestas de Copilot.

Bloquear mediante robots.txt: User-agent: Bingbot

Más información →
Meta

facebookexternalhit

(Meta)

Rastreador de Meta que genera las vistas previas de enlace cuando se comparten URLs en Facebook e Instagram.

Bloquear mediante robots.txt: User-agent: facebookexternalhit

Más información →
Amazon

Amazonbot

(Amazon)

Rastreador de Amazon para Alexa AI y sus servicios de machine learning.

Bloquear mediante robots.txt: User-agent: Amazonbot

Más información →
OpenAI

GPTBot

(OpenAI)

Rastreador web de OpenAI utilizado para entrenar y mejorar ChatGPT y otros modelos. Respeta las directivas de robots.txt.

Bloquear mediante robots.txt: User-agent: GPTBot

Más información →
Google

GoogleOther

(Google)

Rastreador secundario de Google, utilizado para investigación y tareas de indexación ajenas a la búsqueda.

Bloquear mediante robots.txt: User-agent: GoogleOther

Más información →
Yandex

YandexBot

(Yandex)

Rastreador web de Yandex que indexa páginas para el mayor motor de búsqueda de Rusia.

Bloquear mediante robots.txt: User-agent: YandexBot

Más información →

Preguntas frecuentes de AI Crawler Index

Monitoriza cómo afectan los rastreadores de IA a la visibilidad de tu marca

LLM Pulse hace un seguimiento de cómo mencionan tu marca los modelos de IA. Descubre qué rastreadores visitan tu sitio y cómo se traduce eso en visibilidad en IA.