Skip to content
Directorio de bots de IA

¿Qué bots de IA deberían acceder a tu sitio web?

Este directorio incluye crawlers de IA identificables y agentes activados por el usuario, tokens de control de robots.txt y las principales plataformas de IA con acceso a la web pero sin una identidad de bot documentada públicamente: qué hace cada uno y nuestra recomendación de GEO cuando corresponde.

24
Bots y tokens monitorizados
14
Recomendación: mantener abiertos
10
Bloqueo opcional
ChatGPT-User
OpenAI · Impulsa ChatGPT
Asistente de IA

Obtiene una página en respuesta directa a una acción o solicitud específica de un usuario de ChatGPT.

Mantener abierto Perfil
OAI-SearchBot
OpenAI · Impulsa ChatGPT Search
Crawler de búsqueda

Rastrea contenido para ChatGPT Search. OpenAI vincula directamente su acceso con la posibilidad de que el contenido sea encontrado, mostrado y citado.

Mantener abierto Perfil
GPTBot
OpenAI · Impulsa el entrenamiento de modelos
Crawler de entrenamiento

Recopila contenido público que puede utilizarse para entrenar futuros modelos de OpenAI.

Bloqueo opcional Perfil
OAI-AdsBot
OpenAI · Impulsa ChatGPT Ads
Crawler de verificación de anuncios

Visita las páginas de destino enviadas como anuncios de ChatGPT para comprobar el cumplimiento de las políticas y su relevancia. No está relacionado con la visibilidad en búsquedas ni con el entrenamiento de modelos.

Bloqueo opcional Perfil
Claude-User
Anthropic · Impulsa Claude
Asistente de IA

Obtiene páginas cuando una solicitud de un usuario de Claude requiere contenido web actualizado.

Mantener abierto Perfil
Claude-SearchBot
Anthropic · Impulsa la búsqueda y las citas de Claude
Crawler de búsqueda

Indexa la web para mejorar la calidad y la relevancia de los resultados de búsqueda de Claude.

Mantener abierto Perfil
ClaudeBot
Anthropic · Impulsa el entrenamiento de modelos de Claude
Crawler de entrenamiento

Recopila contenido web que podría utilizarse para entrenar futuros modelos de Claude.

Bloqueo opcional Perfil
Perplexity-User
Perplexity · Impulsa Perplexity
Asistente de IA

Puede obtener una página directamente para responder a una pregunta específica de un usuario y citarla en la respuesta.

Mantener abierto Perfil
PerplexityBot
Perplexity · Impulsa la búsqueda de Perplexity
Crawler de búsqueda

Construye el índice de búsqueda de Perplexity; oficialmente no se utiliza para entrenar modelos fundacionales.

Mantener abierto Perfil
Googlebot
Google · Impulsa Google Search y AI Overviews
Crawler de búsqueda

Es la base del índice de búsqueda de Google, que también alimenta las funciones de IA de Google. No recomendamos bloquearlo en un sitio comercial.

Mantener abierto Perfil
Google-Extended
Google · Controla el uso para entrenamiento y grounding de Gemini
Token de control

Es un token de control de robots (no un crawler) que determina si el contenido ya rastreado puede utilizarse para entrenar y proporcionar grounding a Gemini.

Bloqueo opcional Perfil
DuckAssistBot
DuckDuckGo · Impulsa DuckAssist
Crawler de búsqueda

Obtiene páginas en tiempo real para generar respuestas asistidas por IA con fuentes; no se utiliza para entrenar modelos.

Mantener abierto Perfil
Meta-ExternalFetcher
Meta · Permite la recuperación web iniciada por el usuario en los productos de Meta
Asistente de IA

Obtiene contenido web específico bajo demanda para las funciones de Meta AI.

Mantener abierto Perfil
Meta-ExternalAgent
Meta · Entrena Meta AI y los modelos Llama
Crawler de entrenamiento

Recopila e indexa contenido para los sistemas de IA de Meta.

Bloqueo opcional Perfil
MistralAI-User
Mistral AI · Acceso web iniciado por el usuario en Vibe
Asistente de IA

Obtiene páginas web a petición del usuario para proporcionar respuestas de IA actualizadas.

Mantener abierto Perfil
MistralAI-Index
Mistral AI · Impulsa la búsqueda en Vibe
Crawler de búsqueda

Crawler automatizado que indexa contenido web para las funciones de búsqueda de Mistral AI.

Mantener abierto Perfil
MistralAI-Training
Mistral AI · Recopila datos para el entrenamiento de modelos
Crawler de entrenamiento

Crawler automatizado que recopila contenido web para los conjuntos de datos de entrenamiento de la IA generativa de Mistral.

Bloqueo opcional Perfil
Applebot
Apple · Impulsa Siri, Spotlight y Safari
Crawler de búsqueda

Impulsa Siri, Spotlight y Safari; ahora también se utiliza como contexto en tiempo real para las respuestas de IA de Apple.

Mantener abierto Perfil
Applebot-Extended
Apple · Controla el uso para el entrenamiento de Apple Intelligence
Token de control

Es un token de control de robots que determina si los datos de Applebot pueden utilizarse para entrenar modelos fundacionales.

Bloqueo opcional Perfil
Amazonbot
Amazon · Impulsa productos de Amazon y modelos de IA
Crawler de entrenamiento

Recopila contenido web para los servicios de Amazon, incluidos los sistemas de respuesta de Alexa.

Bloqueo opcional Perfil
Amzn-SearchBot
Amazon · Impulsa las experiencias de búsqueda de Amazon, incluida Alexa
Crawler de búsqueda

Se utiliza para experiencias de búsqueda como Alexa; Amazon afirma que no se utiliza para entrenar modelos de IA generativa.

Mantener abierto Perfil
Amzn-User
Amazon · Impulsa solicitudes de Alexa iniciadas por el usuario
Asistente de IA

Obtiene una página en nombre de una solicitud de Alexa/Amazon iniciada por un usuario para acceder a información actualizada.

Mantener abierto Perfil
CCBot
Common Crawl · Alimenta un conjunto de datos compartido utilizado por múltiples empresas
Crawler de conjuntos de datos

Construye el conjunto de datos de Common Crawl, ampliamente utilizado en el ecosistema de ML/LLM.

Bloqueo opcional Perfil
Bytespider
ByteDance · Ampliamente atribuido a ByteDance · Finalidad no documentada oficialmente
Crawler de entrenamiento

Crawler de entrenamiento · Crawler de ByteDance asociado con la recopilación de datos para sus productos de IA.

Bloqueo opcional Perfil
Sin identidad de bot pública

Plataformas de IA sin una identidad de bot pública

Estas plataformas impulsan asistentes de IA ampliamente utilizados, pero no han publicado un User-Agent específico para su crawler ni rangos de IP propios, por lo que su tráfico no puede verificarse ni controlarse de forma selectiva mediante robots.txt a día de hoy.

Qwen
Alibaba
Plataforma de IA

Impulsa Qwen Chat y Quark. Alibaba no ha publicado un User-Agent específico para su bot ni rangos de IP propios para el tráfico de acceso a la web.

Sin identidad de bot Perfil
DeepSeek
DeepSeek
Plataforma de IA

Impulsa el chat de DeepSeek y sus respuestas enriquecidas con búsquedas. No se ha documentado públicamente ninguna identidad de crawler o bot de acceso a la web.

Sin identidad de bot Perfil
Grok
xAI
Plataforma de IA

Responde preguntas dentro de X y de la aplicación Grok, y en ocasiones cita contenido web actualizado, sin disponer de una identidad de bot publicada.

Sin identidad de bot Perfil