Google-Extended
Operado por Google · Controla el uso para entrenamiento y grounding de Gemini
Google-Extended no es un crawler y no tiene un bot propio: es un token independiente de robots.txt. Googlebot obtiene el contenido de la forma habitual; Google-Extended únicamente controla si ese contenido ya rastreado puede utilizarse para entrenar los modelos generativos Gemini y Vertex AI.
Qué hace
Google-Extended no tiene su propio HTTP User-Agent ni su propio crawler. La documentación de Google especifica que el rastreo se realiza mediante los User-Agent existentes de Google y que este token de robots.txt se utiliza únicamente para controlar cómo pueden utilizarse posteriormente esos datos.
Bloquear Google-Extended determina si el contenido ya rastreado por Googlebot puede utilizarse para entrenar futuros modelos de Gemini, para grounding en las aplicaciones de Gemini y para Grounding with Google Search en Vertex AI. Google afirma que este token no afecta a la inclusión ni al posicionamiento de un sitio en Google Search.
Por qué el bloqueo es opcional
- Es un mecanismo de control sobre el uso para entrenamiento, no sobre el acceso: bloquearlo no impide que Googlebot rastree o indexe tu sitio.
- Google afirma que bloquearlo no afecta a la inclusión ni al posicionamiento en Search.
- Permitir o no que tu contenido se utilice para el entrenamiento de Gemini/Vertex AI es una decisión de estrategia de contenidos, no un requisito técnico.
Identificación y robots.txt
Google-Extended
Google-Extended no tiene un HTTP User-Agent independiente que pueda verificarse: es un grupo identificado por nombre dentro de tu archivo robots.txt. La documentación oficial de Google ofrece información adicional.
User-agent: Google-Extended
Disallow: /