Respuesta corta
Google-Extended no es un rastreador HTTP propio: es un token de producto en robots.txt que controla ciertos usos de Gemini para entrenamiento y anclaje.
Guia de crawlers IA
Google-Extended no es un rastreador HTTP propio: es un token de producto en robots.txt que controla ciertos usos de Gemini para entrenamiento y anclaje.
Respuesta corta
Google-Extended no es un rastreador HTTP propio: es un token de producto en robots.txt que controla ciertos usos de Gemini para entrenamiento y anclaje.
Datos del crawler
Token user-agent
Google-Extended
Operador
Grupo KI-Console
Crawler autonomo: permite acceso, manten contenido publico legible y monitoriza logs.
robots.txt
Documentacion
Abrir documentacion fuenteGoogle descarga las páginas con sus agentes habituales. Google-Extended decide después si el contenido ya rastreado por Google puede servir para los usos de Gemini documentados.
En KI-Console pertenece al grupo «entrenamiento», más exactamente a un token de control para entrenamiento y anclaje. Google indica que Google-Extended no controla la inclusión en Google Search ni es una señal de posicionamiento.
Bloquear Google-Extended puede reducir como los sistemas de Google ven, indexan, usan para entrenamiento o recuperan tu contenido publico. Permitirlo mejora el acceso tecnico, pero nunca garantiza rastreo, ranking, cita ni respuesta IA positiva.
Use exactamente el token Google-Extended en robots.txt. Bloquearlo reduce la idoneidad para los usos de Gemini enumerados, pero no bloquea a Googlebot.
Usa el token exacto Google-Extended en robots.txt. Mantén rutas privadas bloqueadas por separado si solo una parte del sitio debe estar disponible.
Permitir :bot
User-agent: Google-Extended
Allow: /
Bloquear :bot
User-agent: Google-Extended
Disallow: /
Respuestas directas
KI-Console no vende visibilidad mágica. Hacemos tu sitio más legible para sistemas de IA y mostramos pruebas cuando los logs lo permiten.
Google-Extended es un crawler o token de control robots.txt operado por Google. Los datos superiores muestran objetivo, comportamiento robots.txt y reglas exactas para permitir o bloquear.
Usa User-agent: Google-Extended y Disallow: /. robots.txt es una directiva para crawlers conformes, no una barrera tecnica.
Puede reducir la visibilidad en sistemas de Google si esos sistemas ya no pueden rastrear, indexar, entrenar o recuperar tu contenido. El efecto depende del tipo de bot y del producto.
Comprueba tu sitio
Empieza con el escaneo gratis. Con una cuenta verificas el dominio, guardas historial, generas archivos y documentas visitas de crawlers en el tiempo.