Guía robots.txt
Si quieres que sistemas relacionados con ChatGPT alcancen contenido público, nombra explícitamente los tres agentes. Aun así puedes bloquear rutas privadas o permitir consultas en vivo limitando el acceso amplio de entrenamiento.
Reglas iniciales OpenAI
User-agent: GPTBot
Allow: /
User-agent: ChatGPT-User
Allow: /
User-agent: OAI-SearchBot
Allow: /
Sitemap: https://www.example.com/sitemap.xml
Los tres caminos hacia una respuesta de ChatGPT
Primero, a través del entrenamiento: su página estaba en los datos con los que aprendió el modelo. Sobre eso ya no tiene influencia ni forma de comprobarlo. Segundo, a través de la búsqueda: OAI-SearchBot guarda la página en un índice del que ChatGPT tira cuando hace falta. Tercero, a través de la consulta en directo: alguien pregunta y ChatGPT recupera la página en ese momento. Solo los dos últimos caminos se pueden dirigir, y ahí se decide si su empresa se describe como es hoy o según una instantánea caducada.
Lo que ChatGPT ve realmente al consultar
Una consulta no es una visita de navegador. No se ejecuta JavaScript, no se mueve el ratón, no se abre ningún desplegable. Cuenta lo que está en el código fuente; lo que carga después un script normalmente no está. El texto dentro de imágenes tampoco está: un precio sobre un gráfico sencillamente no existe para un sistema de IA. Puede comprobarlo sin herramientas: abra la página, desactive JavaScript en el navegador, recargue. Lo que siga siendo legible es más o menos lo que llega.
Seis razones por las que una página no aparece
Un Disallow en robots.txt, a menudo resto de una fase de pruebas antigua. Un cortafuegos o una protección antibots que rechaza en bloque los agentes desconocidos: entonces la consulta ni siquiera llega. Contenidos visibles solo tras iniciar sesión o aceptar un diálogo de consentimiento. Una página cuya información está dentro de una imagen. Una página muy larga en la que los datos importantes están al final y caen al recortarla. Y el caso más frecuente: la pregunta que hace el cliente no se responde como pregunta en ningún sitio de la web.
Lo que puede comprobar en media hora
Abra su robots.txt en el navegador y lea si GPTBot, ChatGPT-User y OAI-SearchBot están permitidos allí. Desactive JavaScript y compruebe si su mensaje esencial sigue estando. En su página más importante, busque las tres preguntas que los clientes hacen por teléfono: ¿están ahí como preguntas, con una respuesta debajo? Revise los registros del servidor en busca de esos tres agentes. Y pregúntele a ChatGPT por su propia empresa: lo que salga es el punto de partida más honesto que puede conseguir.
Lo que se puede medir y lo que no
El acceso se mide: qué agente descargó qué página, cuándo y con qué resultado. Lo que no se mide es si eso se convirtió en una mención. OpenAI no publica ninguna estadística sobre cuántas respuestas nombraron su página; nadie puede prometerlo en serio, y quien venda una cifra la ha estimado. Lo que sí puede hacer: demostrar el acceso, preguntar con regularidad a ChatGPT por su propia empresa y comparar las respuestas a lo largo de meses. Es menos cómodo que un indicador, pero es cierto.
Cómo KI-Console prueba visitas
KI-Console reconoce GPTBot, ChatGPT-User y OAI-SearchBot en logs subidos y mediante el tracker cuando está instalado. El Radar separa los grupos para que el acceso en vivo no quede oculto en tráfico bot genérico.
Lo que una visita no prueba
Una visita crawler no garantiza ranking, inclusión, cita ni respuesta positiva. Prueba acceso técnico en un momento concreto, que es la base que puedes controlar.