Kurzantwort
GPTBot ist der OpenAI-Crawler für öffentliche Webinhalte, die für das Training generativer Foundation-Modelle in Betracht kommen können.
KI-Crawler-Leitfaden
GPTBot ist der OpenAI-Crawler für öffentliche Webinhalte, die für das Training generativer Foundation-Modelle in Betracht kommen können.
Kurzantwort
GPTBot ist der OpenAI-Crawler für öffentliche Webinhalte, die für das Training generativer Foundation-Modelle in Betracht kommen können.
Crawler-Fakten
User-Agent-Token
GPTBot
Betreiber
KI-Console-Gruppe
Autonomer Crawler: Zugriff erlauben, öffentliche Inhalte lesbar halten und Logs beobachten.
robots.txt
Dokumentation
Quelldokumentation öffnenGPTBot ist kein Live-Besuch eines ChatGPT-Nutzers. Er crawlt automatisiert öffentliche Webseiten und wird in robots.txt mit dem Token GPTBot gesteuert.
Die KI-Console-Gruppe ist Training. Ein Besuch zeigt technischen Zugriff durch einen Trainings- oder Datencrawler, nicht dass Ihre Seite gerade in einer ChatGPT-Antwort zitiert wurde.
Wenn Sie GPTBot blockieren, kann das reduzieren, wie Systeme von OpenAI Ihre öffentlichen Inhalte sehen, indexieren, für Training verwenden oder abrufen. Erlauben verbessert den technischen Zugriff, garantiert aber nie Crawl, Ranking, Zitat oder positive KI-Antwort.
OpenAI dokumentiert GPTBot als robots.txt-steuerbar. Ein Disallow für GPTBot signalisiert, dass Inhalte nicht für das Training generativer Foundation-Modelle verwendet werden sollen.
Nutzen Sie den exakten Token GPTBot in Ihrer robots.txt. Private Pfade separat blockiert lassen, wenn nur ein Teil der Website verfügbar sein soll.
:bot erlauben
User-agent: GPTBot
Allow: /
:bot blockieren
User-agent: GPTBot
Disallow: /
Klare Antworten
KI-Console verkauft keine magische Sichtbarkeit. Wir machen Ihre Website für KI-Systeme lesbarer und zeigen Nachweise, wo Logs sie hergeben.
GPTBot ist ein Crawler oder robots.txt-Steuer-Token von OpenAI. Die Fakten oben zeigen Zweck, robots.txt-Verhalten und die exakten Regeln zum Erlauben oder Blockieren.
Nutzen Sie User-agent: GPTBot und Disallow: /. robots.txt ist eine Richtlinie für regelkonforme Crawler, keine technische Zugriffssperre.
Es kann die Sichtbarkeit in Systemen von OpenAI reduzieren, wenn diese Systeme Ihre Inhalte nicht mehr crawlen, indexieren, für Training verwenden oder abrufen können. Der Effekt hängt vom Bot-Typ und Produkt ab.
Eigene Website prüfen
Starten Sie zuerst den Gratis-Scan. Mit einem Konto verifizieren Sie die Domain, speichern Verlauf, generieren Dateien und dokumentieren Crawler-Besuche.