Reponse courte
bedrockbot est le jeton robots.txt générique du robot web d'Amazon Bedrock pour les bases de connaissances.
Guide des crawlers IA
bedrockbot est le jeton robots.txt générique du robot web d'Amazon Bedrock pour les bases de connaissances.
Reponse courte
bedrockbot est le jeton robots.txt générique du robot web d'Amazon Bedrock pour les bases de connaissances.
Faits crawler
Token user-agent
bedrockbot
Operateur
Groupe KI-Console
Crawler autonome : autoriser l acces, garder le contenu public lisible et surveiller les logs.
robots.txt
Documentation
Ouvrir la documentation sourceAmazon Bedrock peut explorer les sites qu'un client configure comme source de données pour une base de connaissances. AWS décrit des règles bedrockbot et bedrockbot-UUID.
Dans KI-Console, ce robot appartient au groupe « entraînement ». Plus précisément, il s'agit d'alimenter et d'interroger une base de connaissances pour des applications Bedrock configurées par le client.
Bloquer bedrockbot peut reduire la maniere dont les systemes de Amazon Web Services voient, indexent, utilisent pour l entrainement ou recuperent votre contenu public. Autoriser ameliore l acces technique, mais ne garantit jamais crawl, classement, citation ou reponse IA positive.
AWS documente que le robot web respecte robots.txt selon la RFC 9309 et qu'il examine les règles bedrockbot-UUID avant les règles génériques bedrockbot.
Utilisez le token exact bedrockbot dans robots.txt. Gardez les chemins prives bloques separement si seule une partie du site doit etre accessible.
Autoriser :bot
User-agent: bedrockbot
Allow: /
Bloquer :bot
User-agent: bedrockbot
Disallow: /
Réponses directes
KI-Console ne vend pas de visibilité magique. Nous rendons votre site plus lisible pour les systèmes d'IA et montrons des preuves quand les logs le permettent.
bedrockbot est un crawler ou un token de controle robots.txt opere par Amazon Web Services. Les faits ci-dessus indiquent son objectif, son comportement robots.txt et les regles exactes pour autoriser ou bloquer.
Utilisez User-agent: bedrockbot et Disallow: /. robots.txt est une directive pour les crawlers conformes, pas une barriere technique.
Cela peut reduire la visibilite dans les systemes de Amazon Web Services si ces systemes ne peuvent plus crawler, indexer, entrainer ou recuperer votre contenu. L effet depend du type de bot et du produit.
Vérifier votre site
Commencez par le scan gratuit. Avec un compte, vous vérifiez le domaine, gardez l'historique, générez des fichiers et documentez les visites de crawlers.