Parcours Expertise Enjeux Références Blog Ressources Me contacter →
Thème
Langue
Outil SEO & GEO gratuit

Votre site est-il ouvert aux IA ?

ChatGPT, Claude, Perplexity, Gemini : ces moteurs peuvent citer votre site dans leurs réponses : ou l'ignorer, selon ce que vous les laissez faire. En un test, voyez qui peut lire votre contenu, qui peut l'utiliser pour s'entraîner, et qui peut vous recommander à ses utilisateurs.

Analyse instantanée dans votre navigateur. Rien n'est envoyé ni stocké.

1Votre site

L'outil lit automatiquement les règles d'accès de votre site pour chaque robot IA.

Par défaut la racine. Testez un chemin précis si certaines sections sont réservées.

Qui peut accéder à votre site

Le verdict pour chaque moteur IA, regroupé selon ce qu'il fait de votre contenu.

Renseignez votre site pour voir quels moteurs IA peuvent y accéder.

Comment ça marche

Décider qui entraîne son IA sur votre contenu, et qui peut le citer.

1

Chargez le fichier

Saisissez votre domaine ou collez votre robots.txt. L'outil récupère aussi la présence d'un llms.txt.

2

Lisez chaque verdict

Pour chaque robot IA, autorisé ou bloqué, avec la règle exacte qui décide : user-agent spécifique ou repli sur *.

3

Arbitrez votre stratégie

Bloquer l'entraînement tout en restant citable dans les réponses IA, ou l'inverse : chaque robot a un rôle distinct.

Entraînement, réponses, assistants : ne pas tout confondre

Bloquer un robot IA n'a pas le même effet selon son rôle.

Entraînement ≠ visibilité. Bloquer GPTBot ou CCBot empêche l'usage de votre contenu pour entraîner des modèles, mais ne vous retire pas des réponses en temps réel. Deux décisions séparées.

Rester citable dans les réponses IA (GEO). Les robots de récupération en direct (ChatGPT-User, PerplexityBot) vont chercher votre page pour répondre et vous citer. Les bloquer, c'est disparaître des réponses génératives.

Google-Extended est un jeton d'opt-out. Il ne crawle pas : il contrôle l'usage pour Gemini et Vertex. Le bloquer n'affecte pas votre référencement Google classique, piloté par Googlebot.

Certains robots ignorent robots.txt. Les acteurs respectueux (OpenAI, Anthropic, Google) le suivent. D'autres, plus agressifs, ne le respectent pas : un blocage réseau ou WAF est alors nécessaire.

Questions fréquentes

Sur le contrôle des robots IA.

Bloquer GPTBot me fait-il perdre du trafic ChatGPT ?
Pas directement. GPTBot sert à collecter des données d'entraînement. Les citations en direct dans ChatGPT passent par ChatGPT-User et OAI-SearchBot. Pour rester visible dans les réponses tout en refusant l'entraînement, bloquez GPTBot mais laissez passer les deux autres.
Quelle différence entre robots.txt et llms.txt ?
Le robots.txt contrôle l'accès des robots (autoriser/bloquer l'exploration). Le llms.txt est une proposition récente qui, à l'inverse, met en avant vos contenus clés pour les modèles, sous forme de plan lisible. L'un restreint, l'autre guide. Cet outil signale la présence du second.
Pourquoi un robot apparaît « autorisé » alors que je pense l'avoir bloqué ?
Souvent une question de spécificité. Si aucun groupe ne cible ce robot précis, il retombe sur le groupe User-agent: *. Et un Allow plus spécifique peut rouvrir un chemin bloqué plus haut. L'outil affiche la règle exacte qui décide, pour lever le doute.
Ce test garantit-il que le robot respectera le blocage ?
Non. L'outil vérifie ce que dit votre robots.txt selon le standard. Les grands acteurs le respectent, mais certains robots l'ignorent délibérément. Pour ceux-là, seul un blocage au niveau serveur, WAF ou pare-feu applicatif est efficace.

Une stratégie GEO à définir ?

Être cité par les moteurs génératifs ne s'improvise pas : contenu structuré, autorité, contrôle fin des robots. Voyons comment positionner votre marque dans les réponses IA.

Discutons de votre projet