glossary

En quoi ChatGPT-User diffère de GPTBot et OAI-SearchBot

Taras Shynkarenko
Taras Shynkarenko
Updated: 8 lecture min.
En quoi ChatGPT-User diffère de GPTBot et OAI-SearchBotEn quoi ChatGPT-User diffère de GPTBot et OAI-SearchBot

TL;DR

8 lecture min.

OpenAI présente ChatGPT-User comme un agent de récupération déclenché par l'utilisateur qui ne charge une page que lorsqu'une personne, ou un Custom GPT à l'intérieur de ChatGPT, lui demande d'ouvrir ce lien, ce qui le sépare du crawl automatique de GPTBot pour l'entraînement et du crawl automatique d'OAI-SearchBot pour la fonction de recherche de ChatGPT. La documentation des bots d'OpenAI donne à chacun sa propre chaîne user agent et son propre comportement robots.txt, et énonce clairement que ChatGPT-User "n'est pas utilisé pour explorer le web de façon automatique" (en anglais dans le texte original : "is not used for crawling the web in an automatic fashion").

Qu'est-ce que ChatGPT-User ?

OpenAI présente ChatGPT-User comme l'agent qui ne récupère une page que lorsqu'une personne, ou un Custom GPT s'exécutant à l'intérieur de ChatGPT, demande à ChatGPT d'ouvrir un lien précis, selon la documentation des bots d'OpenAI sur developers.openai.com, vérifiée le 9 September 2026. Cette documentation énonce directement que ChatGPT-User "n'est pas utilisé pour explorer le web de façon automatique", ce qui le distingue des deux autres agents d'OpenAI qui, eux, explorent selon leur propre calendrier. Une requête de ChatGPT-User existe parce que quelqu'un, à cet instant précis, a demandé exactement cette page.

Quelle est la chaîne user agent exacte de ChatGPT-User ?

ChatGPT-User s'identifie avec la chaîne Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko); compatible; ChatGPT-User/1.0; +https://openai.com/bot, selon la documentation des bots d'OpenAI. OpenAI publie les plages d'adresses IP actuelles depuis lesquelles cet agent envoie des requêtes sous forme de JSON sur openai.com/chatgpt-user.json, ce qui offre un moyen côté serveur de confirmer une requête plutôt que de se fier au seul texte de l'en-tête. Vérifiez à la fois le jeton dans la chaîne user agent et l'adresse IP source avant de considérer une requête comme authentique.

AgentChaîne user agentDéclencheur
ChatGPT-UserMozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko); compatible; ChatGPT-User/1.0; +https://openai.com/botUne personne ou un Custom GPT demande à ChatGPT d'ouvrir un lien
GPTBotMozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko); compatible; GPTBot/1.4; +https://openai.com/gptbotCrawl automatique pour l'entraînement du modèle de fondation
OAI-SearchBotMozilla/5.0 (Macintosh; Intel Mac OS X 10_15_7) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/131.0.0.0 Safari/537.36; compatible; OAI-SearchBot/1.4; +https://openai.com/searchbotCrawl automatique pour faire apparaître des sites dans la fonction de recherche de ChatGPT

En quoi ChatGPT-User diffère-t-il de GPTBot ?

GPTBot explore un site selon son propre calendrier, et la documentation d'OpenAI relie directement GPTBot aux données d'entraînement, en indiquant que ce crawl sert "à rendre nos modèles de fondation d'IA générative plus utiles et plus sûrs" (en anglais dans le texte original : "to make our generative AI foundation models more useful and safe"). ChatGPT-User, lui, se déclenche une seule fois, en réponse à une requête précise issue d'une conversation précise, et ne touche que la page que cette conversation a nommée. La différence pratique tient au moment et à la cause : une requête de GPTBot peut arriver à tout moment dans le cadre d'un crawl programmé, alors qu'une requête de ChatGPT-User ne suit jamais qu'une question en direct qui mentionnait une URL.

En quoi ChatGPT-User diffère-t-il d'OAI-SearchBot ?

OAI-SearchBot explore lui aussi automatiquement, selon son propre calendrier, mais la documentation d'OpenAI relie son objectif à un résultat différent : faire apparaître des sites dans la fonction de recherche de ChatGPT plutôt qu'entraîner un modèle. ChatGPT-User partage avec OAI-SearchBot son lien avec la surface produit en direct de ChatGPT, mais les deux fonctionnent sur des déclencheurs opposés, l'un menant un crawl permanent et l'autre se déclenchant à la demande pour une seule conversation. Un site qui veut apparaître quand ChatGPT explore le web, sans fournir de données d'entraînement, choisit d'autoriser spécifiquement OAI-SearchBot, ce qui est une décision distincte d'autoriser GPTBot ou ChatGPT-User.

Une baie de serveurs verrouillée illustre le blocage d'une requête automatisée à la source.

Peut-on bloquer ChatGPT-User dans robots.txt ?

Une règle Disallow standard sous un bloc User-agent: ChatGPT-User est la syntaxe documentée, mais la documentation des bots d'OpenAI note que les règles robots.txt pourraient ne pas s'appliquer à cet agent de la même façon qu'à un crawler, puisque la requête est déclenchée par une action en direct d'un utilisateur plutôt que par un crawl programmé. La règle continue tout de même à dire à une requête conforme de ne pas poursuivre, ce qui justifie de la mettre en place quand même. Ce qu'elle ne fera pas, c'est empêcher une personne de demander à ChatGPT des informations sur votre page d'une façon qui n'exige pas que ChatGPT-User la récupère directement.

User-agent: ChatGPT-User
Disallow: /

Comment bloquer GPTBot et OAI-SearchBot ?

Ajoutez un bloc nommé séparément pour chaque agent que vous voulez contrôler, puisqu'une règle qui en nomme un n'a aucun effet sur les autres.

User-agent: GPTBot
Disallow: /

User-agent: OAI-SearchBot
Disallow: /

La documentation d'OpenAI indique qu'une modification de robots.txt met environ 24 heures à atteindre ses systèmes, attendez-vous donc à un délai d'à peu près une journée plutôt qu'à un effet immédiat. Vérifiez toute requête par rapport aux plages d'adresses IP publiées sur openai.com/gptbot.json et openai.com/searchbot.json avant de supposer qu'un crawler bloqué a ignoré la règle, car une chaîne user agent falsifiée est un problème distinct d'une règle qui ne s'est pas encore propagée.

Trois agents, trois déclencheurs
Crawlers programmés
  • GPTBot explore pour entraîner les modèles de fondation d'OpenAI
  • OAI-SearchBot explore pour alimenter la fonction de recherche de ChatGPT
  • Les deux acceptent une règle Disallow robots.txt standard
Récupération déclenchée par l'utilisateur
  • ChatGPT-User charge une page qu'une personne ou un Custom GPT vient de demander
  • OpenAI indique qu'il n'est pas utilisé pour l'exploration automatique
  • OpenAI note que les règles robots.txt pourraient ne pas s'appliquer de la même façon
D'après la documentation des bots d'OpenAI sur developers.openai.com, vérifiée le 9 September 2026.

Qu'est-ce qui s'arrête vraiment quand on bloque chacun d'eux ?

Bloquer GPTBot arrête le crawl programmé qu'OpenAI relie à l'entraînement du modèle de fondation, si bien que les pages concernées par cette règle cessent d'alimenter les futures mises à jour du modèle par cette voie précise. Bloquer OAI-SearchBot arrête le crawl programmé qu'OpenAI relie à la fonction de recherche de ChatGPT, si bien que les pages concernées par cette règle ont moins de chances d'apparaître quand quelqu'un demande à ChatGPT de chercher sur le web. Bloquer ChatGPT-User vise une requête qui ne se produit que parce qu'une personne a déjà nommé votre URL dans une conversation en direct, si bien que la règle retient surtout le contenu en direct de la page pour cette seule récupération, plutôt qu'elle ne retire le site d'un quelconque crawl permanent. Décider lequel des trois bloquer revient en réalité à décider quelle relation avec ChatGPT on veut garder : contribution à l'entraînement, visibilité dans la recherche, ou capacité à répondre à une question directe sur une page que quelqu'un a déjà trouvée.

Quelle que soit la combinaison choisie par un site, la question la plus utile est ce que dit ChatGPT une fois qu'il a déjà répondu avec le contenu qu'il a pu atteindre. Surveillance de marque dans la recherche IA suit où ChatGPT, Claude et Gemini citent une marque dans leurs réponses, ce qui est le résultat qui compte une fois que l'une de ces trois requêtes a déjà eu lieu. La même répartition en trois crawlers se retrouve dans d'autres piles d'IA : CCBot documente l'équivalent de Common Crawl, une archive ouverte que d'autres laboratoires filtrent en ensembles d'entraînement plutôt qu'un crawl direct, et Applebot-Extended documente la version d'Apple de la même séparation entre recherche et entraînement. Écrivez chaque règle dans le même fichier, en suivant la syntaxe couverte dans le guide complet robots.txt.

Ce qui s'arrête quand on bloque chaque agent
Bloquer GPTBotArrête l'alimentation des futurs entraînements de modèles via cette exploration
Bloquer OAI-SearchBotArrête l'apparition dans la fonction de recherche de ChatGPT
Bloquer ChatGPT-UserArrête une seule récupération en direct, pas une exploration permanente
Chaque règle contrôle une relation différente avec ChatGPT : données d'entraînement, visibilité dans la recherche, ou une seule requête déjà demandée.

Questions fréquentes

Bloquer GPTBot bloque-t-il aussi ChatGPT-User ?

Non. La documentation d'OpenAI donne à chaque agent son propre nom et son propre bloc robots.txt, si bien qu'une règle nommant GPTBot n'a aucun effet sur ChatGPT-User ou OAI-SearchBot. Écrivez un bloc séparé pour chaque agent que vous voulez contrôler.

Une personne tapant une question sur un ordinateur portable illustre la requête en direct qui déclenche la récupération d'une seule page.

Pourquoi une règle robots.txt pour ChatGPT-User pourrait-elle ne pas fonctionner pleinement ?

La documentation d'OpenAI elle-même indique que les règles robots.txt pourraient ne pas s'appliquer à ChatGPT-User de la même façon qu'à un crawler programmé, parce que la requête suit une action en direct d'un utilisateur plutôt qu'un crawl automatique. La règle reste tout de même le moyen documenté de signaler une intention, même si OpenAI note cette limite.

Quelle est la chaîne user agent exacte d'OAI-SearchBot ?

OAI-SearchBot s'identifie comme Mozilla/5.0 (Macintosh; Intel Mac OS X 10_15_7) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/131.0.0.0 Safari/537.36; compatible; OAI-SearchBot/1.4; +https://openai.com/searchbot, selon la documentation des bots d'OpenAI.

Combien de temps met une modification de robots.txt à s'appliquer chez OpenAI ?

La documentation d'OpenAI indique qu'une mise à jour de robots.txt met environ 24 heures à atteindre les systèmes d'OpenAI. Attendez-vous à environ une journée de délai avant qu'une nouvelle règle pour GPTBot ou OAI-SearchBot ne prenne effet.

RedReplier
RedReplier

Commencer

Reddit, X, Bluesky et HN

Alertes d'intention en temps réel

Réponses IA illimitées

Classé par intention d'achat

Où OpenAI publie-t-il les plages d'adresses IP de ces agents ?

Sur openai.com/gptbot.json, openai.com/searchbot.json et openai.com/chatgpt-user.json, un fichier par agent, selon la documentation des bots d'OpenAI. Vérifiez l'adresse IP source d'une requête par rapport au fichier correspondant avant de vous fier à sa seule chaîne user agent.

GPTBot entraîne-t-il les modèles d'OpenAI avec chaque page qu'il explore ?

La documentation d'OpenAI relie le crawl de GPTBot au fait de rendre ses modèles de fondation d'IA générative "plus utiles et plus sûrs", sans lister d'exceptions page par page. Un site qui ne veut aucune page incluse dans ce processus bloque GPTBot nommément dans robots.txt.

Comment la configuration d'entraînement de CCBot se compare-t-elle à celle de GPTBot ?

CCBot documente l'équivalent de Common Crawl, une archive ouverte que d'autres laboratoires filtrent pour leurs propres ensembles d'entraînement plutôt que d'explorer directement. GPTBot, lui, explore un site directement selon le calendrier propre d'OpenAI pour ses modèles de fondation. Un site qui compare les deux prend deux décisions distinctes : autoriser OpenAI à explorer directement, et choisir si ses pages atterrissent dans l'archive ouverte que d'autres laboratoires filtrent.

Comment la répartition d'Applebot-Extended se compare-t-elle aux trois agents d'OpenAI ?

Applebot-Extended documente la version d'Apple de la même séparation entre recherche et entraînement qui distingue GPTBot d'OAI-SearchBot. Un site qui gère les trois agents d'OpenAI fait presque le même choix face au crawler d'Apple : données d'entraînement ou visibilité dans la recherche. La comparaison complète se trouve dans le guide Applebot-Extended.

Les règles pour GPTBot, OAI-SearchBot et ChatGPT-User vont-elles dans le même fichier robots.txt ?

Oui, chaque règle occupe son propre bloc User-agent nommé à l'intérieur d'un seul fichier robots.txt, pas dans trois fichiers séparés. Une règle qui nomme un agent n'a aucun effet sur les autres, donc chaque bloc a besoin de sa propre ligne Disallow. Le guide complet sur robots.txt couvre la syntaxe exacte pour empiler plusieurs blocs d'agents.

Le suivi de marque en recherche IA surveille-t-il la requête ChatGPT-User elle-même ?

Il enregistre ce que ChatGPT, Claude et Gemini disent une fois qu'ils ont déjà répondu, pas la requête individuelle. Cette citation est le résultat qui compte une fois que l'un des trois agents d'OpenAI a déjà tourné, que ce soit une exploration programmée ou une seule récupération ChatGPT-User. Le suivi de marque en recherche IA suit le texte de la réponse elle-même, pas l'exploration ou la récupération qui l'a nourrie.

Nous voir plus souvent sur Google

Un clic définit RedReplier comme source préférée. Nos articles remontent alors dans vos À la une, en mode IA et dans les aperçus IA.

Avant de partir...

RedReplier

RedReplier

Repérez chaque acheteur qui cherche ce que vous vendez

RedReplier surveille Reddit, X, Bluesky et Hacker News en temps réel, classe chaque sujet selon l'intention d'achat et rédige votre réponse, pour que vous arriviez en premier.

Reddit, X, Bluesky et HN

Alertes d'intention en temps réel

Réponses IA illimitées

Classé par intention d'achat

Articles connexes