TL;DR
7 lecture min.Amazonbot est le robot d'exploration web d'Amazon, et la documentation développeur d'Amazon indique qu'il collecte le contenu des sites pour améliorer la précision des produits d'Amazon et peut utiliser ce qu'il collecte pour entraîner les modèles d'IA d'Amazon. Un propriétaire de site le contrôle avec un bloc user agent standard dans robots.txt, et Amazon publie la chaîne user agent exacte ainsi que ses plages d'IP actuelles pour que vous puissiez vérifier une visite réelle. La documentation d'Amazon ne relie pas Amazonbot à Rufus, et relie les expériences de recherche Alexa à un robot distinct, Amzn-SearchBot.
Qu'est-ce qu'Amazonbot ?
Amazon exploite Amazonbot comme un robot d'exploration web qui collecte le contenu des sites pour améliorer la précision des produits et services d'Amazon et peut utiliser ce qu'il collecte pour entraîner les modèles d'IA d'Amazon, selon la documentation Amazonbot d'Amazon elle-même sur developer.amazon.com, vérifiée le 8 September 2026. Le robot explore les pages comme le fait tout robot de recherche ou d'IA, en demandant des URL et en lisant la réponse, et Amazon indique clairement que cet objectif diffère de l'indexation d'une page pour un résultat de recherche.
Quelle est la chaîne user agent d'Amazonbot ?
Amazonbot s'identifie avec la chaîne "Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; Amazonbot/0.1) Chrome/W.X.Y.Z Safari/537.36", selon la documentation publiée par Amazon. Le token compatible; Amazonbot/0.1 à l'intérieur de cette chaîne est la partie qu'une vérification côté serveur devrait comparer, car les segments Mozilla et Chrome qui l'entourent existent pour la compatibilité avec les anciens analyseurs de user agent et apparaissent dans de nombreux robots sans rapport. Amazon publie aussi la liste actuelle des adresses IP depuis lesquelles le robot explore sur developer.amazon.com/amazonbot/ip-addresses, afin qu'un site puisse confirmer qu'une requête prétendant être Amazonbot provient réellement d'Amazon avant de se fier à la seule chaîne user agent.
Que collecte Amazonbot, et pourquoi ?
Amazonbot collecte le contenu des pages qu'il explore pour améliorer la précision des produits et services d'Amazon, et la documentation d'Amazon indique que les données collectées peuvent aussi entraîner les modèles d'IA d'Amazon. Amazon trace une frontière entre Amazonbot et un second robot distinct nommé Amzn-SearchBot : la documentation d'Amazon relie Amzn-SearchBot aux expériences de recherche, tandis qu'Amazonbot est celui qu'Amazon cite en lien avec l'entraînement des modèles d'IA. La question de savoir si explorer une page est même autorisé au regard du droit d'auteur et des conditions du site est distincte et traitée dans le web scraping est-il légal, ce qui s'applique à tout robot qui extrait du contenu d'un site qu'il ne possède pas.
| Robot | Objectif déclaré | Entraîne les modèles d'IA d'Amazon | Alimente des expériences de recherche comme Alexa |
|---|---|---|---|
| Amazonbot | Améliore la précision des produits et services d'Amazon | Oui, selon la documentation d'Amazon | Non documenté |
| Amzn-SearchBot | Explore pour l'indexation de recherche | Non documenté | Oui, selon la documentation d'Amazon |

Comment bloquer Amazonbot dans robots.txt ?
Ajoutez un bloc user agent dédié nommant Amazonbot et bloquez les chemins que vous voulez exclure.
User-agent: Amazonbot
Disallow: /
La documentation d'Amazon indique qu'Amazonbot respecte le Robots Exclusion Protocol, vérifie le fichier robots.txt au niveau de l'hôte et le met en cache jusqu'à 30 jours, si bien qu'un changement de règle prend environ 24 heures pour s'appliquer et peut prendre plus longtemps pour effacer totalement le cache. Amazonbot respecte aussi une balise meta noindex, noarchive ou none ainsi que les liens rel=nofollow sur les pages qu'il explore, ce qui donne à un propriétaire de site un contrôle au niveau de la page en plus du blocage dans robots.txt. Lisez toutes les options de syntaxe dans le guide robots.txt avant d'écrire une règle pour un robot par son nom.
Comment autoriser Amazonbot, et cela aide-t-il votre site ?
Autoriser Amazonbot signifie n'ajouter aucune règle disallow pour son user agent, ou une règle allow explicite si votre robots.txt bloque les robots par défaut. La documentation d'Amazon indique que les propriétaires de sites qui autorisent Amazonbot peuvent être admissibles au programme Amazon Content Partners, qu'Amazon décrit comme offrant une commission d'affiliation accrue sur les ventes éligibles, des crédits d'hébergement et des outils de gestion du trafic IA ; vérifiez les conditions actuelles du programme sur le site d'Amazon lui-même avant de présumer de votre admissibilité, car les conditions du programme changent indépendamment de la documentation du robot.

Quelle est la relation d'Amazonbot avec Alexa et Rufus ?
La documentation Amazonbot d'Amazon ne cite pas Rufus, l'assistant d'achat d'Amazon, donc aucun lien confirmé n'existe dans les documents d'Amazon entre les deux. Le lien documenté avec un assistant d'achat ou de recherche passe plutôt par Amzn-SearchBot : la documentation d'Amazon indique que le contenu exploré par Amzn-SearchBot devient admissible à apparaître dans des expériences de recherche comme Alexa. Traitez Amazonbot et Amzn-SearchBot comme deux robots distincts avec deux règles robots.txt distinctes, car bloquer l'un ne bloque pas l'autre. Applebot-Extended documente la séparation équivalente côté Apple, où le robot qui alimente la recherche et le token qui régit l'usage pour l'entraînement de l'IA sont eux aussi deux contrôles distincts.
Comment vérifier un robot qui prétend être Amazonbot ?
Comparez l'adresse IP source de la requête à la liste publiée des adresses IP d'Amazonbot d'Amazon sur developer.amazon.com/amazonbot/ip-addresses avant de vous fier à la seule chaîne user agent, car un en-tête user agent est une affirmation qu'une requête fait sur elle-même, pas une preuve d'origine. Un visiteur qui envoie la chaîne user agent d'Amazonbot depuis une adresse IP hors de la plage publiée par Amazon n'est pas Amazonbot, quoi que dise l'en-tête. Associez cette vérification à la même surveillance de marque que vous utiliseriez pour tout système d'IA : la surveillance de marque dans la recherche IA suit la façon dont une marque est représentée une fois que les données d'un robot atteignent une réponse d'IA, ce qui est le résultat qui compte une fois l'exploration elle-même terminée.
Questions fréquentes
Bloquer Amazonbot bloque-t-il aussi les résultats de recherche shopping d'Amazon ?
La documentation d'Amazon relie les expériences de shopping et de recherche comme Alexa à Amzn-SearchBot, un robot distinct d'Amazonbot, donc bloquer Amazonbot par son nom ne touche à aucune règle que vous avez définie pour Amzn-SearchBot. Écrivez un bloc user agent distinct pour chaque robot que vous voulez contrôler.
Combien de temps prend un changement de robots.txt pour Amazonbot avant de s'appliquer ?
La documentation d'Amazon indique qu'Amazonbot vérifie le fichier robots.txt au niveau de l'hôte et le met en cache jusqu'à 30 jours, et que les changements prennent environ 24 heures pour s'appliquer. Attendez-vous à ce qu'un changement s'applique en une journée, bien que le cache puisse conserver une ancienne version plus longtemps dans certains cas.
Amazonbot respecte-t-il noindex et nofollow ?
Oui. La documentation d'Amazon indique qu'Amazonbot respecte les balises meta noindex, noarchive et none, ainsi que les liens rel=nofollow, sur les pages qu'il explore, en plus des règles disallow standard de robots.txt.
Amazonbot est-il le même robot qui alimente Rufus ?
La documentation Amazonbot d'Amazon elle-même ne cite pas Rufus, donc aucun lien confirmé et publié n'existe entre les deux. Traitez toute affirmation reliant directement Amazonbot à Rufus comme non vérifiée tant qu'Amazon ne la documente pas.
Puis-je autoriser Amazonbot seulement sur une partie de mon site ?
Oui. Une règle disallow de robots.txt à l'intérieur du bloc user agent d'Amazonbot accepte des chemins spécifiques, si bien que vous pouvez bloquer un répertoire comme /private/ tout en laissant le reste du site ouvert au même robot.
RedReplier
Commencer
Reddit, X, Bluesky et HN
Alertes d'intention en temps réel
Réponses IA illimitées
Classé par intention d'achat
Où Amazon publie-t-il les adresses IP actuelles d'Amazonbot ?
Sur developer.amazon.com/amazonbot/ip-addresses, que la documentation d'Amazon désigne comme la source pour vérifier qu'une requête prétendant être Amazonbot provient réellement des plages publiées par Amazon.
Qu'est-ce que le programme Amazon Content Partners ?
La documentation d'Amazon indique que les propriétaires de sites qui autorisent Amazonbot peuvent être éligibles au programme Amazon Content Partners. Amazon décrit ce programme comme offrant une commission d'affiliation accrue sur les ventes éligibles, des crédits d'hébergement et des outils de gestion du trafic lié à l'IA. Les conditions du programme évoluent indépendamment de la documentation du robot, vérifiez donc l'éligibilité actuelle sur le site d'Amazon avant de la considérer acquise.
Que se passe-t-il si je n'ajoute aucune règle robots.txt pour Amazonbot ?
L'absence de règle équivaut à autoriser Amazonbot à explorer votre site, puisqu'il n'y a pas de disallow. La documentation d'Amazon relie cet état à l'éligibilité au programme Amazon Content Partners. Le robot collecte alors le contenu des pages selon son objectif déclaré, améliorer la précision des produits Amazon et potentiellement entraîner les modèles d'IA d'Amazon.
En quoi Amazonbot diffère-t-il d'un robot de recherche classique ?
Amazon précise que l'objectif d'Amazonbot, améliorer la précision des produits Amazon et entraîner les modèles d'IA d'Amazon, diffère de l'indexation d'une page pour un résultat de recherche. Amazon exploite un robot distinct, Amzn-SearchBot, pour les expériences de recherche comme Alexa. Bloquer ou autoriser un robot par son nom n'affecte pas l'autre.
Quel robot Amazon dois-je bloquer pour empêcher mon contenu d'entraîner son IA ?
Bloquez Amazonbot par son nom, car la documentation d'Amazon relie l'entraînement des modèles d'IA spécifiquement à Amazonbot et non à Amzn-SearchBot. Un bloc dédié User-agent: Amazonbot avec Disallow: / dans robots.txt arrête l'exploration. Laissez la règle d'Amzn-SearchBot séparée si vous voulez toujours que votre contenu apparaisse dans des expériences de recherche comme Alexa.
Nous voir plus souvent sur Google
Un clic définit RedReplier comme source préférée. Nos articles remontent alors dans vos À la une, en mode IA et dans les aperçus IA.
Avant de partir...
RedReplier
Repérez chaque acheteur qui cherche ce que vous vendez
RedReplier surveille Reddit, X, Bluesky et Hacker News en temps réel, classe chaque sujet selon l'intention d'achat et rédige votre réponse, pour que vous arriviez en premier.
Reddit, X, Bluesky et HN
Alertes d'intention en temps réel
Réponses IA illimitées
Classé par intention d'achat
Articles connexes


Vu dans le HTML : les liens Reddit sont-ils en nofollow ?
Vérifié dans le HTML en direct : les liens Reddit sont-ils en nofollow, ce que veut dire rel="noopener nofollow ugc" et pourquoi Google parle d'indices.


Jakob Nielsen a publié la règle 90-9-1 en 2006, et les preuves depuis sont minces
Jakob Nielsen a publié la règle 90-9-1 en 2006 : 90% d'une communauté en ligne ne fait que lire, 9% contribue parfois, 1% écrit presque tout. Ce qu'elle vaut.


Pourquoi l'algospeak cache de vraies conversations au monitoring de mots-clés
Comment l'algospeak, remplacer par des mots codés les termes que la modération supprime, cache des conversations au monitoring exact, et quoi faire ensuite.

