TL;DR
7 lectura mínimaAmazonbot es el rastreador web de Amazon, y la propia documentación para desarrolladores de Amazon indica que recopila el contenido del sitio para mejorar la precisión de los productos de Amazon y puede usar lo recopilado para entrenar los modelos de IA de Amazon. Un propietario de sitio lo controla con un bloque de user agent estándar en robots.txt, y Amazon publica la cadena exacta de user agent y sus rangos de IP actuales para que usted pueda verificar una visita real. La documentación de Amazon no vincula a Amazonbot con Rufus, y vincula las experiencias de búsqueda de Alexa a un rastreador separado, Amzn-SearchBot.
¿Qué es Amazonbot?
Amazon opera Amazonbot como un rastreador web que recopila el contenido del sitio para mejorar la precisión de los productos y servicios de Amazon y puede usar lo recopilado para entrenar los modelos de IA de Amazon, según la propia documentación de Amazonbot de Amazon en developer.amazon.com, verificada el 8 September 2026. El bot rastrea páginas de la misma forma que cualquier rastreador de búsqueda o de IA: solicita URLs y lee la respuesta, y Amazon afirma claramente que este propósito es distinto de indexar una página para un resultado de búsqueda.
¿Cuál es la cadena de user agent de Amazonbot?
Amazonbot se identifica con la cadena "Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; Amazonbot/0.1) Chrome/W.X.Y.Z Safari/537.36", según la documentación publicada por Amazon. El token compatible; Amazonbot/0.1 dentro de esa cadena es la parte que una verificación del lado del servidor debería comparar, ya que los segmentos Mozilla y Chrome que la rodean existen por compatibilidad con análisis de user agent más antiguos y aparecen en muchos rastreadores sin relación. Amazon también publica la lista actual de direcciones IP desde las que rastrea el bot en developer.amazon.com/amazonbot/ip-addresses, de modo que un sitio pueda confirmar que una solicitud que dice ser Amazonbot en verdad proviene de Amazon antes de confiar solo en la cadena de user agent.
¿Qué recopila Amazonbot, y por qué?
Amazonbot recopila el contenido de las páginas que rastrea para mejorar la precisión de los productos y servicios de Amazon, y la documentación de Amazon indica que los datos recopilados también pueden entrenar los modelos de IA de Amazon. Amazon traza una línea entre Amazonbot y un segundo rastreador separado llamado Amzn-SearchBot: la documentación de Amazon vincula a Amzn-SearchBot con experiencias de búsqueda, mientras que Amazonbot es el que Amazon nombra en relación con el entrenamiento de modelos de IA. Si rastrear una página siquiera está permitido bajo derechos de autor y los términos del sitio es una cuestión aparte que se trata en es legal el web scraping, lo cual se aplica a cualquier bot que extraiga contenido de un sitio que no posee.
| Rastreador | Propósito declarado | Entrena los modelos de IA de Amazon | Alimenta experiencias de búsqueda como Alexa |
|---|---|---|---|
| Amazonbot | Mejora la precisión de los productos y servicios de Amazon | Sí, según la documentación de Amazon | No documentado |
| Amzn-SearchBot | Rastrea para indexación de búsqueda | No documentado | Sí, según la documentación de Amazon |

¿Cómo se bloquea a Amazonbot en robots.txt?
Agregue un bloque de user agent dedicado que nombre a Amazonbot y bloquee las rutas que quiera excluir.
User-agent: Amazonbot
Disallow: /
La documentación de Amazon indica que Amazonbot respeta el Robots Exclusion Protocol, revisa el archivo robots.txt a nivel de host y lo almacena en caché hasta por 30 días, de modo que un cambio de regla tarda aproximadamente 24 horas en surtir efecto y puede tardar más en despejarse por completo de la caché. Amazonbot también respeta una etiqueta meta noindex, noarchive o none y los enlaces rel=nofollow en las páginas que rastrea, lo que da a un propietario de sitio control a nivel de página además del bloqueo en robots.txt. Lea las opciones completas de sintaxis en la guía de robots.txt antes de escribir una regla para cualquier bot por nombre.
¿Cómo se permite a Amazonbot, y ayuda eso a su sitio?
Permitir a Amazonbot significa no agregar ninguna regla disallow para su user agent, o una regla allow explícita si su robots.txt bloquea rastreadores por defecto. La documentación de Amazon indica que los propietarios de sitios que permiten a Amazonbot pueden calificar para el programa Amazon Content Partners, que Amazon describe como una oferta de comisión de afiliado aumentada en ventas elegibles, créditos de hosting y herramientas de gestión de tráfico de IA; revise los términos actuales del programa en el propio sitio de Amazon antes de asumir elegibilidad, ya que los términos del programa cambian de forma independiente a la documentación del rastreador.

¿Cuál es la relación de Amazonbot con Alexa y Rufus?
La documentación de Amazonbot de Amazon no menciona a Rufus, el asistente de compras de Amazon, así que no existe un vínculo confirmado en el propio material de Amazon entre los dos. La conexión documentada con un asistente de compras o de búsqueda pasa en cambio por Amzn-SearchBot: la documentación de Amazon indica que el contenido rastreado por Amzn-SearchBot se vuelve elegible para aparecer en experiencias de búsqueda como Alexa. Trate a Amazonbot y Amzn-SearchBot como dos rastreadores separados con dos reglas de robots.txt separadas, ya que bloquear uno no bloquea al otro. Applebot-Extended documenta la división equivalente del lado de Apple, donde el rastreador que impulsa la búsqueda y el token que rige el uso para entrenamiento de IA también son dos controles separados.
¿Cómo se verifica un rastreador que dice ser Amazonbot?
Compare la dirección IP de origen de la solicitud con la lista publicada de direcciones IP de Amazonbot de Amazon en developer.amazon.com/amazonbot/ip-addresses antes de confiar solo en una cadena de user agent, ya que un encabezado de user agent es una afirmación que una solicitud hace sobre sí misma, no una prueba de origen. Un visitante que envía la cadena de user agent de Amazonbot desde una dirección IP fuera del rango publicado de Amazon no es Amazonbot, sin importar lo que diga el encabezado. Combine esta verificación con el mismo monitoreo de marca que usted usaría para cualquier sistema de IA: monitoreo de marca en búsqueda con IA rastrea cómo se representa una marca una vez que los datos de un rastreador llegan a una respuesta de IA, que es el resultado que importa una vez que el rastreo en sí ha terminado.
Preguntas frecuentes
¿Bloquear a Amazonbot también bloquea los resultados de búsqueda de compras de Amazon?
La documentación de Amazon vincula las experiencias de compras y búsqueda como Alexa a Amzn-SearchBot, un rastreador separado de Amazonbot, así que bloquear a Amazonbot por nombre no afecta ninguna regla que usted haya definido para Amzn-SearchBot. Escriba un bloque de user agent separado para cada rastreador que quiera controlar.
¿Cuánto tarda en aplicarse un cambio de robots.txt para Amazonbot?
La documentación de Amazon indica que Amazonbot revisa el archivo robots.txt a nivel de host y lo almacena en caché hasta por 30 días, y que los cambios tardan cerca de 24 horas en aplicarse. Espere que un cambio se aplique dentro de un día, aunque la caché puede conservar una versión anterior por más tiempo en algunos casos.
¿Respeta Amazonbot noindex y nofollow?
Sí. La documentación de Amazon indica que Amazonbot respeta las etiquetas meta noindex, noarchive y none, junto con los enlaces rel=nofollow, en las páginas que rastrea, además de las reglas estándar de disallow en robots.txt.
¿Es Amazonbot el mismo rastreador que impulsa a Rufus?
La propia documentación de Amazonbot de Amazon no menciona a Rufus, así que no existe un vínculo confirmado y publicado entre los dos. Trate cualquier afirmación que conecte a Amazonbot directamente con Rufus como no verificada hasta que Amazon lo documente.
¿Puedo permitir a Amazonbot solo en parte de mi sitio?
Sí. Una regla disallow de robots.txt dentro del bloque de user agent de Amazonbot acepta rutas específicas, así que puede bloquear un directorio como /private/ mientras deja el resto del sitio abierto para el mismo rastreador.
RedReplier
Comenzar
Reddit, X, Bluesky y HN
Alertas de intención en tiempo real
Respuestas IA ilimitadas
Ordenado por intención de compra
¿Dónde publica Amazon las direcciones IP actuales de Amazonbot?
En developer.amazon.com/amazonbot/ip-addresses, que la documentación de Amazon nombra como la fuente para verificar que una solicitud que dice ser Amazonbot en verdad se originó desde los rangos publicados por Amazon.
¿Qué es el programa Amazon Content Partners?
La documentación de Amazon indica que los propietarios de sitios que permiten a Amazonbot pueden calificar para el programa Amazon Content Partners. Amazon describe el programa como una mejora en la comisión de afiliado en ventas elegibles, créditos de hosting y herramientas de gestión de tráfico de IA. Los términos del programa cambian de forma independiente a la documentación del rastreador, así que revise la elegibilidad actual en el propio sitio de Amazon antes de asumir que califica.
¿Qué pasa si no agrego ninguna regla de robots.txt para Amazonbot?
Sin ninguna regla no hay disallow, lo cual equivale a permitir que Amazonbot rastree su sitio. La documentación de Amazon vincula ese estado a la elegibilidad para el programa Amazon Content Partners. El bot entonces recopila el contenido de las páginas según su propósito declarado de mejorar la precisión de los productos de Amazon y posiblemente entrenar los modelos de IA de Amazon.
¿En qué se diferencia Amazonbot de un rastreador de búsqueda normal?
Amazon declara explícitamente que el propósito de Amazonbot, mejorar la precisión de los productos de Amazon y entrenar los modelos de IA de Amazon, difiere de indexar una página para un resultado de búsqueda. Amazon opera un rastreador separado, Amzn-SearchBot, para experiencias de búsqueda como Alexa. Bloquear o permitir un rastreador por nombre no afecta al otro.
¿Qué rastreador de Amazon debo bloquear para evitar que mi contenido entrene su IA?
Bloquee a Amazonbot por nombre, ya que la documentación de Amazon vincula el entrenamiento de modelos de IA específicamente a Amazonbot y no a Amzn-SearchBot. Un bloque dedicado User-agent: Amazonbot con Disallow: / en robots.txt detiene el rastreo. Deje la regla de Amzn-SearchBot por separado si aún desea que su contenido aparezca en experiencias de búsqueda como Alexa.
Vernos más en Google
Un clic marca RedReplier como fuente preferida y nuestros artículos aparecen más arriba en tus Noticias destacadas, el modo IA y los resúmenes con IA.
Antes de irte...
RedReplier
Detecta a cada comprador que busca lo que vendes
RedReplier vigila Reddit, X, Bluesky y Hacker News en tiempo real, clasifica cada hilo por intención de compra y redacta tu respuesta, para que llegues primero.
Reddit, X, Bluesky y HN
Alertas de intención en tiempo real
Respuestas IA ilimitadas
Ordenado por intención de compra
Artículos relacionados


Visto en el HTML: ¿Los enlaces de Reddit son nofollow?
Comprobado en el HTML real: si los enlaces de Reddit son nofollow, qué significa rel="noopener nofollow ugc" y por qué Google los llama sugerencias.


Jakob Nielsen publicó la regla 90-9-1 en 2006, y la evidencia posterior es escasa
Jakob Nielsen publicó la regla 90-9-1 en 2006: 90% de una comunidad online solo lee, 9% aporta a veces, 1% escribe casi todo. Qué tan bien se sostiene.


Por qué el algospeak esconde conversaciones reales del monitoreo de keywords
Cómo el algospeak, sustituir por palabras en clave los términos que la moderación suprime, esconde conversaciones del monitoreo exacto y qué hacer después.

