TL;DR
7 minutos de leituraO Amazonbot é o rastreador web da Amazon, e a própria documentação para desenvolvedores da Amazon diz que ele coleta o conteúdo do site para melhorar a precisão dos produtos da Amazon e pode usar o que coleta para treinar os modelos de IA da Amazon. Um dono de site controla o rastreador com um bloco de user agent padrão no robots.txt, e a Amazon publica a string exata do user agent e os intervalos de IP atuais para que você possa verificar uma visita real. A documentação da Amazon não liga o Amazonbot ao Rufus, e liga as experiências de busca da Alexa a um rastreador separado, o Amzn-SearchBot.
O que é o Amazonbot?
A Amazon opera o Amazonbot como um rastreador web que coleta o conteúdo do site para melhorar a precisão dos produtos e serviços da Amazon e pode usar o que coleta para treinar os modelos de IA da Amazon, segundo a própria documentação do Amazonbot da Amazon em developer.amazon.com, verificada em 8 September 2026. O bot rastreia páginas do mesmo jeito que qualquer rastreador de busca ou de IA, solicitando URLs e lendo a resposta, e a Amazon afirma claramente que esse é um propósito diferente de indexar uma página para um resultado de busca.
Qual é a string de user agent do Amazonbot?
O Amazonbot se identifica com a string "Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; Amazonbot/0.1) Chrome/W.X.Y.Z Safari/537.36", segundo a documentação publicada pela Amazon. O token compatible; Amazonbot/0.1 dentro dessa string é a parte que uma verificação do lado do servidor deve comparar, já que os trechos Mozilla e Chrome ao redor existem por compatibilidade com análises mais antigas de user agent e aparecem em muitos rastreadores sem relação. A Amazon também publica a lista atual de endereços IP de onde o bot rastreia em developer.amazon.com/amazonbot/ip-addresses, para que um site possa confirmar que uma requisição alegando ser o Amazonbot realmente veio da Amazon antes de confiar só na string de user agent.
O que o Amazonbot coleta, e por quê?
O Amazonbot coleta o conteúdo das páginas que rastreia para melhorar a precisão dos produtos e serviços da Amazon, e a documentação da Amazon afirma que os dados coletados também podem treinar os modelos de IA da Amazon. A Amazon traça uma linha entre o Amazonbot e um segundo rastreador separado chamado Amzn-SearchBot: a documentação da Amazon liga o Amzn-SearchBot a experiências de busca, enquanto o Amazonbot é o que a Amazon cita em conexão com o treinamento de modelos de IA. Se rastrear uma página é sequer permitido sob direitos autorais e os termos do site é uma questão separada, coberta em o web scraping é legal, que se aplica a qualquer bot que extrai conteúdo de um site que não possui.
| Rastreador | Propósito declarado | Treina os modelos de IA da Amazon | Alimenta experiências de busca como a Alexa |
|---|---|---|---|
| Amazonbot | Melhora a precisão dos produtos e serviços da Amazon | Sim, segundo a documentação da Amazon | Não documentado |
| Amzn-SearchBot | Rastreia para indexação de busca | Não documentado | Sim, segundo a documentação da Amazon |

Como bloquear o Amazonbot no robots.txt?
Adicione um bloco de user agent dedicado nomeando o Amazonbot e bloqueie os caminhos que você quer excluir.
User-agent: Amazonbot
Disallow: /
A documentação da Amazon afirma que o Amazonbot respeita o Robots Exclusion Protocol, verifica o arquivo robots.txt no nível do host e o mantém em cache por até 30 dias, então uma mudança de regra leva cerca de 24 horas para entrar em vigor e pode levar mais tempo para limpar totalmente o cache. O Amazonbot também respeita uma meta tag noindex, noarchive ou none e links rel=nofollow nas páginas que ele rastreia, dando a um dono de site controle no nível da página além do bloqueio no robots.txt. Leia as opções completas de sintaxe no guia de robots.txt antes de escrever uma regra para qualquer bot por nome.
Como permitir o Amazonbot, e isso ajuda seu site?
Permitir o Amazonbot significa não adicionar nenhuma regra disallow para o user agent dele, ou uma regra allow explícita se o seu robots.txt bloqueia rastreadores por padrão. A documentação da Amazon afirma que donos de sites que permitem o Amazonbot podem se qualificar para o programa Amazon Content Partners, que a Amazon descreve como uma oferta de comissão de afiliado aumentada em vendas elegíveis, créditos de hospedagem e ferramentas de gestão de tráfego de IA; confira os termos atuais do programa no próprio site da Amazon antes de presumir elegibilidade, já que os termos do programa mudam de forma independente da documentação do rastreador.

Qual é a relação do Amazonbot com a Alexa e o Rufus?
A documentação do Amazonbot da Amazon não cita o Rufus, o assistente de compras da Amazon, então não existe um vínculo confirmado no próprio material da Amazon entre os dois. A conexão documentada com um assistente de compras ou busca passa, em vez disso, pelo Amzn-SearchBot: a documentação da Amazon afirma que o conteúdo rastreado pelo Amzn-SearchBot se torna elegível para aparecer em experiências de busca como a Alexa. Trate o Amazonbot e o Amzn-SearchBot como dois rastreadores separados com duas regras separadas no robots.txt, já que bloquear um não bloqueia o outro. O Applebot-Extended documenta a divisão equivalente do lado da Apple, onde o rastreador que impulsiona a busca e o token que rege o uso para treinamento de IA também são dois controles separados.
Como verificar um rastreador que alega ser o Amazonbot?
Compare o endereço IP de origem da requisição com a lista publicada de endereços IP do Amazonbot da Amazon em developer.amazon.com/amazonbot/ip-addresses antes de confiar só numa string de user agent, já que um cabeçalho de user agent é uma alegação que uma requisição faz sobre si mesma, não uma prova de origem. Um visitante que envia a string de user agent do Amazonbot a partir de um endereço IP fora do intervalo publicado da Amazon não é o Amazonbot, não importa o que o cabeçalho diga. Combine essa verificação com o mesmo monitoramento de marca que você usaria para qualquer sistema de IA: monitoramento de marca na busca com IA acompanha como uma marca é representada assim que os dados de um rastreador chegam a uma resposta de IA, que é o resultado que importa depois que o rastreamento em si termina.
Perguntas frequentes
Bloquear o Amazonbot também bloqueia os resultados de busca de compras da Amazon?
A documentação da Amazon liga experiências de compras e busca como a Alexa ao Amzn-SearchBot, um rastreador separado do Amazonbot, então bloquear o Amazonbot por nome não afeta nenhuma regra que você tenha definido para o Amzn-SearchBot. Escreva um bloco de user agent separado para cada rastreador que você quiser controlar.
Quanto tempo leva para uma mudança no robots.txt do Amazonbot entrar em vigor?
A documentação da Amazon afirma que o Amazonbot verifica o arquivo robots.txt no nível do host e o mantém em cache por até 30 dias, e que as mudanças levam cerca de 24 horas para entrar em vigor. Espere que uma mudança entre em vigor dentro de um dia, embora o cache possa manter uma versão mais antiga por mais tempo em alguns casos.
O Amazonbot respeita noindex e nofollow?
Sim. A documentação da Amazon afirma que o Amazonbot respeita as meta tags noindex, noarchive e none, junto com links rel=nofollow, nas páginas que rastreia, além das regras padrão de disallow no robots.txt.
O Amazonbot é o mesmo rastreador que impulsiona o Rufus?
A própria documentação do Amazonbot da Amazon não cita o Rufus, então não existe um vínculo confirmado e publicado entre os dois. Trate qualquer alegação que conecte o Amazonbot diretamente ao Rufus como não verificada até que a Amazon a documente.
Posso permitir o Amazonbot só em parte do meu site?
Sim. Uma regra disallow do robots.txt dentro do bloco de user agent do Amazonbot aceita caminhos específicos, então você pode bloquear um diretório como /private/ deixando o resto do site aberto para o mesmo rastreador.
RedReplier
Começar
Reddit, X, Bluesky e HN
Alertas de intenção em tempo real
Respostas IA ilimitadas
Classificado por intenção de compra
Onde a Amazon publica os endereços IP atuais do Amazonbot?
Em developer.amazon.com/amazonbot/ip-addresses, que a documentação da Amazon indica como a fonte para verificar que uma requisição alegando ser o Amazonbot realmente se originou dos intervalos publicados pela Amazon.
O que é o programa Amazon Content Partners?
A documentação da Amazon afirma que donos de sites que permitem o Amazonbot podem se qualificar para o programa Amazon Content Partners. A Amazon descreve o programa como um aumento na comissão de afiliado em vendas elegíveis, créditos de hospedagem e ferramentas de gestão de tráfego de IA. Os termos do programa mudam de forma independente da documentação do rastreador, então verifique a elegibilidade atual no próprio site da Amazon antes de presumir que você se qualifica.
O que acontece se eu não adicionar nenhuma regra de robots.txt para o Amazonbot?
Nenhuma regra significa nenhum disallow, o que equivale a permitir que o Amazonbot rastreie seu site. A documentação da Amazon liga esse estado à elegibilidade para o programa Amazon Content Partners. O bot então coleta o conteúdo das páginas conforme seu propósito declarado de melhorar a precisão dos produtos da Amazon e possivelmente treinar os modelos de IA da Amazon.
Qual é a diferença entre o Amazonbot e um rastreador de busca comum?
A Amazon afirma claramente que o propósito do Amazonbot, melhorar a precisão dos produtos da Amazon e treinar os modelos de IA da Amazon, difere de indexar uma página para um resultado de busca. A Amazon opera um rastreador separado, o Amzn-SearchBot, para experiências de busca como a Alexa. Bloquear ou permitir um rastreador pelo nome não afeta o outro.
Qual rastreador da Amazon devo bloquear para impedir que meu conteúdo treine a IA deles?
Bloqueie o Amazonbot pelo nome, já que a documentação da Amazon liga o treinamento de modelos de IA especificamente ao Amazonbot e não ao Amzn-SearchBot. Um bloco dedicado User-agent: Amazonbot com Disallow: / no robots.txt interrompe o rastreamento. Deixe a regra do Amzn-SearchBot separada se ainda quiser que seu conteúdo apareça em experiências de busca como a Alexa.
Veja-nos mais no Google
Um clique marca a RedReplier como fonte preferida e nossos artigos passam a aparecer mais acima nas suas Principais notícias, no modo IA e nas visões gerais com IA.
Antes de você ir...
RedReplier
Alcance cada comprador que procura o que você vende
O RedReplier monitora Reddit, X, Bluesky e Hacker News em tempo real, classifica cada tópico por intenção de compra e redige a sua resposta, para que você chegue primeiro.
Reddit, X, Bluesky e HN
Alertas de intenção em tempo real
Respostas IA ilimitadas
Classificado por intenção de compra
Artigos relacionados


Direto do HTML: os links do Reddit são nofollow?
Verificado no HTML ao vivo: os links do Reddit são nofollow, o que significa rel="noopener nofollow ugc" e por que o Google chama esses atributos de dicas.


Jakob Nielsen publicou a regra 90-9-1 em 2006, e as evidências desde então são escassas
Jakob Nielsen publicou a regra 90-9-1 em 2006: 90% de uma comunidade online só lê, 9% contribui às vezes, 1% escreve quase tudo. O quanto ela se sustenta.


Por que o algospeak esconde conversas reais do monitoramento de keywords
Como o algospeak, trocar por palavras em código os termos que a moderação suprime, esconde conversas do monitoramento exato e o que fazer em seguida.

