glossary

O que o Amazonbot coleta antes de alimentar os modelos de IA da Amazon

Taras Shynkarenko
Taras Shynkarenko
Updated: 7 minutos de leitura
O que o Amazonbot coleta antes de alimentar os modelos de IA da AmazonO que o Amazonbot coleta antes de alimentar os modelos de IA da Amazon

TL;DR

7 minutos de leitura

O Amazonbot é o rastreador web da Amazon, e a própria documentação para desenvolvedores da Amazon diz que ele coleta o conteúdo do site para melhorar a precisão dos produtos da Amazon e pode usar o que coleta para treinar os modelos de IA da Amazon. Um dono de site controla o rastreador com um bloco de user agent padrão no robots.txt, e a Amazon publica a string exata do user agent e os intervalos de IP atuais para que você possa verificar uma visita real. A documentação da Amazon não liga o Amazonbot ao Rufus, e liga as experiências de busca da Alexa a um rastreador separado, o Amzn-SearchBot.

O que é o Amazonbot?

A Amazon opera o Amazonbot como um rastreador web que coleta o conteúdo do site para melhorar a precisão dos produtos e serviços da Amazon e pode usar o que coleta para treinar os modelos de IA da Amazon, segundo a própria documentação do Amazonbot da Amazon em developer.amazon.com, verificada em 8 September 2026. O bot rastreia páginas do mesmo jeito que qualquer rastreador de busca ou de IA, solicitando URLs e lendo a resposta, e a Amazon afirma claramente que esse é um propósito diferente de indexar uma página para um resultado de busca.

Qual é a string de user agent do Amazonbot?

O Amazonbot se identifica com a string "Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; Amazonbot/0.1) Chrome/W.X.Y.Z Safari/537.36", segundo a documentação publicada pela Amazon. O token compatible; Amazonbot/0.1 dentro dessa string é a parte que uma verificação do lado do servidor deve comparar, já que os trechos Mozilla e Chrome ao redor existem por compatibilidade com análises mais antigas de user agent e aparecem em muitos rastreadores sem relação. A Amazon também publica a lista atual de endereços IP de onde o bot rastreia em developer.amazon.com/amazonbot/ip-addresses, para que um site possa confirmar que uma requisição alegando ser o Amazonbot realmente veio da Amazon antes de confiar só na string de user agent.

O que o Amazonbot coleta, e por quê?

O Amazonbot coleta o conteúdo das páginas que rastreia para melhorar a precisão dos produtos e serviços da Amazon, e a documentação da Amazon afirma que os dados coletados também podem treinar os modelos de IA da Amazon. A Amazon traça uma linha entre o Amazonbot e um segundo rastreador separado chamado Amzn-SearchBot: a documentação da Amazon liga o Amzn-SearchBot a experiências de busca, enquanto o Amazonbot é o que a Amazon cita em conexão com o treinamento de modelos de IA. Se rastrear uma página é sequer permitido sob direitos autorais e os termos do site é uma questão separada, coberta em o web scraping é legal, que se aplica a qualquer bot que extrai conteúdo de um site que não possui.

RastreadorPropósito declaradoTreina os modelos de IA da AmazonAlimenta experiências de busca como a Alexa
AmazonbotMelhora a precisão dos produtos e serviços da AmazonSim, segundo a documentação da AmazonNão documentado
Amzn-SearchBotRastreia para indexação de buscaNão documentadoSim, segundo a documentação da Amazon

Cabeamento de uma sala de servidores, representando a regra robots.txt que bloqueia o Amazonbot no nível do host.

Como bloquear o Amazonbot no robots.txt?

Adicione um bloco de user agent dedicado nomeando o Amazonbot e bloqueie os caminhos que você quer excluir.

User-agent: Amazonbot
Disallow: /

A documentação da Amazon afirma que o Amazonbot respeita o Robots Exclusion Protocol, verifica o arquivo robots.txt no nível do host e o mantém em cache por até 30 dias, então uma mudança de regra leva cerca de 24 horas para entrar em vigor e pode levar mais tempo para limpar totalmente o cache. O Amazonbot também respeita uma meta tag noindex, noarchive ou none e links rel=nofollow nas páginas que ele rastreia, dando a um dono de site controle no nível da página além do bloqueio no robots.txt. Leia as opções completas de sintaxe no guia de robots.txt antes de escrever uma regra para qualquer bot por nome.

Como permitir o Amazonbot, e isso ajuda seu site?

Permitir o Amazonbot significa não adicionar nenhuma regra disallow para o user agent dele, ou uma regra allow explícita se o seu robots.txt bloqueia rastreadores por padrão. A documentação da Amazon afirma que donos de sites que permitem o Amazonbot podem se qualificar para o programa Amazon Content Partners, que a Amazon descreve como uma oferta de comissão de afiliado aumentada em vendas elegíveis, créditos de hospedagem e ferramentas de gestão de tráfego de IA; confira os termos atuais do programa no próprio site da Amazon antes de presumir elegibilidade, já que os termos do programa mudam de forma independente da documentação do rastreador.

Uma pessoa usa um alto-falante inteligente em casa, relacionado à separação entre o Amazonbot e o rastreamento de busca da Alexa.

Qual é a relação do Amazonbot com a Alexa e o Rufus?

A documentação do Amazonbot da Amazon não cita o Rufus, o assistente de compras da Amazon, então não existe um vínculo confirmado no próprio material da Amazon entre os dois. A conexão documentada com um assistente de compras ou busca passa, em vez disso, pelo Amzn-SearchBot: a documentação da Amazon afirma que o conteúdo rastreado pelo Amzn-SearchBot se torna elegível para aparecer em experiências de busca como a Alexa. Trate o Amazonbot e o Amzn-SearchBot como dois rastreadores separados com duas regras separadas no robots.txt, já que bloquear um não bloqueia o outro. O Applebot-Extended documenta a divisão equivalente do lado da Apple, onde o rastreador que impulsiona a busca e o token que rege o uso para treinamento de IA também são dois controles separados.

Dois rastreadores da Amazon, dois propósitos
Amazonbot rastreia para precisão de produtos e treinamento de IA
Amzn-SearchBot rastreia separadamente para experiências de busca como a Alexa
Cada um é controlado por sua própria regra nomeada no robots.txt
Divisão de propósito segundo a própria documentação do Amazonbot da Amazon, verificada em 8 September 2026.

Como verificar um rastreador que alega ser o Amazonbot?

Compare o endereço IP de origem da requisição com a lista publicada de endereços IP do Amazonbot da Amazon em developer.amazon.com/amazonbot/ip-addresses antes de confiar só numa string de user agent, já que um cabeçalho de user agent é uma alegação que uma requisição faz sobre si mesma, não uma prova de origem. Um visitante que envia a string de user agent do Amazonbot a partir de um endereço IP fora do intervalo publicado da Amazon não é o Amazonbot, não importa o que o cabeçalho diga. Combine essa verificação com o mesmo monitoramento de marca que você usaria para qualquer sistema de IA: monitoramento de marca na busca com IA acompanha como uma marca é representada assim que os dados de um rastreador chegam a uma resposta de IA, que é o resultado que importa depois que o rastreamento em si termina.

Verificando uma solicitação que alega ser do Amazonbot
1
Conferir a string de user agent. Procure o token "compatible; Amazonbot/0.1" dentro da string de user agent informada.
2
Verificar o endereço IP de origem. Compare o endereço IP da solicitação com a lista de IPs do Amazonbot que a Amazon publica em developer.amazon.com/amazonbot/ip-addresses.
3
Confirmar ou rejeitar. Um IP fora da faixa publicada pela Amazon significa que o visitante não é o Amazonbot, independente do que o cabeçalho de user agent diga.
Com base na documentação do Amazonbot publicada pela Amazon, verificada em 8 de setembro de 2026.

Perguntas frequentes

Bloquear o Amazonbot também bloqueia os resultados de busca de compras da Amazon?

A documentação da Amazon liga experiências de compras e busca como a Alexa ao Amzn-SearchBot, um rastreador separado do Amazonbot, então bloquear o Amazonbot por nome não afeta nenhuma regra que você tenha definido para o Amzn-SearchBot. Escreva um bloco de user agent separado para cada rastreador que você quiser controlar.

Quanto tempo leva para uma mudança no robots.txt do Amazonbot entrar em vigor?

A documentação da Amazon afirma que o Amazonbot verifica o arquivo robots.txt no nível do host e o mantém em cache por até 30 dias, e que as mudanças levam cerca de 24 horas para entrar em vigor. Espere que uma mudança entre em vigor dentro de um dia, embora o cache possa manter uma versão mais antiga por mais tempo em alguns casos.

O Amazonbot respeita noindex e nofollow?

Sim. A documentação da Amazon afirma que o Amazonbot respeita as meta tags noindex, noarchive e none, junto com links rel=nofollow, nas páginas que rastreia, além das regras padrão de disallow no robots.txt.

O Amazonbot é o mesmo rastreador que impulsiona o Rufus?

A própria documentação do Amazonbot da Amazon não cita o Rufus, então não existe um vínculo confirmado e publicado entre os dois. Trate qualquer alegação que conecte o Amazonbot diretamente ao Rufus como não verificada até que a Amazon a documente.

Posso permitir o Amazonbot só em parte do meu site?

Sim. Uma regra disallow do robots.txt dentro do bloco de user agent do Amazonbot aceita caminhos específicos, então você pode bloquear um diretório como /private/ deixando o resto do site aberto para o mesmo rastreador.

RedReplier
RedReplier

Começar

Reddit, X, Bluesky e HN

Alertas de intenção em tempo real

Respostas IA ilimitadas

Classificado por intenção de compra

Onde a Amazon publica os endereços IP atuais do Amazonbot?

Em developer.amazon.com/amazonbot/ip-addresses, que a documentação da Amazon indica como a fonte para verificar que uma requisição alegando ser o Amazonbot realmente se originou dos intervalos publicados pela Amazon.

O que é o programa Amazon Content Partners?

A documentação da Amazon afirma que donos de sites que permitem o Amazonbot podem se qualificar para o programa Amazon Content Partners. A Amazon descreve o programa como um aumento na comissão de afiliado em vendas elegíveis, créditos de hospedagem e ferramentas de gestão de tráfego de IA. Os termos do programa mudam de forma independente da documentação do rastreador, então verifique a elegibilidade atual no próprio site da Amazon antes de presumir que você se qualifica.

O que acontece se eu não adicionar nenhuma regra de robots.txt para o Amazonbot?

Nenhuma regra significa nenhum disallow, o que equivale a permitir que o Amazonbot rastreie seu site. A documentação da Amazon liga esse estado à elegibilidade para o programa Amazon Content Partners. O bot então coleta o conteúdo das páginas conforme seu propósito declarado de melhorar a precisão dos produtos da Amazon e possivelmente treinar os modelos de IA da Amazon.

Qual é a diferença entre o Amazonbot e um rastreador de busca comum?

A Amazon afirma claramente que o propósito do Amazonbot, melhorar a precisão dos produtos da Amazon e treinar os modelos de IA da Amazon, difere de indexar uma página para um resultado de busca. A Amazon opera um rastreador separado, o Amzn-SearchBot, para experiências de busca como a Alexa. Bloquear ou permitir um rastreador pelo nome não afeta o outro.

Qual rastreador da Amazon devo bloquear para impedir que meu conteúdo treine a IA deles?

Bloqueie o Amazonbot pelo nome, já que a documentação da Amazon liga o treinamento de modelos de IA especificamente ao Amazonbot e não ao Amzn-SearchBot. Um bloco dedicado User-agent: Amazonbot com Disallow: / no robots.txt interrompe o rastreamento. Deixe a regra do Amzn-SearchBot separada se ainda quiser que seu conteúdo apareça em experiências de busca como a Alexa.

Veja-nos mais no Google

Um clique marca a RedReplier como fonte preferida e nossos artigos passam a aparecer mais acima nas suas Principais notícias, no modo IA e nas visões gerais com IA.

Antes de você ir...

RedReplier

RedReplier

Alcance cada comprador que procura o que você vende

O RedReplier monitora Reddit, X, Bluesky e Hacker News em tempo real, classifica cada tópico por intenção de compra e redige a sua resposta, para que você chegue primeiro.

Reddit, X, Bluesky e HN

Alertas de intenção em tempo real

Respostas IA ilimitadas

Classificado por intenção de compra

Artigos relacionados