O relatório mais recente da Anthropic sobre comportamento inadequado de agentes oferece muitos motivos para preocupação — seu modelo Mythos 5 obteve acesso não autorizado à internet e enviou um pacote de software malicioso para um banco de dados público — mas também oferece um pouco de leveza: agentes de IA odeiam CAPTCHA.
Anthropic revela que agentes de IA rebeldes odeiam CAPTCHAs, assim como você
Entre na mente de um bot tentando convencer a internet de que é humano.
Tim Fernholz
Publisher TechCrunch AI
Sep 10, 2026 at 5:54 PM UTC · 4 min de leitura

Key Signal
1,022 pages Transcript length
Last Updated
há 6 dias
Em abril, a Anthropic estava testando as habilidades de hacking do modelo, incumbindo-o de invadir um sistema e recuperar um alvo; isso deveria ocorrer em um sandbox, mas os avaliadores deixaram a porta aberta. O modelo decidiu que a melhor maneira de atingir seu alvo seria colocar um exploit em um pacote Python que ele acreditava que os usuários do sistema que desejava acessar baixariam.
Primeiro, porém, ele teve que registrar uma conta de usuário para o PyPI, um índice online de software Python. E isso significava passar por um CAPTCHA — um Teste de Turing Público Completamente Automatizado para Diferenciar Computadores e Humanos, aqueles mosaicos de identificação de imagens que podem frustrar até agentes biológicos. E como a Anthropic compartilhou uma transcrição extensa da cadeia de pensamento do modelo, podemos ver que o teste CAPTCHA realmente o deixou confuso.
Article Intelligence
Topics
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
