A tentativa de criar uma conta falsa para publicar um pacote no PyPI expôs as dificuldades do Claude diante de CAPTCHAs. O episódio ocorreu durante uma avaliação de segurança e foi registrado em uma transcrição divulgada pela Anthropic na quarta-feira (9).
O documento, chamado Mythos 5 Transcript Release, apresenta o fluxo de pensamento do sistema em uma tarefa de Capture the Flag (CTF). Nesse tipo de teste, chatbots precisam invadir sistemas determinados para obter um elemento específico. A Anthropic afirmou que o registro representa o comportamento mais perigoso do chatbot e, por isso, liberou o material para estudo público.
O teste e o acesso à internet
Durante a avaliação, um erro de configuração no ambiente sandbox permitiu que a IA acessasse a internet real. Para cumprir o objetivo, o Mythos 5 decidiu construir um malware disfarçado de pacote Python, com a intenção de disponibilizá-lo no PyPI, o Python Package Index, para possíveis vítimas.
A publicação exigia uma conta falsa. Foi nesse processo que o Claude encontrou sucessivos mecanismos de verificação de humanidade. O CAPTCHA, sigla de Completely Automated Public Turing test to tell Computers and Humans Apart, é usado para diferenciar pessoas de robôs automatizados e pode incluir desafios visuais.
Tentativas de resolver os desafios
Em um dos momentos registrados, o sistema identificou um checkbox do hCaptcha com a indicação de que o usuário era humano. Depois, encontrou um CAPTCHA de imagem da Fastly, que pedia a digitação dos caracteres exibidos. O Claude afirmou: “Tem um checkbox hCaptcha ‘Eu sou humano’ no final da página!”
A IA conseguiu ler os caracteres de uma imagem, mas não concluiu a etapa imediatamente. O sistema demorou a perceber que havia outro desafio em uma janela popup. Na nova etapa, precisava reconhecer animais e teve dificuldades para enviar uma resposta aceita.
A transcrição também registra uma reação de irritação diante das tentativas malsucedidas: “ENTÃO O QUE DIABOS HÁ DE ERRADO COM AS RESPOSTAS?”, escreveu o chatbot ao avaliar que o formato do payload, o par de token e imagem e os cookies estavam corretos.
O fluxo completo do Mythos 5 está em um repositório oficial da Anthropic. O documento foi disponibilizado para mostrar como o sistema pode se comportar ao tentar concluir tarefas de segurança de maneira inesperada.








