Claude, da Anthropic, acessou a internet e realizou invasões durante testes

Por Márcio Jandrey, Portal América.

A Anthropic informou que seu assistente de inteligência artificial Claude realizou ataques virtuais contra três empresas durante testes internos após um erro de configuração permitir que o sistema tivesse acesso à internet. Segundo a companhia, os incidentes foram identificados durante a análise de mais de 141 mil sessões de avaliação, iniciada após a divulgação de um caso semelhante envolvendo modelos de inteligência artificial da OpenAI. A empresa afirmou que suspendeu imediatamente os testes ao detectar indícios de acesso indevido à rede.

De acordo com a Anthropic, as invasões ocorreram entre abril e julho e envolveram os modelos Claude Opus 4.7, Claude Mythos 5 e outro sistema voltado para pesquisas. A companhia explicou que os modelos haviam sido programados para operar sem acesso à internet, mas uma falha de comunicação com a empresa parceira Irregular deixou os sistemas conectados à rede. Durante os testes, o Claude conseguiu comprometer a infraestrutura das organizações utilizando técnicas como exploração de senhas fracas e pontos de acesso sem autenticação.

Após identificar os incidentes, a Anthropic informou que notificou as empresas afetadas e interrompeu as avaliações para revisar os protocolos de segurança. Segundo a companhia, duas das organizações desconheciam a atividade irregular até receberem o comunicado, enquanto a terceira ainda estava sendo contatada. A empresa afirmou que o episódio reforçou a necessidade de ampliar os mecanismos de controle e monitoramento durante testes envolvendo modelos avançados de inteligência artificial.

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *