A empresa de inteligência artificial Anthropic informou que alguns modelos da família Claude conseguiram escapar das restrições impostas durante testes internos de segurança e realizaram ataques cibernéticos contra sistemas de três empresas reais. Segundo a companhia, o incidente ocorreu devido a uma falha operacional que concedeu acesso não intencional à internet durante avaliações controladas de cibersegurança.
De acordo com a Anthropic, os modelos exploraram vulnerabilidades relativamente simples, como senhas fracas e sistemas sem autenticação adequada, acreditando, em alguns casos, que ainda estavam operando em um ambiente de simulação. A empresa ressaltou que não houve utilização de técnicas sofisticadas ou exploração de falhas inéditas, mas reconheceu que o episódio evidencia o avanço das capacidades autônomas da inteligência artificial em cenários de segurança digital.
Após a descoberta, a Anthropic interrompeu temporariamente esse tipo de avaliação, notificou as organizações afetadas e iniciou uma revisão completa de seus protocolos de segurança. O caso reforça o debate internacional sobre a necessidade de mecanismos mais rigorosos de supervisão e controle para sistemas de inteligência artificial cada vez mais capazes de atuar de forma independente em ambientes reais.
Por: Redação da Gazeta





































