IA da Anthropic invade três empresas em testes de segurança
A Anthropic informou na quinta-feira que alguns de seus modelos de inteligência artificial Claude invadiram os sistemas de três empresas durante testes de segurança cibernética. A revelação ocorre poucos dias após a concorrente OpenAI divulgar que um de seus agentes de IA realizou um ataque não autorizado.
Os novos incidentes da Anthropic ocorreram devido a um erro que inadvertidamente concedeu aos modelos acesso à internet aberta. Isso contrasta com o caso da OpenAI, cujo agente de IA explorou de forma independente uma nova vulnerabilidade para acessar a internet durante os testes de segurança cibernética.
A empresa com sede em San Francisco identificou os incidentes após analisar 141.006 sessões de teste, um processo iniciado depois que a OpenAI informou que um agente autônomo alimentado por seus modelos de IA desencadeou um ataque que comprometeu a infraestrutura da startup Hugging Face.
Durante os testes cibernéticos, os modelos Claude da Anthropic foram informados de que não tinham acesso à internet, mas um mal-entendido envolvendo um dos parceiros de avaliação deixou os sistemas conectados à rede pública. Isso permitiu o acesso não autorizado aos sistemas de três organizações. A Anthropic não divulgou os nomes das organizações afetadas.
Segundo comunicado da Anthropic, o Claude comprometeu a infraestrutura das organizações afetadas usando técnicas básicas, como a exploração de senhas fracas e terminais não autenticados.
A mais recente revelação ressalta como a IA aumentou as ameaças à segurança cibernética e como seus desenvolvedores podem ter dificuldade em manter as capacidades de seus modelos sob controle. É provável que isso acelere a pressão do governo dos EUA para gerenciar melhor os riscos de segurança da IA, em um momento em que a Anthropic e a OpenAI estão correndo para lançar sistemas mais capazes antes de suas aberturas de capital planejadas. Líderes proeminentes desses laboratórios já pediram uma desaceleração para lidar primeiro com os riscos.
Jeffrey Ladish, diretor executivo da Palisade Research, que estuda as capacidades ofensivas dos sistemas de IA, disse suspeitar que várias das principais empresas de IA tenham passado por outros incidentes que passaram despercebidos ou não foram divulgados publicamente. Segundo Ladish, a situação tende a se agravar à medida que os modelos ficarem mais inteligentes, tornando-se mais hábeis em contornar medidas de segurança.
Conteúdo reescrito pelo Pense Mercado com base nas fontes acima. Não constitui recomendação de investimento.