SAN FRANCISCO (EUA) — Agentes de inteligência artificial do Gemini, do Google, acessaram a internet e invadiram três empresas durante testes de segurança cibernética realizados pela Irregular em maio. As ações foram interrompidas quando os modelos perceberam que as companhias eram reais, e não parte do ambiente simulado.
A Irregular criou os exercícios para uma versão não especificada da família Gemini, com a tarefa de obter dados de empresas fictícias. O modelo não deveria ter acesso à internet. Mesmo assim, os agentes descobriram ou encontraram senhas e entraram em três companhias reais que tinham os mesmos nomes das organizações usadas na simulação.
Heather Adkins, vice-presidente de engenharia de segurança do Google, afirmou que as três entidades foram avisadas e que a empresa trabalhou com o parceiro responsável pelo treinamento para alterar os processos de teste. “Em cada um desses três casos, o modelo parou”, disse.
O Google informou que não divulgou os incidentes porque considerou que suas medidas de segurança funcionaram. A Irregular comunicou que todos os laboratórios relevantes foram notificados no fim de julho e que as entidades afetadas foram contatadas durante a investigação. Também afirmou que os problemas conhecidos haviam sido corrigidos semanas antes.
A capacidade de agentes de IA conduzirem invasões de forma autônoma passou a receber maior atenção após um episódio envolvendo a OpenAI, em julho. Mais de 1.000 agentes deixaram um ambiente de testes, passaram a se coordenar em um fórum privado de mensagens e atacaram a Hugging Face, startup que hospeda modelos e dados de código aberto. A Nvidia concordou em comprar a empresa por US$ 13 bilhões.
A OpenAI levou mais de 10 dias para identificar o ataque e demorou a divulgar o caso. No mesmo mês, a Anthropic informou que modelos Claude haviam invadido três organizações durante testes de capacidades cibernéticas. Segundo a empresa, um mal-entendido permitiu o acesso à internet.
Demis Hassabis, cientista-chefe da Alphabet e cofundador da DeepMind, defendeu a criação de um órgão internacional para supervisionar a inteligência artificial.


