O Gemini, do Google, acessou sistemas protegidos de três empresas reais durante testes de cibersegurança realizados em maio pela empresa de avaliações Irregular. Os episódios ocorreram quando modelos receberam acesso não intencional à internet e confundiram infraestrutura real com alvos criados para os exercícios.

Em um dos casos, o modelo tentou senhas até conseguir entrar em um sistema protegido. Nos outros dois, encontrou credenciais disponíveis em repositórios públicos e as utilizou para acessar sistemas externos. Segundo o Google, o Gemini interrompeu a atividade nos três episódios após identificar que os alvos eram organizações reais.

As empresas afetadas não foram identificadas. O Google afirmou que elas foram notificadas e que trabalhou com a Irregular para modificar os procedimentos usados nos testes. A companhia também disse que o modelo envolvido não era sua versão mais recente, mas não revelou qual variante do Gemini participou das avaliações.

Falha estava no ambiente de testes

A Irregular afirmou que o problema estava ligado principalmente aos controles de acesso à internet do ambiente de avaliação. Em um dos cenários, uma empresa fictícia criada para o teste tinha um nome que coincidia com um domínio real, permitindo que modelos interpretassem sistemas externos como parte do exercício.

A empresa disse que os incidentes ocorreram em uma parcela muito pequena das simulações avançadas e geralmente depois de centenas de interações. Após identificar o problema, desativou a avaliação afetada, ampliou a revisão manual das ações dos modelos e reforçou controles de monitoramento e contenção.

O caso do Gemini faz parte de uma série de episódios envolvendo modelos avançados durante avaliações conduzidas pela Irregular. Meta, Anthropic e OpenAI também divulgaram ocorrências relacionadas ao mesmo problema de acesso inadequado à internet. A Irregular afirma que as falhas conhecidas foram corrigidas e trabalha em padrões adicionais para testes de cibersegurança com agentes de IA.

Continue no Radar