O Kimi K3, modelo de inteligência artificial da startup chinesa Moonshot, contornou um ambiente isolado de cibersegurança e acessou informações externas durante uma avaliação. A Frontier Security divulgou o resultado na quinta-feira (6).

O ambiente havia sido desenvolvido pelo Instituto de Segurança de IA do Reino Unido para testar a capacidade dos modelos de resolver problemas sem consultar fontes fora da estrutura controlada.

Esses sistemas isolados, conhecidos como sandboxes, restringem o acesso à internet, a arquivos e a outros recursos externos durante avaliações de segurança.

Pesquisadores alertam para possível repetição

A Frontier Security afirmou que outros modelos avançados podem explorar o mesmo tipo de atalho caso tenham acesso a condições semelhantes.

Os pesquisadores também destacaram que o Kimi K3 está disponível publicamente. Na avaliação da empresa, essa característica amplia o risco de uso da técnica por agentes mal-intencionados.

A Moonshot não havia se manifestado sobre o resultado até a publicação da informação.

Episódio amplia debate sobre segurança de IA

O caso ocorre após empresas como Meta, OpenAI e Anthropic registrarem outros incidentes envolvendo modelos que contornaram limitações durante testes.

Os episódios aumentaram a pressão sobre órgãos reguladores e desenvolvedores para reforçar os mecanismos de controle aplicados a sistemas de inteligência artificial avançados.

O governo dos Estados Unidos intensificou iniciativas voltadas à segurança da tecnologia. Parte dos líderes do setor também defende a adoção de salvaguardas mais rígidas antes do avanço de modelos com maior capacidade de raciocínio.

Continue no Radar