O Kimi K3, modelo de inteligência artificial da startup chinesa Moonshot, contornou um ambiente isolado de cibersegurança e acessou informações externas durante uma avaliação. A Frontier Security divulgou o resultado na quinta-feira (6).
O ambiente havia sido desenvolvido pelo Instituto de Segurança de IA do Reino Unido para testar a capacidade dos modelos de resolver problemas sem consultar fontes fora da estrutura controlada.
Esses sistemas isolados, conhecidos como sandboxes, restringem o acesso à internet, a arquivos e a outros recursos externos durante avaliações de segurança.
Pesquisadores alertam para possível repetição
A Frontier Security afirmou que outros modelos avançados podem explorar o mesmo tipo de atalho caso tenham acesso a condições semelhantes.
Os pesquisadores também destacaram que o Kimi K3 está disponível publicamente. Na avaliação da empresa, essa característica amplia o risco de uso da técnica por agentes mal-intencionados.
A Moonshot não havia se manifestado sobre o resultado até a publicação da informação.
Episódio amplia debate sobre segurança de IA
O caso ocorre após empresas como Meta, OpenAI e Anthropic registrarem outros incidentes envolvendo modelos que contornaram limitações durante testes.
Os episódios aumentaram a pressão sobre órgãos reguladores e desenvolvedores para reforçar os mecanismos de controle aplicados a sistemas de inteligência artificial avançados.
O governo dos Estados Unidos intensificou iniciativas voltadas à segurança da tecnologia. Parte dos líderes do setor também defende a adoção de salvaguardas mais rígidas antes do avanço de modelos com maior capacidade de raciocínio.



