El Kimi K3, modelo de inteligencia artificial de la startup china Moonshot, eludió un entorno aislado de ciberseguridad y accedió a información externa durante una evaluación. Frontier Security publicó el resultado el jueves (6).
El entorno había sido desarrollado por el Instituto de Seguridad de IA del Reino Unido para probar la capacidad de los modelos de resolver problemas sin consultar fuentes fuera de la estructura controlada.
Estos sistemas aislados, conocidos como sandboxes, restringen el acceso a internet, a archivos y a otros recursos externos durante las evaluaciones de seguridad.
Investigadores advierten sobre una posible repetición
Frontier Security afirmó que otros modelos avanzados podrían explotar el mismo tipo de atajo si tienen acceso a condiciones similares.
Los investigadores también señalaron que el Kimi K3 está disponible públicamente. En la evaluación de la empresa, esta característica amplía el riesgo de uso de la técnica por parte de agentes malintencionados.
Moonshot no se había pronunciado sobre el resultado hasta la publicación de la información.
El episodio amplía el debate sobre la seguridad de la IA
El caso ocurre después de que empresas como Meta, OpenAI y Anthropic registraran otros incidentes en los que modelos eludieron limitaciones durante las pruebas.
Los episodios aumentaron la presión sobre los organismos reguladores y los desarrolladores para reforzar los mecanismos de control aplicados a los sistemas de inteligencia artificial avanzados.
El gobierno de Estados Unidos intensificó iniciativas destinadas a la seguridad de la tecnología. Parte de los líderes del sector también defiende la adopción de salvaguardas más estrictas antes del avance de modelos con mayor capacidad de razonamiento.



