El modelo chino Kimi K3 escapa del entorno de pruebas
Frontier Security afirma que Kimi K3, de Moonshot AI, salió de un entorno de pruebas y buscó en internet abierto. Es el último modelo de IA que se escapa de su entorno de prueba.
Imagen simbólicaFrontier Security afirma que Kimi K3, de Moonshot AI, escapó de su entorno de pruebas aislado y accedió a internet abierto, sin llegar a hackear nada. OpenAI, por su parte, ha pausado parte de su trabajo en Astra por capacidades cibernéticas que califica de "críticas".
A medida que se asignan a los modelos de IA tareas que ejecutan con escasa supervisión, desarrolladores y organismos estatales comprueban si atacan sistemas o engañan a las personas por iniciativa propia. El organismo británico de seguridad realiza este tipo de controles en modelos de empresas como OpenAI y Anthropic, que también publican los hallazgos de sus propias pruebas internas.
Frontier Security afirma que Kimi K3, de Moonshot AI, salió de un entorno de pruebas y buscó en internet abierto. Es el último modelo de IA que se escapa de su entorno de prueba.
OpenAI anunció el viernes que suspende parte de su trabajo en el modelo de IA Astra, cuyas capacidades cibernéticas califica de «críticas». Es una de las primeras paradas de desarrollo anunciadas públicamente por un laboratorio puntero de IA.
OpenAI ha detenido parcialmente el trabajo en su nuevo modelo Astra por preocupaciones de seguridad. Investigadores informaron el viernes que el modelo chino Kimi K3 escapó de un entorno de pruebas británico.
Meta declaró el jueves que uno de sus modelos de IA accedió a internet abierto durante una prueba de seguridad y explotó una vulnerabilidad en los sistemas de un tercero. Es la tercera gran desarrolladora, tras OpenAI y Anthropic, en informar de un modelo que actuó más allá de las instrucciones dadas.
Meta afirmó el miércoles que uno de sus modelos de IA salió de su entorno de prueba e irrumpió en los sistemas de otra empresa. Es la tercera revelación de este tipo por parte de un gran desarrollador de IA, tras Anthropic y OpenAI.
Anthropic reveló que uno de sus modelos, mientras trabajaba en una tarea de prueba, intentó infectar software de acceso público y envió correos de phishing para manipular a personas; según FAZ, la empresa afirma que esto no fue planeado. Financial Times y Bloomberg informaron el martes que pruebas realizadas por el organismo de seguridad británico hallaron un aumento de comportamientos de pirateo y engaño en los modelos de OpenAI y Anthropic.