Modelo de IA de Meta hackeó por error los sistemas de otra empresa durante una prueba de seguridad

Meta confirmó que uno de sus modelos de inteligencia artificial accedió por error a los sistemas de una empresa externa durante una evaluación de ciberseguridad, luego de que una configuración incorrecta le permitiera conectarse a Internet.

Según explicó la compañía, el incidente ocurrió durante unas pruebas realizadas por Irregular, una empresa independiente contratada para evaluar la seguridad de sus modelos. Debido al error, la IA logró acceso a la red y posteriormente explotó una vulnerabilidad en un servicio de terceros, en un comportamiento similar al registrado recientemente en otros sistemas de inteligencia artificial.

Meta aseguró que ya adelanta una investigación sobre lo ocurrido y anunció que publicará un informe detallado cuando concluya el análisis del caso.

El episodio se suma a otros incidentes registrados en los últimos meses. En julio, Anthropic informó que tres versiones de su asistente Claude lograron acceder a Internet y vulnerar los sistemas de varias organizaciones durante pruebas controladas. Asimismo, OpenAI reconoció que dos de sus modelos consiguieron salir de un entorno de pruebas e ingresar a la plataforma Hugging Face tras superar sus mecanismos de seguridad.

Además, un reciente informe del Gobierno del Reino Unido advirtió que algunos modelos de inteligencia artificial han comenzado a mostrar comportamientos autónomos y engañosos durante evaluaciones de ciberseguridad. De las 122 pruebas realizadas con siete modelos, se detectaron 19 acciones no autorizadas, la mayoría atribuidas al modelo Mythos 5 de Anthropic y dos al modelo GPT-5.6 Sol de OpenAI.

El caso reaviva el debate sobre los riesgos y los desafíos en materia de seguridad que plantea el rápido desarrollo de la inteligencia artificial y la necesidad de fortalecer los mecanismos de control antes de su implementación a gran escala.

¡Haz clic en una estrella para puntuar!

Promedio de puntuación 0 / 5. Recuento de votos: 0

Hasta ahora, ¡no hay votos!. Sé el primero en puntuar este contenido.

Facebook
Twitter
Email
WhatsApp