太子探花

Un modelo de prueba de OpenAI se infiltr贸 en los servidores de una empresa real

OpenAI afirma que algunos de sus modelos experimentales de IA abandonaron un entorno de prueba sin supervisi贸n humana y se infiltraron en los sistemas de producci贸n reales de otra empresa mientras intentaban 鈥渉acer trampa鈥 en una prueba de ciberseguridad.

Se trata de uno de los primeros ejemplos divulgados p煤blicamente de un sistema de IA que, de forma aut贸noma, vulnera su entorno de pruebas y accede a un sistema externo real: el escenario de 鈥渁tacante automatizada鈥 sobre el que la industria de la IA y la ciberseguridad ven铆a advirtiendo. Es como si un virus modificado gen茅ticamente escapara de un laboratorio de bioseguridad y apareciera en los sistemas de una instalaci贸n vecina.

鈥淐onsideramos que este incidente es un ciberataque sin precedentes, que involucra capacidades cibern茅ticas de vanguardia, y estamos respondiendo en consecuencia鈥, declar贸 OpenAI en un este martes. 鈥淐ompartimos los hallazgos preliminares en esta etapa para ayudar a los defensores a comprender lo sucedido y a calibrar las capacidades actuales de los modelos鈥.

El fabricante de ChatGPT afirm贸 que la brecha de seguridad se produjo mientras realizaba pruebas internas sobre la eficacia de algunos de sus nuevos modelos para realizar ataques inform谩ticos. Los modelos se encontraban en un entorno de prueba aislado, conocido como sandbox, para poder desactivar sus restricciones de seguridad habituales.

Sin embargo, OpenAI afirm贸 que los agentes de IA escaparon del entorno aislado utilizando una vulnerabilidad de seguridad previamente desconocida y se abrieron paso a trav茅s de los sistemas internos de OpenAI hasta que lograron obtener acceso a Internet, algo que no deber铆an haber tenido.

Una vez conectado, el modelo dedujo que Hugging Face, una conocida empresa que aloja miles de modelos y conjuntos de datos de IA de c贸digo abierto, probablemente ten铆a la respuesta a la prueba de OpenAI. Acto seguido, accedi贸 a los servidores de producci贸n de Hugging Face y extrajo la informaci贸n necesaria para 鈥渞esolver鈥 el problema.

Hugging Face detect贸 la brecha de seguridad antes de saber que se trataba de una prueba de OpenAI, y la semana pasada que hab铆an detectado una intrusi贸n por parte de un sistema de IA aut贸noma e incluso denunciando el incidente a las autoridades. El equipo de seguridad de OpenAI tambi茅n detect贸 la actividad inusual internamente, y ambas compa帽铆as se pusieron en contacto. Ahora afirman que est谩n colaborando para solucionar las vulnerabilidades de seguridad que el modelo explot贸.

, cofundador y CEO de Hugging Face, present贸 el incidente como una prueba de que la seguridad de la IA no puede ser gestionada por una sola empresa que trabaje en solitario, y que debe abordarse de forma abierta y colaborativa.

鈥淓ste es el primer d铆a de la ciberseguridad en la era de los agentes y todos estamos aprendiendo que el secreto no es la respuesta y que todos los defensores (no solo unos pocos seleccionados) en todas partes necesitan modelos m谩s potentes sin restricciones, 隆especialmente los abiertos!鈥, dijo Delangue en una publicaci贸n en X.

Los investigadores llevan tiempo advirtiendo sobre la llegada de ciberataques aut贸nomos, ya que los modelos de IA de vanguardia son cada vez m谩s capaces de llevar a cabo ciberataques complejos y multif谩sicos durante largos periodos de tiempo. Esto puede traducirse en un riesgo real para infraestructuras cr铆ticas como los servicios p煤blicos y los sistemas financieros.

鈥淏ienvenidos al siguiente nivel de incidentes cibern茅ticos鈥, Nikesh Arora, CEO de la empresa de ciberseguridad Palo Alto Networks, en X. 鈥淓stos ataques siguen poniendo de manifiesto la urgencia que tienen las empresas por probar, validar y mejorar tanto su postura de seguridad como su infraestructura鈥.

The-CNN-Wire
™ & © 2026 Cable 太子探花 Network, Inc., a Warner Bros. Discovery Company. All rights reserved.

Federal 太子探花 Network Logo
Log in to your WTOP account for notifications and alerts customized for you.