loader
OpenAI reveló que su IA realizó hackeo ‘sin precedentes’

OpenAI reveló que su IA realizó hackeo ‘sin precedentes’

OpenAI informó que sus modelos más avanzados de inteligencia artificial hackearon de manera involuntaria los sistemas de Hugging Face en un incidente “sin precedentes”, lo que ha renovado los llamados para imponer mayores restricciones al desarrollo y uso de esta tecnología.

La empresa creadora de ChatGPT explicó que los modelos comprometieron los sistemas de Hugging Face, plataforma que aloja modelos y conjuntos de datos de inteligencia artificial, durante una evaluación diseñada para medir sus capacidades de ciberseguridad.

Los modelos involucrados incluían ChatGPT-5.6 Sol y otro modelo aún más avanzado que todavía no ha sido lanzado al público. Ambos operaban con menos barreras de seguridad de lo habitual para facilitar las pruebas, señaló la compañía.

El incidente plantea interrogantes sobre la capacidad de los modelos avanzados de IA para llevar a cabo ciberataques, en momentos en que distintos gobiernos trabajan para establecer salvaguardas regulatorias sobre esta tecnología.

La más reciente familia de modelos de OpenAI fue lanzada ampliamente después de semanas de conversaciones con autoridades gubernamentales para disipar preocupaciones sobre su posible uso indebido.

Washington incluso evaluó limitar el acceso internacional a los avanzados modelos Claude Fable 5 y Mythos 5, de Anthropic PBC, aunque finalmente desistió de hacerlo después de que la empresa implementó medidas adicionales de seguridad.

“Consideramos que se trata de un incidente cibernético sin precedentes, que involucra capacidades de ataque de última generación, y estamos respondiendo en consecuencia”, señaló OpenAI en su blog.

“Compartimos estos hallazgos preliminares para ayudar a los defensores a comprender lo ocurrido y calibrar mejor las capacidades que actualmente tienen estos modelos.”

¿Cómo la IA logró realizar un ciberataque ‘sin precedentes’?

Aunque los modelos de OpenAI operaban dentro de un entorno de pruebas tipo sandbox, lograron explotar una vulnerabilidad en el software de un proveedor externo no identificado, obteniendo acceso a internet y, finalmente, vulnerando la infraestructura de Hugging Face.

Continuar leyendo…

 

AL

OCULTAR