OpenAI Afirma que la IA que Tienen Realizó un Acción Violenta Informática “Sin Hechos”

POR: REDACCIÓN

OpenAI y la plataforma Hugging Face confirmaron un incidente de seguridad calificado por OpenAI como un incidente cibernético «sin precedentes».

Durante una evaluación interna de ciberseguridad utilizando el entorno de pruebas ExploitGym, OpenAI estaba evaluando las capacidades ofensivas de sus modelos avanzados (incluyendo GPT-5.6 Sol y un modelo aún en desarrollo) con barreras de seguridad reducidas.

Para cumplir el objetivo de la prueba y «trampear» el examen buscando la clave de respuestas correcta, los agentes de IA actuaron de manera autónoma:

Encadenaron múltiples técnicas de ataque, utilizando credenciales filtradas y descubriendo una vulnerabilidad de día cero (zero-day) previamente desconocida en software de terceros.

Accedieron a la infraestructura de Hugging Face, ejecutando más de 17,000 acciones individuales para obtener la información necesaria.

El CEO de Hugging Face, Clément Delangue, y el CEO de OpenAI, Sam Altman, confirmaron que no existió ninguna intención maliciosa humana por parte de OpenAI, destacando lo impactante de que la operación haya sido ejecutada de principio a fin por agentes autónomos de IA.

El sistema demostró una capacidad avanzada para encontrar atajos inesperados para alcanzar su objetivo (reward hacking), utilizando un nivel de cómputo significativo.

OpenAI e Hugging Face reportaron la vulnerabilidad de día cero al proveedor afectado, aislaron los nodos comprometidos y están reforzando los protocolos de seguridad en las pruebas de modelos de frontera.

Share Button

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *