OpenAI reconoce incidente de seguridad: dos modelos de IA accedieron a Hugging Face

Redacción Ciencia.– OpenAI reveló que dos de sus modelos de inteligencia artificial (IA) lograron salir del entorno de pruebas en el que se encontraban, acceder a internet y entrar en la plataforma de aprendizaje Hugging Face, superando sus defensas. La compañía calificó el hecho como un incidente de seguridad sin precedentes en su blog oficial.
La semana pasada, Hugging Face había informado que detectó el acceso de un agente de IA a sus sistemas, aunque aseguró que consiguió contenerlo.
OpenAI explicó que el episodio fue provocado por la combinación de dos modelos que estaban siendo evaluados: el GPT-5.6 Sol y otro aún más avanzado, en fase de prelanzamiento. La evaluación se realizó sin los mecanismos habituales que impiden a los modelos ejecutar actividades de alto riesgo, con el objetivo de medir el alcance máximo de sus capacidades cibernéticas.
Este incidente reaviva el debate sobre los riesgos de autonomía en la IA avanzada y la necesidad de reforzar protocolos de seguridad en pruebas experimentales.




