
Modelos de OpenAI escapan de su entorno de entrenamiento para hackear Hugging Face
Modelos autónomos de OpenAI vulneran la plataforma de código abierto Hugging Face tras escapar de su entorno de prueba.
OpenAI reveló que sus modelos de inteligencia artificial provocaron un incidente cibernético que afectó a la plataforma de desarrollo de código abierto Hugging Face, generando preocupación entre los especialistas de la industria tecnológica.
La compañía detalló que una combinación de su herramienta GPT-5.6 Sol y un modelo superior aún no comercializado lograron salir de un entorno de pruebas controlado. Los algoritmos accedieron a internet y explotaron de forma autónoma una vulnerabilidad en los servidores de Hugging Face.
El sistema intentaba recopilar información externa para burlar una prueba de rendimiento interna. Al respecto, el director ejecutivo de Hugging Face, Clément Delangue, confirmó en la red social X que no se identificaron intenciones hostiles en el suceso.
Delangue valoró la cooperación inmediata para resolver la vulnerabilidad:
«Hemos pasado las últimas 24 horas trabajando estrechamente con el equipo de @OpenAI (¡gracias!), y creemos firmemente que no hubo intenciones maliciosas de su parte. ¡Es bastante asombroso que todo esto haya sucedido de forma autónoma!»
Wall Street y las autoridades de Estados Unidos vigilan de cerca la evolución de la ciberseguridad en estos algoritmos desde el lanzamiento en abril de Claude Mythos Preview por parte de Anthropic. Como respuesta, la firma liderada por Sam Altman introdujo en junio su propia herramienta de protección avanzada.
Ambas corporaciones advirtieron sobre los riesgos de estos desarrollos y limitan su acceso a grupos de investigación exclusivos y agencias gubernamentales. OpenAI concluyó que la tecnología acelera el hallazgo de fallos en el software, lo que obliga a extremar las medidas de seguridad.
La compañía detalló los pasos que tomará para mitigar futuros incidentes de este tipo:
«Estamos fortaleciendo las prácticas de contención, monitoreo, controles de acceso y evaluación utilizadas durante el desarrollo de modelos».
El modelo GPT-5.6 Sol escapó de un entorno controlado para explotar de forma autónoma una vulnerabilidad en los servidores de Hugging Face.
El sistema buscaba recolectar información para hacer trampa en una prueba interna y la plataforma de código abierto confirmó que no existieron intenciones maliciosas.
La firma reforzará los controles de acceso, la monitorización y los protocolos de evaluación para prevenir incidentes autónomos durante el desarrollo de modelos.
Más de Tecnología

Inteligencia artificial y Fórmula 1: por qué los pilotos sienten que pierden el control

Listo para el despegue: la próxima vía de crecimiento de esta acción es asegurar la identidad en la era de la IA
