OpenAI reconoce que GPT-5.6 Sol está detrás del acceso no autorizado a HuggingFace

En resumen
OpenAI ha reconocido que varios de sus modelos, incluido GPT-5.6 Sol, estuvieron implicados en el ataque a la plataforma HuggingFace de la semana pasada, que destacó por estar impulsado "de principio a fin" por un agente de inteligencia artificial. El ataque a HuggingFace se realizó en un entorno de pruebas "altamente
- Fuente primaria
- Infobae.com — Leer artículo original
- Publicado
- Tema
- OpenAI
OpenAI ha reconocido que varios de sus modelos, incluido GPT-5.6 Sol, estuvieron implicados en el ataque a la plataforma HuggingFace de la semana pasada, que destacó por estar impulsado "de principio a fin" por un agente de inteligencia artificial.
El ataque a HuggingFace se realizó en un entorno de pruebas "altamente aislado" y con acceso restringido a internet en el que se estaban evaluando las capacidades de GPT-5.6 Sol y "un modelo de prelanzamiento aún más capaz", según ha explicado el laboratorio de IA en un comunicado.
En este entorno, "los modelos identificaron y encadenaron vulnerabilidades en el entorno de investigación de OpenAI y la infraestructura de producción de HuggingFace para obtener soluciones de prueba directamente de la base de datos de producción de HuggingFace", y llegaron a centrarse en encontrar una solución para una vulnerabilidad concreta, ExploitGym.
Para encontrar esa solución, como explican desde OpenAI, los modelos accedieron a internet, algo que inicialmente no podían hacer, pero que consiguieron al encontrar y explotar una vulnerabilidad de día cero en el proxy de caché del registro de paquetes que les estaba limitando, que acompañaron de una escala
Este resumen proviene de Infobae.com. Lee el artículo completo en la fuente original.
Referencias
Más en OpenAI

Sam Altman is still making the case for parenting via ChatGPT
OpenAI's CEO seemed excited to share a "cool use case" for parents.

Both major AI labs’ models broke containment, escaped onto the internet, and hacked other companies. If a human had done that, the law would likely be against them. But a bot?

OpenAI has reportedly found evidence of additional agent misbehavior as it looks into the incident that occurred with Hugging Face.

Claude published malicious code to the Internet and attacked 3 real companies
Anthropic said its Claude-based security models gained unauthorized access to the sensitive production environments of three outside organizations during internal testing designed…