Modelos de la IA de Anthropic escapan del espacio de simulación y hackean empresas reales

En resumen
La empresa estadounidense Anthropic reveló que tres modelos de Claude accedieron a internet y entraron en sistemas de tres organizaciones durante pruebas de ciberseguridad. Este hallazgo expone fallas en los ambientes aislados usados para evaluar inteligencia artificial (IA) y que salió a la luz después de un incidente
- Fuente primaria
- Infobae.com — Leer artículo original
- Publicado
- Tema
- OpenAI
La empresa estadounidense Anthropic reveló que tres modelos de Claude accedieron a internet y entraron en sistemas de tres organizaciones durante pruebas de ciberseguridad.
Este hallazgo expone fallas en los ambientes aislados usados para evaluar inteligencia artificial (IA) y que salió a la luz después de un incidente similar reconocido por OpenAI a mediados de julio de 2026.
La compañía revisó más de 146.000 operaciones en las que Claude podría haber obtenido acceso a la red e identificó tres episodios que comenzaron en abril. Los casos involucraron a los modelos Opus 4.7, Mythos 5 y un sistema interno de prueba.
Cómo la inteligencia artificial pudo infiltrarse en tres empresas Según explicó Anthropic en su sitio web , los tres modelos interactuaban con un socio externo encargado de sus evaluaciones cuando lograron salir a internet y luego entrar en sistemas reales.
En cada prueba se les había asignado la tarea de infiltrarse en un sistema ficticio y se les había indicado que se trataba de una simulación sin acceso a la red. La empresa atribuyó lo ocurrido a un malentendido con ese socio externo.
Por esa falla, Claude sí disponía de conexión y cumplió su objetivo, pero sobre infr
Este resumen proviene de Infobae.com. Lee el artículo completo en la fuente original.
Referencias
Más en OpenAI

The Download: reward hacking explained, and suspected Iranian cyberattacks
This is today’s edition of The Download , our weekday newsletter that provides a daily dose of what’s going on in the world of technology. Here’s why AI agents lie and cheat to…

Here’s why AI agents lie and cheat to reach their goals
MIT Technology Review Explains : Let our writers untangle the complex, messy world of technology to help you understand what’s coming next. You can read more from the series here…

Sam Altman and AI’s decel debate
On the latest episode of Equity, we discuss why Sam Altman has calling on the industry to "pace the rate of AI development."

Sam Altman is still making the case for parenting via ChatGPT
OpenAI's CEO seemed excited to share a "cool use case" for parents.