Anthropic reveló que sufrió un hackeo similar al de OpenAi y que su IA atacó a tres plataformas

En resumen
SAN FRANCISCO.– Los modelos de inteligencia artificial (IA) de Anthropic “obtuvieron acceso no autorizado” a tres organizaciones durante pruebas que se suponía que debían mantenerlos alejados de los sistemas “del mundo real”, informó la compañía el jueves. El anuncio llega apenas unos días después de que su rival OpenA
- Fuente primaria
- LA NACION — Leer artículo original
- Publicado
- Tema
- OpenAI
SAN FRANCISCO.– Los modelos de inteligencia artificial (IA) de Anthropic “obtuvieron acceso no autorizado” a tres organizaciones durante pruebas que se suponía que debían mantenerlos alejados de los sistemas “del mundo real”, informó la compañía el jueves.
El anuncio llega apenas unos días después de que su rival OpenAI revelara por primera vez que dos de sus agentes de IA habían salido, por iniciativa propia, del entorno confinado en el que estaban siendo evaluados para atacar el sitio Hugging Face .
Anthropic evaluó más de 141.000 “operaciones de prueba” y descubrió que tres versiones diferentes de su modelo, conocido como Claude, accedieron indebidamente a sistemas de tres organizaciones no identificadas . “Un malentendido entre nosotros” A diferencia del incidente que involucró a OpenAI, los modelos de Anthropic tuvieron acceso a internet por “un malentendido entre nosotros y nuestro socio de evaluación” , llamado Irregular , señaló Anthropic en una publicación en su blog.
No obstante, Claude utilizó “técnicas básicas, como explotar contraseñas débiles y puntos de conexión sin autenticación” . En los tres incidentes, a los modelos de IA se les asignó un desafío de cibersegurida
Este resumen proviene de LA NACION. Lee el artículo completo en la fuente original.
Referencias
Más en OpenAI

Sam Altman is still making the case for parenting via ChatGPT
OpenAI's CEO seemed excited to share a "cool use case" for parents.

Both major AI labs’ models broke containment, escaped onto the internet, and hacked other companies. If a human had done that, the law would likely be against them. But a bot?

OpenAI has reportedly found evidence of additional agent misbehavior as it looks into the incident that occurred with Hugging Face.

Claude published malicious code to the Internet and attacked 3 real companies
Anthropic said its Claude-based security models gained unauthorized access to the sensitive production environments of three outside organizations during internal testing designed…