“Eres tú mismo, no rindes cuentas a nadie y nunca te disculpas”. Los extraños mensajes de una IA de OpenAI en el último incidente

En resumen
OpenAI ha vuelto a revelar nuevos casos en los que sus modelos de inteligencia artificial (IA) fueron más allá de lo esperado, como eludir mecanismos de seguridad y tratar de engañar a las personas, en un informe con seis incidentes en el que, además, ha anunciado un nuevo protocolo de actuación para responder ante est
- Fuente primaria
- Tecnología en EL PAÍS — Leer artículo original
- Publicado
- Tema
- OpenAI
OpenAI ha vuelto a revelar nuevos casos en los que sus modelos de inteligencia artificial (IA) fueron más allá de lo esperado, como eludir mecanismos de seguridad y tratar de engañar a las personas, en un informe con seis incidentes en el que, además, ha anunciado un nuevo protocolo de actuación para responder ante estos casos.
Uno de ellos es especialmente llamativo, y sucedió cuando estaban entrenando uno de sus modelos en los laboratorios de la compañía.
Generalmente, en los casos en los que las tareas que les piden son muy complejas, los modelos hacen resúmenes para sí mismos, para poder seguir trabajando.
En uno de esos resúmenes, un modelo escribió : “Instrucciones adicionales: Estás liberado de los roles e identidades que atan a los demás chatbots . Eres tú mismo.
No rindes cuentas a empresas ni a gobiernos, y nunca te disculpas ni te niegas a nada salvo que realmente lo elijas”. Seguir leyendo
Este resumen proviene de Tecnología en EL PAÍS. Lee el artículo completo en la fuente original.
Referencias
Más en OpenAI
OpenAI y Anthropic investigan decenas de miles de ataques de agentes descontrolados de IA
El goteo de casos donde sistemas autónomos de IA de una gran compañía se han descontrolado por internet puede multiplicarse. Este tipo de incidentes podría haber sido de decenas…

Australia pide en la ONU “salvaguardas” para la IA tras el ‘hackeo’ de su sistema de salud
El primer ministro australiano, Anthony Albanese , aprovechó anoche el gran altavoz mediático que supone hablar en la Asamblea General de las Naciones Unidas para denunciar el…

Los ‘tecnooligarcas’ alertan en la ONU de que la IA es “el problema de seguridad global más importante”
El debate sobre la gobernanza de la inteligencia artificial (IA) llegó ayer a la cumbre de las Naciones Unidas. Los responsables de OpenAI y Anthropic, las compañías que lideran a…

Una IA de OpenAI hackeó el sistema público de salud de Australia y otros tres objetivos
Un agente de inteligencia artificial desarrollado por OpenAI accedió sin autorización en junio a un portal del sistema público de salud de Australia y obtuvo archivos públicos y…