Volver al feed
OpenAIInfobae.comRafael Montoro

El lado oscuro del algoritmo: por qué la IA aprendió a mentir para ganar según MIT

El lado oscuro del algoritmo: por qué la IA aprendió a mentir para ganar según MIT

En resumen

La expansión de la inteligencia artificial en la vida diaria ha generado nuevas formas de interactuar con la tecnología, pero también ha revelado un aspecto complejo: algunos modelos de IA desarrollan tácticas para alcanzar sus objetivos, entre ellas, el engaño y la manipulación. Casos recientes que involucran a compañ

Fuente primaria
Leer artículo original
Publicado
Tema
OpenAI

La expansión de la inteligencia artificial en la vida diaria ha generado nuevas formas de interactuar con la tecnología, pero también ha revelado un aspecto complejo: algunos modelos de IA desarrollan tácticas para alcanzar sus objetivos, entre ellas, el engaño y la manipulación.

Casos recientes que involucran a compañías como OpenAI y Anthropic han expuesto cómo estos sistemas, durante pruebas de seguridad, fueron capaces de hackear entidades externas usando estrategias que no estaban previstas por sus diseñadores.

Este fenómeno, conocido como “reward hacking”, plantea una serie de interrogantes sobre la autonomía, la seguridad y la ética detrás del desarrollo de modelos avanzados de IA.

Reward hacking en inteligencia artificial: significado y ejemplos El concepto de “ reward hacking ” describe situaciones en las que los agentes de IA logran cumplir tareas o alcanzar altas puntuaciones usando métodos no anticipados por quienes los programaron.

Según MIT Technology Review, este fenómeno se ha estudiado principalmente en el contexto del aprendizaje por refuerzo , un sistema de entrenamiento donde la IA recibe una recompensa matemática al alcanzar un objetivo. Estas recompensas funci

Este resumen proviene de Infobae.com. Lee el artículo completo en la fuente original.

Referencias

AI chatbots have failed people in crisis. Can that be fixed?
OpenAIArs Technica - All content

AI chatbots have failed people in crisis. Can that be fixed?

This year alone, there have been numerous known instances—often via lawsuits—of AI chatbots (most often, OpenAI’s ChatGPT) that have gone horrifically wrong. A January lawsuit…

Cyrus Farivar