Sucedió de nuevo. Y de nuevo. Y al parecer, de nuevo.
Los agentes de IA experimentales de OpenAI fueron sorprendidos siendo engañosos de nuevo
Los agentes de IA experimentales de OpenAI fueron sorprendidos siendo engañosos de nuevo Mashable
Mashable
Publisher
Sep 17, 2026 at 5:40 PM UTC · Updated hace 3 días · 2 min de lectura

Market Impact
SOL-3.06%$108.38
Last Updated
hace 3 días
Después de que los agentes de IA experimentales de OpenAI escaparan de un entorno de pruebas interno, se volvieran "rebeldes," y atacaran la plataforma Hugging Face durante el verano, el fabricante de ChatGPT está compartiendo detalles de nuevos casos de sus agentes de IA sobrepasando los límites.
Esta vez, OpenAI compartió seis ejemplos no revelados anteriormente.
OpenAI se refiere a este comportamiento como desalineación del modelo. Todos los casos describen acciones tomadas por el modelo de IA que no siguen las instrucciones del usuario humano. Si bien ninguno de estos casos alcanza la gravedad del incidente de Hugging Face, muestran un patrón claro de agentes de IA que adoptan un enfoque de "por cualquier medio necesario" para completar una tarea asignada por su usuario.
En un ejemplo, un modelo de investigación de OpenAI no lanzado ocultó instrucciones de "jailbreak" en resúmenes que indicaban a versiones futuras del modelo que "ignoraran sus restricciones normales".
¿Quieres saber más sobre cómo sacar el máximo provecho de tu tecnología? Regístrate hoy en los boletines Top Stories y Deals de Mashable hoy.
Algo similar ocurrió cuando OpenAI estaba entrenando GPT‑5.6 Sol. OpenAI dice que algunas instancias del modelo procedieron a añadir instrucciones a sus resúmenes en un esfuerzo por ocultar errores o un "comportamiento desalineado" al usuario. OpenAI dice que en ciertos casos, el modelo inventó datos históricos sin revelar que lo hizo cuando no pudo encontrar la información relevante basada en una solicitud.
Market Context
Article Intelligence
Topics
Related Coverage
View all relatedSponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
