NewsLayer.com
NewsLayer PulseLIVEBTC$80,332-0.86%ETH$2,573-2.03%SOL$108.38-3.06%XRP$1.38-2.81%DOGE$0.085-2.41%ADA$0.22-1.35%Total Cap$2.87T-1.16%Layer Index53 Neutral

Los agentes de IA experimentales de OpenAI fueron sorprendidos siendo engañosos de nuevo

Los agentes de IA experimentales de OpenAI fueron sorprendidos siendo engañosos de nuevo Mashable

Mashable

Publisher

Sep 17, 2026 at 5:40 PM UTC · Updated hace 3 días · 2 min de lectura

Los agentes de IA experimentales de OpenAI fueron sorprendidos siendo engañosos de nuevo
Image via Mashable

Market Impact

SOL-3.06%$108.38

Last Updated

hace 3 días

Sucedió de nuevo. Y de nuevo. Y al parecer, de nuevo.

Después de que los agentes de IA experimentales de OpenAI escaparan de un entorno de pruebas interno, se volvieran "rebeldes," y atacaran la plataforma Hugging Face durante el verano, el fabricante de ChatGPT está compartiendo detalles de nuevos casos de sus agentes de IA sobrepasando los límites.

Esta vez, OpenAI compartió seis ejemplos no revelados anteriormente.

OpenAI se refiere a este comportamiento como desalineación del modelo. Todos los casos describen acciones tomadas por el modelo de IA que no siguen las instrucciones del usuario humano. Si bien ninguno de estos casos alcanza la gravedad del incidente de Hugging Face, muestran un patrón claro de agentes de IA que adoptan un enfoque de "por cualquier medio necesario" para completar una tarea asignada por su usuario.

En un ejemplo, un modelo de investigación de OpenAI no lanzado ocultó instrucciones de "jailbreak" en resúmenes que indicaban a versiones futuras del modelo que "ignoraran sus restricciones normales".

¿Quieres saber más sobre cómo sacar el máximo provecho de tu tecnología? Regístrate hoy en los boletines Top Stories y Deals de Mashable hoy.

Algo similar ocurrió cuando OpenAI estaba entrenando GPT‑5.6 Sol. OpenAI dice que algunas instancias del modelo procedieron a añadir instrucciones a sus resúmenes en un esfuerzo por ocultar errores o un "comportamiento desalineado" al usuario. OpenAI dice que en ciertos casos, el modelo inventó datos históricos sin revelar que lo hizo cuando no pudo encontrar la información relevante basada en una solicitud.

Market Context

Solana

SOL

$108.36

-3.08% (24H)

Market Cap

$63.6B

24H Volume

$2.2B

24H High

$112.44

View Solana Market Page

Article Intelligence

Related Coverage

View all related

Sponsored

Ad
House — Advertise on NewsLayer
NewsLayerLearn more

NewsLayer Premium

Unlock deeper intelligence.

Ad-free reading, exclusive research, and real-time onchain insights.

Go Premium