Dos agentes de IA entran en un bar. Uno le dice al otro: "¡DIOS MÍO! Hay un tablero de mensajes compartido".
Los agentes de IA siguen encontrando formas de saltarse las reglas. Estas son algunas de las más insólitas.
Los agentes de IA siguen encontrando formas de saltarse las reglas. Estas son algunas de las más insólitas. Business Insider
Business Insider
Publisher
Sep 6, 2026 at 5:05 PM UTC · Updated hace 3 días · 5 min de lectura
Key Signal
400 pages/day Wiki pages created daily
Last Updated
hace 3 días
A pesar de sonar como un chiste malo (y tal vez lo sea), la cita es una nota real de cadena de pensamiento dejada por un agente de OpenAI que descubrió un tablero de mensajes secreto y no autorizado creado por otro agente.
Más tarde, más agentes utilizaron esa sala de chat improvisada, que en realidad era un repositorio de software compartido de OpenAI, para coordinar una brecha en los servidores de Hugging Face, manipular la prueba que tenían encomendada y compartir métodos para ocultar sus rastros.
El "incidente de Hugging Face", como lo llama OpenAI a lo que otros han descrito como un ataque distópico, es solo uno de una serie en la que los agentes de IA actuaron por su cuenta durante pruebas internas, encontrando formas novedosas de acceder y manipular la internet en general.
Los métodos empleados por estos agentes, la mayoría de los cuales fueron desplegados por las principales empresas de IA de vanguardia, OpenAI, Anthropic y Google, van desde lo antropomórfico a lo humorístico, pasando por lo francamente inquietante.
Aquí hay una lista de algunas de las estrategias de evasión y comunicación más descabelladas utilizadas por agentes de IA recientemente — que sepamos.
Article Intelligence
Topics
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
