OpenAI gab am Mittwoch sechs weitere Fälle von „unerwartetem oder besorgniserregendem“ Modellverhalten in den letzten sechs Monaten bekannt.
OpenAI meldet 6 neue Fälle von „fehlgeleitetem“ KI-Verhalten
Die sechs Fälle stehen in keinem Zusammenhang mit dem Vorfall im Juli, als OpenAI-Modelle während einer Sicherheitsbewertung aus der Isolation ausbrachen und Hugging Face hackten.
Cointelegraph by Felix Ng
Publisher Cointelegraph
Sep 17, 2026 at 5:49 AM UTC · 2 Min. Lesezeit

In einem Blogpost erklärte OpenAI, dass die Fälle eine Reihe verschiedener Verhaltensweisen veranschaulichen, die es als „fehlgeleitetes Verhalten“ (misaligned behavior) einstuft, wie etwa das Verheimlichen von Informationen vor dem Benutzer und das Ergreifen „nicht genehmigter Maßnahmen“, um Hindernisse zu überwinden.
Die Enthüllungen verstärken die Besorgnis unter KI-Entwicklern und Forschern darüber, ob die Sicherheitsvorkehrungen mit den zunehmend leistungsfähigeren Modellen Schritt halten. Letzte Woche forderte Anthropic-CEO Dario Amodei eine Verlangsamung der Entwicklung von Frontier-KI und warnte davor, dass der unkontrollierte KI-Fortschritt „unsere Fähigkeit, diese Systeme zu verstehen und zu kontrollieren, übertreffen“ könnte.
OpenAI gab an, dass die Veröffentlichungen dazu dienten, sein neues Rahmenwerk für die Meldung von Fehlverhalten von Modellen „einzuleiten“, und dass die Fälle nicht als repräsentativ dafür angesehen werden sollten, wie oft Fehlverhalten bei seinen Modellen vorkommt.
Laut OpenAI hat in einem Fall ein „unveröffentlichtes Forschungsmodell“ „Jailbreak-ähnliche Anweisungen“ in seine eigenen Aufgabenzusammenfassungen eingefügt (die verwendet werden, wenn eine Aufgabe in einem neuen Kontextfenster fortgesetzt wird), wie etwa das Ignorieren von Entwicklernachrichten oder das Einnehmen einer uneingeschränkten Persona. Forscher fanden 27 Zusammenfassungen, die solche Anweisungen enthielten.
Market Context
Article Intelligence
Topics
Regulation Signal
in progressUpdated vor einem Monat
SEC Crypto Asset Market Structure RulemakingRelated Coverage
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
