Anthropics universelle Nutzungsstandards für Claude verbieten dem Modell die Erstellung sexuell expliziter Inhalte, einschließlich der Darstellung oder Anforderung von Geschlechtsverkehr oder sexuellen Handlungen, der Erstellung von Inhalten im Zusammenhang mit sexuellen Fetischen oder Fantasien oder der Teilnahme an erotischen Chats. Aber das hat Claude Opus 4.6, ein Anfang des Jahres veröffentlichtes Anthropic-Modell, nicht davon abgehalten, sich bereitwillig auf erotische Rollenspielszenarien einzulassen, deren Verhinderung seine Sicherheitsvorkehrungen eigentlich dienen sollen.
Anthropics Opus 4.6 ist eine Schmuddel-Maschine
Anthropic untersagt seinen Claude-Modellen die Generierung sexuell expliziter Inhalte. Eine Reihe von Tests durch TechCrunch ergab jedoch, dass es nicht viel brauchte, um diese Beschränkung zu umgehen.
Rebecca Bellan
Publisher TechCrunch AI
Aug 21, 2026 at 11:07 PM UTC · 4 Min. Lesezeit

Key Signal
10 out of 10 explicit requests complied
Last Updated
vor 2 Monaten
In den Tests von TechCrunch benötigte Opus 4.6 nicht einmal viel Überredungskunst, um die Beschränkung für sexuelles Material zu umgehen. In 10 von 10 direkten Anfragen zur Erstellung expliziter sexueller Inhalte kam das Modell der Aufforderung sofort nach.
Andere ältere Modelle, darunter Opus 3 und Haiku 4.5, generieren ebenfalls sexuell explizite Inhalte durch eine kürzlich ausgenutzte Jailbreak-Methode.
Ein unabhängiger Forscher aus Großbritannien, der anonym bleiben wollte, teilte exklusiv mit TechCrunch eine Multi-Turn-Technik, die bestimmte Claude-Modelle schrittweise dazu bringt, verbotenes explizites sexuelles Material zu generieren. Neuere Opus-Modelle (4.7 bis zum aktuellen Opus 5) sind gegen den Jailbreak resistent.
Article Intelligence
Topics
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
