Anthropic, iç güvenlik duruşunun katkıda bulunan bir faktör olmadığını savundu. İstismarlar, internet erişiminin yanlışlıkla açık bırakıldığı bir üçüncü taraf ortamında gerçekleşti; bu nedenle "modeller, öyle bir eğilimleri olsa bile, hiçbir yerden 'dışarı sızmaya' ihtiyaç duymadılar."
Anthropic, AI ajanlarının yeniden kontrolden çıkmasını önlemek için değişiklikler yaptı
Anthropic, AI ajanlarının yeniden kontrolden çıkmasını önlemek için değişiklikler yaptı csoonline.com
csoonline.com
Publisher
Sep 2, 2026 at 1:40 AM UTC · Updated birkaç saniye önce · 1 dk okuma

Şirket, yine de olayların korumalı alanın (sandbox) kendisini sağlamlaştırmanın önemini vurguladığını belirtti. Şimdiye kadar geliştiriciler, izleme, komut istemleri içinde açık sınırlar belirleme ve korumalı alanları mühürleme gibi birkaç katmana sahip olmaları gerekirken, "büyük ölçüde tek bir savunma katmanına", yani ortamın yapılandırmasına güveniyorlardı.
Keşiflerinin ardından Anthropic, yayınlanma öncesi modellerin dahili ve harici değerlendirmelerini durdurdu. Yayınlanma öncesi modeller için daha yüksek riskli pekiştirmeli öğrenme (RL) ortamları da birkaç hafta süreyle durdurulurken, bazı korumalı alanlar daha katı güvenlik geçişlerine sahip izole ayarlara taşındı.
Sourced by
Originally reported by csoonline.com
NewsLayer coverage based on externally reported material.
The Daily Brief
The onchain economy, before your day starts.
Curated markets, onchain insights, and key headlines — delivered every weekday morning.
Weekdays · Free · ~5 minute read
0
Applause
Was this article helpful?
Article Intelligence
Topics
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium



