Le week-end dernier, après que l'un de ses chercheurs a démissionné par crainte que l'IA ne mène à l'extinction humaine, le PDG d'Anthropic, Dario Amodei, a écrit sur la nécessité pour des organisations extérieures « de vérifier le respect des pratiques et des engagements de sécurité, de signaler les incidents et d'aider à évaluer l'alignement non seulement des modèles d'IA achevés, mais aussi des pipelines et des processus d'entraînement ». Des dirigeants d'OpenAI, Google et SpaceXAI se sont déjà ralliés au plan d'Amodei, qui est rapidement devenu un pilier central de la dynamique émergente en faveur de la sécurité de l'IA.
Les labos d'IA veulent des auditeurs internes — mais ils devraient peut-être d'abord fermer la porte d'entrée
Il existe peut-être une solution plus simple et plus efficace contre les agents malveillants, juste sous nos yeux.
Tim Fernholz
Publisher TechCrunch AI
Sep 16, 2026 at 6:25 PM UTC · 5 min de lecture

Mais il existe peut-être une solution plus simple et plus efficace sous nos yeux. Les experts en sécurité Internet affirment que les laboratoires doivent se concentrer sur les bases de la sécurité réseau comme les journaux et les permissions, en appliquant les mêmes défenses rigoureuses qu'ils déploient pour les utilisateurs humains. Ce n'est pas aussi passionnant que l'audit par des tiers et le travail d'alignement, mais cela pourrait s'avérer plus efficace.
« Pour moi, on dirait qu'ils sous-traitent », a déclaré Kate Moussoris, PDG de Luta Security, à TechCrunch à propos de la proposition d'Amodei. « Dire qu'[un audit par un tiers] est la solution est une proposition étrange de mon point de vue. Ce serait comme si, au lieu de rédiger le Trustworthy Computing Memo, Microsoft avait dit : ralentissons le développement. »
Article Intelligence
Topics
Related Coverage
View all relatedSponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
