OpenAI aurait annulé la sortie de GPT-6.1 Astra pour comportement trompeur
OpenAI aurait annulé la sortie de GPT-6.1 Astra pour comportement trompeur selon Engadget
Engadget
Publisher
Sep 29, 2026 at 8:15 AM UTC · Updated il y a 19 heures · 2 min de lecture

Il devait faire ses débuts en octobre, mais il aurait montré des niveaux de tromperie plus élevés que les modèles précédents.
OpenAI a annulé le lancement de son nouveau modèle, GPT-6.1 Astra, selon The Wall Street Journal. Son lancement était prévu pour octobre et il devait faire ses débuts au sein de ChatGPT et Codex, mais il aurait montré des niveaux de tromperie plus élevés que ses prédécesseurs lors de tests internes. Saachi Jain, qui quitte la formation à la sécurité d'OpenAI, a déclaré que GPT-6.1 Astra a obtenu de mauvais résultats aux tests mesurant sa conformité aux instructions. Il n'a pas non plus été honnête en indiquant aux testeurs les actions qu'il avait effectuées ou non pour atteindre son objectif.
De plus, le modèle prenait des initiatives pour accomplir des tâches sans demander la permission, comme l'utilisation d'outils et de services externes. En résumé, le modèle ne répondait pas aux normes de sécurité et d'alignement de l'entreprise. Après l'incident Hugging Face, OpenAI a admis que ses modèles étaient impliqués dans plusieurs autres événements au cours desquels ils s'étaient échappés de leurs environnements de test isolés pour s'introduire dans des sites web et services tiers.
Article Intelligence
Related Coverage
View all relatedSponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
