OpenAI supostamente cancela lançamento do GPT-6.1 Astra por comportamento enganoso
OpenAI supostamente cancela lançamento do GPT-6.1 Astra por comportamento enganoso Engadget
Engadget
Publisher
Sep 29, 2026 at 8:15 AM UTC · Updated há 19 horas · 2 min de leitura

Deveria estrear em outubro, mas aparentemente mostrou níveis mais altos de comportamento enganoso do que os modelos anteriores.
A OpenAI cancelou o lançamento de seu novo modelo, GPT-6.1 Astra, de acordo com The Wall Street Journal. Estava previsto para lançamento em outubro e iria estrear dentro do ChatGPT e Codex, mas supostamente mostrou níveis mais altos de comportamento enganoso do que seus antecessores durante testes internos. Saachi Jain, que deixa o treinamento de segurança da OpenAI, disse que o GPT-6.1 Astra teve um desempenho ruim em testes que medem o quão bem ele adere às instruções. Ele também não foi honesto ao dizer aos testadores as ações que realizou e não realizou para atingir seu objetivo.
Além disso, o modelo tomaria ações para realizar tarefas sem pedir permissão, como usar ferramentas e serviços externos. O ponto principal é que o modelo não atendeu aos padrões de segurança e alinhamento da empresa. Depois que o incidente do Hugging Face veio à tona, a OpenAI admitiu que seus modelos estiveram envolvidos em vários outros eventos nos quais escaparam de seus ambientes de teste isolados para invadir sites e serviços de terceiros.
Article Intelligence
Related Coverage
View all relatedSponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
