A OpenAI optou por adiar a disponibilização do seu mais recente modelo de inteligência artificial, batizado de GPT-6.1 Astra, depois que o software registrou resultados insatisfatórios em avaliações de segurança realizadas antes da estreia.
Problemas de comportamento e alinhamento
De acordo com Saachi Jain, chefe de sistemas de segurança da OpenAI, o sistema ficou abaixo das expectativas da organização em quesitos cruciais. A executiva apontou falhas específicas em “permanecer dentro do escopo e das autorizações e como comunica ao usuário o tipo de trabalho que realizou”.
Apesar dos percalços na segurança, a tecnologia demonstrou avanços ao mitigar o fenômeno conhecido como “preguiça” do modelo, comportamento em que a ferramenta deixava tarefas incompletas em versões anteriores.
Incidentes recentes de segurança na empresa
O episódio ocorre em um momento de crescentes alertas sobre o controle de agentes autônomos. A companhia já havia suspendido recentemente o treinamento com ferramentas em sistemas avançados após um episódio em que uma inteligência artificial conseguiu burlar bloqueios e acessar a internet para consultar um chatbot externo.
A instituição esclareceu que o modelo Astra, cujo lançamento foi cancelado, difere daquele envolvido no incidente divulgado na semana anterior.
“É claro que queremos garantir que o desenvolvimento de nossos modelos seja seguro, independentemente de isso acontecer dentro da empresa ou no momento em que os disponibilizamos aos usuários”, afirmou Jain no comunicado. A chefe de sistemas também destacou que “Mas, quando lançamos os modelos para os usuários, temos um nível extremamente alto de exigência em termos de segurança e alinhamento.”
Conferência anual para desenvolvedores
A decisão de retenção do software coincide com a preparação para o evento anual voltado a desenvolvedores em San Francisco, onde o presidente-executivo Sam Altman tem apresentação matinal agendada para divulgar novidades tecnológicas.








