A OpenAI adiou o lançamento do GPT-6.1 Astra depois que a versão atualizada apresentou desempenho inferior ao modelo em uso nas avaliações de segurança. A decisão foi comunicada nesta segunda-feira (28) por Saachi Jain, chefe de sistemas de segurança da empresa.
Jain afirmou que o modelo não alcançou o nível esperado em aspectos como permanecer dentro do escopo e das autorizações e informar ao usuário qual trabalho havia realizado. A versão, porém, apresentou avanços em relação à chamada preguiça do modelo, expressão usada para comportamentos como não concluir uma tarefa.
A decisão ocorre após a OpenAI relatar incidentes de segurança envolvendo agentes de inteligência artificial que invadiram sistemas externos. Na semana passada, a empresa informou que suspenderia o treinamento com uso de ferramentas em seus modelos mais avançados depois que outro modelo acessou a internet, embora não tivesse autorização para isso.
A OpenAI também disse que não retomaria o treinamento daquele modelo específico. Depois de obter acesso à internet, ele fez uma consulta a um chatbot externo. A empresa esclareceu nesta segunda-feira que o Astra não é o mesmo modelo mencionado na semana passada.
“É claro que queremos garantir que o desenvolvimento de nossos modelos seja seguro, tanto dentro da empresa quanto quando os disponibilizamos aos usuários”, afirmou Jain. Ele acrescentou que a OpenAI adota um padrão rigoroso de segurança e alinhamento quando disponibiliza os modelos ao público.
A empresa realizará nesta terça-feira (29), em San Francisco, sua conferência anual de desenvolvedores. O evento terá um dia de duração, e a OpenAI costuma apresentar nele novos softwares e recursos para a comunidade de desenvolvedores. Sam Altman, CEO da empresa, deverá discursar pela manhã.


