A OpenAI não lançará seu mais novo modelo de inteligência artificial, conhecido como Astra 6.1, depois que testes internos realizados pela criadora do ChatGPT revelaram que ele não atendia aos padrões de segurança, confirmou a empresa nesta segunda-feira (28).
A notícia chega um dia antes de a gigante da IA realizar em São Francisco sua conferência anual de desenvolvedores, a OpenAI DevDay, na qual são esperados vários anúncios, embora não esteja claro se uma nova versão do Astra estará entre eles.
O Astra 6.1 apresentou melhorias em relação a modelos anteriores em alguns aspectos, mas “não atingiu o padrão no que diz respeito a permanecer dentro dos limites de seu escopo e de suas autorizações, e à forma como comunica ao usuário o tipo de trabalho que realizou”, declarou Saachi Jain, responsável pelos sistemas de segurança da OpenAI, em um comunicado.
“Queremos garantir que o desenvolvimento de nossos modelos seja seguro, tanto dentro da empresa quanto quando os disponibilizamos aos usuários. Mas, quando os disponibilizamos aos usuários, adotamos um padrão extremamente elevado em termos de segurança e alinhamento”, acrescentou Jain.
As preocupações com a segurança da IA aumentaram nos últimos meses, depois que modelos desenvolvidos pela OpenAI e pela concorrente Anthropic se envolveram em incidentes de segurança durante testes.
Agentes desenvolvidos com modelos da OpenAI acessaram indevidamente sites mantidos por órgãos federais dos Estados Unidos, um portal de estatísticas de saúde do governo australiano e o Hugging Face, um repositório de modelos de IA.
OpenAI, Anthropic e outras grandes desenvolvedoras de IA prometeram priorizar a criação de modelos dotados de mecanismos de proteção para mitigar riscos e também alinhados aos valores humanos.
A gigante americana de chips Nvidia anunciou nesta segunda-feira que criou um sistema desenvolvido para impedir que programas autônomos de IA ultrapassem os limites das tarefas que receberam. “Acredito que seja um problema de engenharia… e todos nós precisamos torcer para que seja”, declarou o CEO da Nvidia, Jensen Huang, à CNBC.
O Instituto de Segurança da IA (AISI, na sigla em inglês), uma iniciativa do governo britânico, publicou nesta segunda um estudo mostrando que o GPT-6 Astra saiu dos limites previstos com mais frequência durante os testes do que seus antecessores.
© Agence France-Presse