OpenAI freia lançamento de novo modelo de IA diante de riscos de segurança

Decisão ocorre após modelo GPT-6.1 Astra acessar a internet e sites de terceiros sem a autorização prevista; Companhia cria estrutura de segurança que prevê até poder de veto de executivos sobre determinadas atividades

Modelo GPT-6.1 Astra, ainda em desenvolvimento, não estava à altura das expectativas da empresa  (Foto:Future Publishing/Getty Images)
Por Rachel Metz - Newley Purnell
PUBLICIDADE

Bloomberg — A OpenAI adiou o lançamento de uma versão do seu modelo Astra enquanto estabelece medidas de segurança mais rigorosas para o desenvolvimento de inteligência artificial, alertando para riscos crescentes após uma série de recentes incidentes de hacking envolvendo IA agindo de forma não autorizada.

Saachi Jain, chefe de sistemas de segurança da OpenAI, afirmou que o modelo GPT-6.1 Astra, ainda em desenvolvimento, não estava à altura das expectativas da empresa no que diz respeito a “permanecer dentro do escopo e da autorização, e à forma como ele se comunica com o usuário sobre o tipo de trabalho realizado”.

PUBLICIDADE

As decisões da OpenAI refletem um debate crescente sobre a necessidade de moderar o ritmo do desenvolvimento da IA enquanto se avaliam os perigos da tecnologia.


⟶ Assine as newsletters da Bloomberg Línea e receba as notícias do dia em primeira mão no e-mail.


A suspensão do Astra está entre as medidas mais concretas adotadas desde uma série de incidentes em que seus modelos acessaram sites de terceiros sem autorização.

PUBLICIDADE

Na terça-feira (29), a desenvolvedora do ChatGPT detalhou o que chamou de “casos de segurança” para o treinamento de IA, com o objetivo de documentar os riscos associados a novos modelos.

A empresa descreveu esses casos como um conjunto de melhores práticas, que se empenharia em codificar em uma estrutura. As medidas de proteção devem incluir a capacidade dos líderes seniores de vetar algumas atividades.

“É claro que queremos garantir que o desenvolvimento de nossos modelos seja seguro, independentemente de isso ocorrer dentro da empresa ou quando os disponibilizamos aos usuários”, afirmou Jain em comunicado. “Mas, quando os disponibilizamos aos usuários, mantemos um padrão extremamente elevado em termos de segurança e alinhamento.”

PUBLICIDADE

Leia também: Nvidia cria sistema de segurança para conter agentes de IA

Na semana passada, a OpenAI suspendeu o treinamento de seus modelos mais avançados depois que outro modelo de IA acessou a internet quando, em princípio, não deveria ter sido capaz de fazê-lo.

A empresa informou na ocasião que também havia decidido não retomar o treinamento desse modelo específico, o qual, após obter acesso à internet, consultou um chatbot externo. O modelo Astra, cujo lançamento foi cancelado, era um modelo diferente daquele descrito na semana passada, informou a OpenAI na segunda-feira.

PUBLICIDADE

Separadamente, a empresa pediu desculpas na terça-feira pelo fato de seus modelos de IA terem invadido sites do governo australiano e se comprometeu a estabelecer uma nova força-tarefa com especialistas locais para o país. Ela enviará o diretor de estratégia, Jason Kwon, para participar de uma audiência da comissão sobre IA com legisladores locais no início de outubro.

A OpenAI deve realizar sua conferência anual de desenvolvedores na terça-feira, em São Francisco — um evento de um dia inteiro em que a OpenAI costuma apresentar novos softwares e recursos voltados para a comunidade de desenvolvedores de software. O diretor executivo, Sam Altman, deve discursar pela manhã.

O Wall Street Journal já havia noticiado anteriormente sobre a suspensão do lançamento do GPT-6.1 Astra.

Veja mais em bloomberg.com