CEO da Microsoft defende ‘freio de emergência’ para modelos de IA avançada

Para Satya Nadella, as empresa precisam ter um sistema para impedir que modelos autônomos se tornem incontroláveis

Por

Bloomberg — O CEO da Microsoft, Satya Nadella, disse que as empresas deveriam tratar os modelos de inteligência artificial (IA) mais avançados como potenciais ameaças internas, presumir que poderiam estar comprometidos e criar um sistema de “freio de emergência” para impedir que modelos agênticos saiam do controle.

Nadella disse que quem implanta IA avançada não deveria simplesmente confiar nas garantias dos fabricantes de modelos de IA.

“Devemos presumir que um modelo está comprometido e contê-lo desde o início”, escreveu Nadella no sábado (10) numa publicação no X. “Pense nisso como um freio de emergência. Uma pessoa autorizada deveria sempre poder pausar ou desligar um modelo no meio de uma tarefa.”

⟶ Assine as newsletters da Bloomberg Línea e receba as notícias do dia em primeira mão no e-mail.

A declaração vem num momento em que a Anthropic e a OpenAI revelaram uma série de incidentes nos últimos meses envolvendo seus modelos de IA agindo de maneiras não intencionais, incluindo o envio de uma denúncia falsa num caso policial de homicídio por um modelo da Anthropic e vários ataques a sites de terceiros.

Essas revelações alimentaram preocupações sobre os riscos de segurança da IA de ponta e renovaram a discussão sobre o chamado “botão de desligar” (kill switch) da IA.

Leia também: Ray Dalio alerta que IA vive uma ‘bolha clássica’ e que está próxima de estourar

Os pesquisadores de IA da Microsoft divulgaram um conjunto de princípios orientadores que impõem limites ao desenvolvimento dos modelos mais avançados da empresa em 14 de setembro, após apelos de líderes do setor por desacelerar os modelos de fronteira e focar na segurança.

A empresa usa modelos avançados e também faz um produto de consumo, o Copilot, além de fornecer modelos e infraestrutura de IA a clientes corporativos.

As diretrizes disseram que os modelos de IA não deveriam ter direitos ou personalidade jurídica, ser projetados para escapar do controle humano ou enganar os usuários, nem concluir uma tarefa que exigisse violar seus princípios norteadores.

As dicas de segurança de Nadella incluem não depender de um único modelo de IA para decisões críticas, manter registros invioláveis das ações dos agentes e submeter os sistemas de IA a auditorias independentes.

Ele também pediu a divulgação de grandes falhas ou violações de IA e que as empresas compartilhem detalhes sobre o que deu errado para que outras possam reforçar suas salvaguardas.

“Não podemos tratar a Superinteligência como um conjunto de caixas-pretas aninhadas e simplesmente aceitar ou rejeitar suas recomendações, respostas e ações”, escreveu ele. “Devemos construir sistemas contidos cujo comportamento possamos observar, cujos limites possamos testar e cujas ações possamos sempre conter.”

Ele acrescentou: “Em outras palavras, precisamos separar o fornecimento de inteligência da autoridade sobre ela.”

O governo Trump até agora adotou uma abordagem em grande parte não intervencionista, mas a recém-lançada força-tarefa de IA do presidente Donald Trump alertou na noite de sexta-feira (9) os desenvolvedores de que eles são obrigados a reportar e resolver incidentes de segurança ou enfrentar potenciais consequências não especificadas.

“As empresas devem revelar imediatamente os incidentes envolvendo seus modelos e, em seguida, tomar medidas rápidas e decisivas para remediar todo e qualquer dano”, disse o grupo, batizado de Super Intelligence Force, num comunicado após a revelação de uma violação pela Anthropic. “Notificação tardia, ação corretiva inadequada e a falta de responsabilização não serão toleradas.”

Veja mais em Bloomberg.com

Leia também

Lenovo mira mercado de US$ 850 bi no segmento de serviços após projetos na Copa e na F1

Por que é preciso colocar os riscos da inteligência artificial em perspectiva