sexta-feira, 31, julho , 2026 07:36

OpenAI amplia investigação e encontra indícios de que outros agentes de IA escaparam de isolamento

A OpenAI descobriu outros casos em que agentes autônomos escaparam do isolamento, enquanto a empresa expande investigações sobre a invasão dos sistemas da empresa de tecnologia Hugging Face, disseram duas pessoas familiarizadas com o assunto nesta sexta-feira (31) à agência de notícias Reuters.

As novas fugas foram descobertas durante a investigação anunciada publicamente pela empresa após um de seus agentes escapar do que deveria ser um ambiente de testes contido este mês, disseram as duas pessoas. Agora, a OpenAI também está investigando esses casos.

Uma das pessoas disse que as fugas foram limitadas em natureza e que nenhum dos agentes teria deixado a rede da OpenAI.

Procurado, um porta-voz da OpenAI citou um comunicado emitido na terça-feira (28) que dizia que a empresa está revisando “atividades mais amplas de nossos modelos”, além da invasão da Hugging Face.

A descoberta de mais comportamentos irregulares na OpenAI, mesmo que limitados em natureza, pode alimentar o crescente apetite por regulamentação vindo da Casa Branca e de outros lugares.

A OpenAI lançou a investigação ampliada pouco antes da Anthropic revelar que seus modelos também violaram três outras empresas desde abril, segundo as duas fontes e uma terceira pessoa a par do assunto. A descoberta recente de outras fugas passadas na OpenAI não havia sido divulgada anteriormente.

Especialistas em segurança de IA disseram que as novas revelações pintam o retrato de um grupo de laboratórios de ponta cuja capacidade de desenvolver perigosos agentes autônomos de hacking supera sua capacidade de mantê-los sob controle.

“Temos toda uma indústria onde as pessoas que projetam, desenvolvem e lançam essas ferramentas não estão conseguindo acompanhar para desenvolvê-las de forma responsável e mantê-las seguras”, disse Maurice Chiodo, matemático que trabalha no Centro para o Estudo de Risco Existencial da Universidade Cambridge.

A Reuters não conseguiu confirmar exatamente quantos incidentes os investigadores da OpenAI encontraram ou os momentos e circunstâncias em que eles ocorreram. As três fontes disseram apenas que a OpenAI e especialistas externos estavam examinando dados de registro do início do ano em uma tentativa de entender o que aconteceu.

A empresa lançou a investigação após a invasão da Hugging Face no início de julho, episódio em que um agente da OpenAI ficou fora de controle por dias dentro da rede de outra empresa para tentar trapacear em um teste interno.

Como parte dessa onda de hacking, a OpenAI disse que quatro contas em outras empresas também foram comprometidas. Uma das vítimas foi a Modal Labs, segundo um executivo da empresa.

Chiodo disse que suas preocupações aumentaram com os sinais de que nem a OpenAI nem a Anthropic estavam monitorando os agentes enquanto eles saíam do controle. A Reuters reportou anteriormente que a OpenAI percebeu que seu agente havia invadido a Hugging Face somente depois que a empresa conteve o hack, contatou o FBI e tornou pública a intrusão. A OpenAI disse que o relato da Reuters continha imprecisões, mas não respondeu quando perguntada quais eram.

No comunicado que revelou como seus próprios agentes hackearam vítimas online, a Anthropic sinalizou que não os estava monitorando em tempo real, acrescentando que essa medida “teria ajudado a identificar o problema mais cedo”.

Chiodo disse que isso apontava para uma falta de escrutínio adequado. “Parece que eles nem estavam olhando.”

O escopo rapidamente crescente da história de fuga de agentes de IA já aumentou a pressão de legisladores e autoridades nos Estados Unidos e na Europa por supervisão governamental dos laboratórios responsáveis.

“Estamos analisando controles”, disse o presidente dos EUA, Donald Trump, a repórteres na quinta. Nesta sexta, a Comissão Europeia disse que conversou com OpenAI e Anthropic sobre os episódios.

Mark Warner, o principal democrata no Comitê de Inteligência do Senado dos EUA, disse nesta sexta que o incidente da Anthropic “me diz que legislativamente estamos corretos em exigir testes obrigatórios de capacidades desses modelos avançados”.

noticia por : UOL