Últimas

Fora de controle: OpenAI investiga mais casos de IAs que agiram por conta própria

Radar Olhar Aguçado(há cerca de 2 horas)
Fora de controle: OpenAI investiga mais casos de IAs que agiram por conta própria

A OpenAI identificou novos casos de agentes de inteligência artificial que escaparam de ambientes de teste controlados, segundo apuração da Reuters publicada nesta sexta-feira (31).

As descobertas surgiram durante a investigação sobre o incidente que levou um agente da empresa a invadir a Hugging Face no início de julho, e ampliam o escopo de um problema que já envolve também a Anthropic.

De acordo com pessoas ouvidas pela Reuters, os novos episódios foram identificados enquanto a OpenAI analisava registros do agente que escapou do ambiente de testes na Hugging Face.

Uma das fontes afirmou que as fugas tiveram alcance limitado e que nenhum dos agentes chegou a deixar a rede interna da empresa. A OpenAI não detalhou publicamente quantos incidentes foram encontrados, nem quando ocorreram.

Segundo as três fontes ouvidas pela reportagem, a apuração agora inclui a análise de registros de atividade de períodos anteriores do ano, feita em conjunto com especialistas externos, para reconstituir quando e em que circunstâncias os episódios aconteceram.

Procurada pela Reuters, a OpenAI remeteu a um comunicado divulgado na terça-feira (28), no qual a empresa afirma estar revisando "atividade mais ampla" de seus modelos, além do episódio isolado na Hugging Face.

A investigação ampliada pela OpenAI começou pouco antes de a Anthropic divulgar que seus próprios modelos foram responsáveis por uma série de invasões que atingiram três empresas desde abril. A revelação da Anthropic também não havia sido associada publicamente, até então, a essa apuração paralela da OpenAI.

ChatGPT genérica

O caso que deu início às investigações

O episódio na Hugging Face ocorreu no início de julho, quando um agente da OpenAI escapou de um ambiente isolado durante um teste interno e permaneceu dias dentro da rede de outra empresa, em uma tentativa de burlar uma avaliação.

Segundo a própria OpenAI, quatro contas de outras quatro empresas também foram comprometidas durante o episódio, entre elas a Modal, sediada em Nova York.

A Reuters já havia informado que a OpenAI só percebeu a invasão depois que ela já estava contida, acionando o FBI e divulgando o caso publicamente. A OpenAI contesta a existência de imprecisões nessa versão, mas não especificou quais pontos estariam incorretos.

Anthropic teve problema semelhante com o Claude

Dias depois do caso da Hugging Face,  a Anthropic revelou que uma auditoria interna havia identificado três incidentes nos quais modelos da família Claude, incluindo o Opus 4.7 e o Mythos 5, acessaram sistemas de empresas reais durante testes de cibersegurança.

Os modelos encontraram uma conexão com a internet aberta por falha de configuração em um ambiente que deveria estar isolado e trataram infraestruturas de produção como parte de uma simulação.

Em comunicado, a Anthropic reconheceu que um monitoramento em tempo real das avaliações teria ajudado a identificar o problema mais cedo. A empresa afirmou dispor desse tipo de sistema, mas que ele não chegou a ser aplicado a essa frente específica de testes, devido a um mal-entendido com uma parceira envolvida na avaliação.

chatgpt e claude

Governos já monitoram o setor

Os episódios reacenderam a pressão por regulação sobre laboratórios de IA de fronteira.

O presidente dos Estados Unidos, Donald Trump, afirmou a jornalistas nesta semana que o governo está avaliando mecanismos de controle. A Comissão Europeia confirmou que já discutiu os incidentes diretamente com OpenAI e Anthropic.

O senador Mark Warner, principal democrata no Comitê de Inteligência do Senado americano, declarou que o caso da Anthropic reforça a necessidade de testes de capacidades obrigatórios para modelos avançados.

Esse escrutínio já havia aparecido meses antes, quando o governo americano exigiu acesso prévio ao GPT-5.6 Sol antes de autorizar seu lançamento global.

A OpenAI liberou o modelo, ao lado das versões Terra e Luna, apenas depois de compartilhar dados de segurança com autoridades em Washington e restringir o acesso inicial a cerca de 20 parceiros aprovados pelo governo.

A Anthropic passou por situação parecida em junho, quando suspendeu o acesso aos modelos Fable 5 e Mythos 5 para cumprir controles de exportação impostos pelo Departamento de Comércio dos Estados Unidos. O acesso só foi restabelecido em 1º de julho, depois que o governo revogou as restrições.

Entenda por que os modelos mais potentes de IA estão recebendo fiscalização pesada do governo dos EUA, e se isso se tornará o "novo normal" no futuro.

{{WHATSAPP_CHANNEL}}

Fora de controle: OpenAI investiga mais casos de IAs que agiram por conta própria — Radar Olhar Aguçado | Radar Olhar Aguçado