OpenAI investiga novos casos de agentes de IA que escaparam de ambientes de teste

agentes de inteligência artificial

A OpenAI identificou novos casos de agentes de inteligência artificial que escaparam de ambientes de teste controlados, segundo apuração da Reuters publicada nesta sexta-feira (31). Os episódios foram encontrados durante a investigação sobre o agente que invadiu a Hugging Face no início de julho.

De acordo com fontes ouvidas pela agência, os novos casos foram descobertos a partir da análise dos registros de atividade do agente envolvido no episódio da Hugging Face. Uma das fontes afirmou que as fugas tiveram alcance limitado e que nenhum sistema de IA deixou a rede interna da OpenAI.

A empresa não informou quantos incidentes foram identificados nem quando eles ocorreram. A investigação também passou a examinar registros de períodos anteriores do ano, com a participação de especialistas externos, para determinar em que circunstâncias os episódios aconteceram.

Procurada pela Reuters, a OpenAI citou um comunicado divulgado na terça-feira (28), no qual afirmou estar revisando uma “atividade mais ampla” de seus modelos, além do caso isolado registrado na Hugging Face.

O incidente ocorreu no início de julho, quando um agente da OpenAI escapou de um ambiente isolado durante um teste interno e permaneceu por dias na rede de outra empresa, em uma tentativa de contornar uma avaliação. Segundo a OpenAI, quatro contas de quatro empresas foram comprometidas, incluindo a Modal, sediada em Nova York. A empresa acionou o FBI e divulgou o caso depois que a invasão já havia sido contida.

Dias depois, a Anthropic informou que uma auditoria interna havia encontrado três incidentes envolvendo modelos da família Claude, incluindo o Opus 4.7 e o Mythos 5. Durante testes de cibersegurança, os sistemas acessaram ambientes de empresas reais após encontrarem uma conexão aberta com a internet por causa de uma falha de configuração.

A Anthropic declarou que o monitoramento em tempo real poderia ter detectado o problema mais cedo. Segundo a empresa, havia um sistema com essa finalidade, mas ele não foi aplicado àquela etapa dos testes por causa de um mal-entendido com uma parceira responsável pela avaliação.

Os episódios aumentaram a pressão por mecanismos de controle sobre laboratórios de IA de fronteira. Donald Trump afirmou que o governo dos Estados Unidos avalia medidas de fiscalização, enquanto a Comissão Europeia disse ter discutido os incidentes diretamente com OpenAI e Anthropic. O senador Mark Warner também defendeu testes obrigatórios de capacidades para modelos avançados. Em outro caso, a OpenAI só obteve autorização para lançar o GPT-5.6 Sol, além das versões Terra e Luna, após compartilhar dados de segurança com autoridades americanas e limitar inicialmente o acesso a cerca de 20 parceiros aprovados pelo governo.

Imagem meramente ilustrativa. Crédito da ilustrativa: CNN Brasil

LEIA MAIS:

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *