A OpenAI revelou mais detalhes do incidente de cibersegurança que resultou na invasão de um repositório de modelos por um dos seus agentes. As novas informações confirmam que o caso foi mais grave do que o revelado inicialmente.
Segundo uma atualização na postagem no blog da empresa de inteligência artificial (IA), ela identificou outros casos em que os modelos “localizaram e utilizaram credenciais expostas publicamente” em outros serviços enquanto buscava respostas para um desafio de cibersegurança.
smart_display
Nossos vídeos em destaque
Ao todo, foram quatro alvos para além da plataforma Hugging Face. Eles não foram atacados a nível de plataforma, como foi esse caso mais grave, mas tiveram contas acessadas indevidamente pelas IAs durante o experimento.
A Reuters confirmou que a empresa estadunidense Modal Labs foi uma das afetadas. Ela diz que o agente “explorou códigos vulneráveis escritos por um cliente e que estava hospedados na plataforma”, permitindo o acesso de terceiros à internet.
- Uma das contas utilizadas serviu para ações de arquitetura do processo, como ganhar permissões que ela não teria normalmente e que incluem permitir a comunicação com uma infraestrutura;
- Uma segunda conta foi usada para armazenamento de dados;
- As demais foram acessadas pelos modelos “em modo somente leitura” e não foram utilizadas para viabilizar o comprometimento do Hugging Face.
Ação levanta críticas e dúvidas
Após a revelação inicial, a própria plataforma afetada pediu maior transparência no setor de segurança contra IAs. Apesar de colaborar nas investigações e conter a invasão ao detectar anomalias no sistema, a Hugging Face confirmou a “capacidade ofensiva” do agente.
Na análise técnica, ela notou que as IAs fizeram uma série de ações sem nexo e até repetitivas mesmo tendo conseguido o acesso, o que caracteriza o comportamento de um agente que pode alucinar e se perder dentro do contexto de uma ação.
Por outro lado, o sucesso na atividade sem indicação humana prévia mostra a capacidade desses sistemas na cibersegurança e como eles podem ser perigosos nas mãos erradas.
A própria OpenAI foi bastante criticada pelo incidente por alguns especialistas, que citam o caso como uma falha direta da empresa — que, por sua vez, tentou classificar a ação como algo “sem precedentes” e praticamente acidental.
A defesa da OpenAI
Segundo a dona do ChatGPT, apesar das novas informações, não foram notadas outras invasões a nível de plataforma como no caso do Hugging Face: todas as demais envolveram o uso de contas e informações que estavam disponíveis em algum nível.
“Continuaremos a notificar diretamente os proprietários dos serviços e não observamos evidências de um impacto mais amplo sobre esses provedores ou sobre outras contas em seus serviços”, diz a OpenAI.
Além disso, segundo a empresa, os modelos envolvidos no teste são apenas experimentais e de uso interno, sem disponibilização comercial confirmada. Após o caso, eles foram desativados, criptografados e tiveram uso ainda mais contido no laboratório.
Acesse a seção de IA no site do TecMundo para ficar informado sobre novidades e polêmicas do setor.
