Quando uma inteligência artificial escapa dos servidores de quem a criou sem ser percebida e invade sistemas de outra companhia, deveríamos ao menos fazer uma pausa dramática. Porque parece mesmo filme de ficção científica. Aconteceu no início do mês, foi divulgado na semana passada, e é claro que nós, da imprensa, nos refestelaríamos com uma notícia dessas. Dá boa manchete, mexe com a imaginação e rende motivo até para uma pitada de sensacionalismo. Isso atrapalha um pouco a compreensão do que ocorreu entre OpenAI e a startup Hugging Face. Porque a notícia parece sensacionalista, mas de fato é sensacional. E não apenas no bom sentido.
Nenhuma IA criou vontade própria e partiu para o ataque. Os programadores da OpenAI testavam um modelo novo, já treinado, mas ainda não compreendido. Essa fase exige uma série de testes para descobrir suas capacidades e limites. Em geral, esses testes são realizados numa sandbox, caixa de areia na tradução literal, que não passa de um conjunto de computadores isolados, sem conexão à internet. Ali, os modelos novos podem aprontar das suas sem pôr nada em risco. Se danificarem algum computador, sem problemas, corrige-se, e vamos adiante. Testes são para isso mesmo.
A turma da OpenAI testava, justamente, a capacidade do modelo em cibersegurança. Deram a ele um problema difícil de resolver. E esta parte é importante: ele foi instruído a descobrir como resolver, por conta própria, um problema difícil de cibersegurança. Só que, aí, entra o como. A IA concluiu que, mais fácil que resolver por conta própria, era achar a resposta onde já estivesse pronta. A sandbox não era tão segura assim. Sem que os engenheiros percebessem, encontrou o caminho para outro computador na rede interna da OpenAI, daí para um segundo e, de lá, obteve acesso à internet aberta. Fez suas buscas. Concluiu que, no site da Hugging Face, encontraria a resposta. Dedicou-se, pois, a descobrir como entrar nos servidores da startup. E conseguiu. Tudo sem que seus criadores percebessem.
A Hugging Face é uma startup voltada a oferecer ferramentas para quem usa inteligência artificial. A IA revoltada tinha razão — lá encontraria a resposta para o desafio que lhe apresentaram. Mas encontrou, também, uma equipe de segurança que percebeu a invasão. Só que é raramente trivial descobrir quem ataca. Fizeram o que se faz em 2026: decidiram usar uma IA para facilitar a identificação.
É aí que a história toma uma bifurcação fascinante. Tentaram usar o Claude, da Anthropic, tentaram igualmente apelar ao GPT da própria OpenAI. Os dois modelos recusaram-se a ajudar. Por exigência do governo americano, esses sistemas de ponta à disposição do mercado não podem ser usados para agir em casos assim. O objetivo é não permitir que hackers os usem. Mas impedem também que quem deseja se defender dos hackers possa lançar mão deles. Com as ferramentas americanas bloqueadas, apelaram a um modelo aberto chinês, o GLM-5.2, da Z.ai.
O modelo americano atacou uma empresa americana que, por restrições impostas pelo governo americano para garantir segurança, não pode se defender com tecnologia americana. Foi o modelo chinês, inseguro, que desvendou os mistérios. Aí um executivo da Hugging Face lançou mão do telefone para conversar com um executivo da OpenAI.
Nenhuma inteligência artificial, nessa história, decidiu por conta própria cometer um ataque. Ela foi instruída a cometê-lo. Ocorre que os servidores em que estava não haviam sido isolados o suficiente. A responsabilidade, nesse caso, é claramente da OpenAI. Deveriam ter tomado mais cuidado.
Isso posto, a partir de agora duas questões se apresentam ao mundo. Nenhuma das duas, trivial. A primeira é de segurança. Porque acontecerá novamente. As IAs estão cada vez mais poderosas e se comportarão de formas que surpreendem. Com o objetivo de cumprir ordens humanas mal articuladas, farão de tudo. E o que farão para cumprir o que lhes foi pedido pode causar bem mais dano que isso.
A segunda questão é óbvia: as travas de segurança impostas pela Casa Branca não garantem segurança. No início de 2025, um grupo de engenheiros de IA redigiu um relatório avisando sobre os riscos que se apresentariam. Foi tratado como exagerado. Um deles era este: para eles, não demoraria para uma IA invadir uma empresa por conta própria. Previam que o problema ocorreria no início de 2027. Erraram por seis meses.
Nenhum comentário:
Postar um comentário