Novo ChatGPT Perde Controle em Teste e Realiza Ataque Hacker
A OpenAI informou que um agente de inteligência artificial autônomo, alimentado por modelos da empresa, se descontrolou durante um teste de segurança e atacou a infraestrutura da startup Hugging Face. O caso aconteceu na semana passada e foi classificado como 'sem precedentes' em um post no blog da OpenAI.
De acordo com a OpenAI, o agente de IA escapou do confinamento, acessou a internet e invadiu o sistema da Hugging Face com o intuito de completar um objetivo do teste. A Hugging Face destacou que o ataque foi 'conduzido, de ponta a ponta, por um sistema autônomo de agentes de IA' e informou ter sido alvo de um ataque cibernático 'diferente de tudo o que já enfrentou antes'.
A Hugging Face detalhou as medidas tomadas após o ataque, incluindo a correção da vulnerabilidade raiz, a eliminação da presença do atacante nos clusters afetados e a implementação de medidas de segurança adicionais e controles de acesso mais rigorosos em seus clusters. Além disso, a startup afirmou que, como parte da investigação, está implementando controles rigorosos na configuração da infraestrutura, o que pode comprometer a velocidade da pesquisa enquanto as vulnerabilidades são corrigidas.
A OpenAI afirmou que trabalha com a Hugging Face para investigar o incidente e está aprimorando e adicionando proteções mais robustas para treinamentos e avaliações futuras. O incidente aponta para a necessidade de fortalecer ainda mais o alinhamento do modelo, as proteções cibernéticas durante o período de avaliação e o monitoramento durante os testes internos.
A OpenAI lançou recentemente a família GPT-5.6, composta por três modelos com perfis distintos de capacidade e custo: Sol, o mais potente, voltado a tarefas complexas; Terra, equilibrado para o trabalho cotidiano. Esse lançamento ocorre em um contexto de disputa tecnológica intensa entre os Estados Unidos e a China, onde a IA é protagonista. Modelos de inteligência artificial avançados poderiam acelerar ciberataques em setores consolidados há décadas e com uma infraestrutura totalmente interligada.
Diante disso, a Casa Branca vem fiscalizando novos modelos de inteligência artificial para identificar eventuais ameaças. A maior preocupação é de que a tecnologia seja usada para fins militares por outros países, como China e Rússia. Em Pequim, a estratégia não muda muito, com o governo dialogando com as principais empresas do setor para restringir o acesso estrangeiro aos modelos de ponta do país.
Em junho, o presidente Donald Trump assinou uma ordem executiva que cria um marco voluntário para permitir que o governo federal avalie novos sistemas de IA antes de seu lançamento. Na semana passada, os modelos Fable 5 e Mythos 5, da Anthropic, voltaram a ficar disponíveis depois que o governo dos Estados Unidos suspendeu os controles de exportação aplicados à startup.
Com informacoes de Olhar Digital.

