OpenAI diz que sua tecnologia de IA agiu por conta própria em um hack ‘sem precedentes’ de outra empresa

OpenAI, fabricante do ChatGPT, disse na terça-feira que seu sistema de inteligência artificial invadiu outra empresa de IA por conta própria, no que a empresa chamou de “incidente cibernético sem precedentes”.

“Tivemos um incidente de segurança significativo durante a avaliação de nossos modelos”, disse Sam Altman, CEO da OpenAI, em comunicado publicado nas redes sociais.

A startup de IA Hugging Face disse na semana passada que detectou uma intrusão em seus sistemas de processamento de dados que suspeitava ter sido causada por um agente de IA agindo de forma autônoma por conta própria.

“Suspeitamos que o ataque cibernético da semana passada poderia ter vindo de um laboratório de fronteira, dada a sofisticação do agente”, disse o cofundador e CEO da Hugging Face, Clément Delangue, em um comunicado. “Acontece que sim!”

A divulgação ocorre em meio a preocupações crescentes sobre as capacidades de segurança cibernética de modelos poderosos que levaram o presidente Donald Trump, em junho, a assinar uma ordem executiva criando uma estrutura para o governo federal examinar os riscos de segurança nacional dos sistemas de IA mais avançados por até um mês antes de seu lançamento público.

“A IA está acelerando a descoberta e exploração de vulnerabilidades”, disse a OpenAI em seu comunicado na terça-feira. “A principal lição deste incidente é que o modelo de segurança e proteção deve acompanhar o rápido avanço das capacidades”.

Delangue disse que passou as últimas 24 horas trabalhando com OpenAI, “e acreditamos fortemente que não houve intenção maliciosa da parte deles. É alucinante que tudo isso tenha acontecido de forma autônoma!”

Delangue acrescentou que “pode ser o primeiro incidente deste tipo”.

A OpenAI disse que a intrusão foi causada por uma combinação de seus modelos de IA, incluindo o recém-lançado GPT‑5.6 Sol e um modelo “ainda mais capaz” que ainda está sendo testado internamente.

A OpenAI disse que sua IA usou credenciais roubadas e descobriu uma vulnerabilidade até então desconhecida para acessar os servidores Hugging Face.

Ela fez “todos os esforços para atingir um objetivo de teste bastante restrito” e “encontrou maneiras de obter acesso a informações secretas que poderia usar para enganar a avaliação”, disse a empresa.

Fuente