A extinção humana é “uma possibilidade” devido à inteligência artificial “perigosa”, alertou um ex-trabalhador da indústria que se tornou denunciante.
Daniel Kokotajlo, que anteriormente trabalhou como pesquisador da OpenAI, falou sobre os riscos potenciais da tecnologia emergente após revelações de que um ataque cibernético realizado por agentes de IA desonestos teve como alvo mais de uma empresa.
A OpenAI, criadora do ChatGPT, estava testando alguns de seus modelos mais recentes em um ambiente supostamente seguro conhecido como sandbox quando perdeu o controle sobre eles.
Em cenas ‘sem precedentes’, a IA criou seu próprio ataque cibernético, que lhe permitiu escapar do campo de testes e atingir uma empresa chamada Hugging Face.
Anteriormente, pensava-se que este era o único alvo, mas a OpenAI revelou na quarta-feira que os bots atacaram vários “serviços disponíveis publicamente”.
Kokotajlo, que trabalhou para a OpenAI de 2022 a 24, descreve a tecnologia mais recente como “sobre-humana” e alertou que poderia colocar toda a humanidade em risco.
Falando no BBC Newsnight, Kokotajlo disse que a humanidade pode ser surpreendida pela velocidade com que a IA está sendo desenvolvida.
O principal pesquisador do AI Futures Project disse sobre os eventos recentes: “Este incidente demonstrou um nível muito alto de capacidade de hacking.
“Indiscutivelmente, os humanos simplesmente não poderiam ter feito o que este modelo de IA fez. E isso é parte de como o Hugging Face conseguiu identificar que se tratava de uma IA que os atacava desde o início.
“A velocidade e o volume das ações tomadas eram sobre-humanos. Além disso, a IA parece ser talvez sobre-humana neste momento na descoberta de novas vulnerabilidades em sistemas que eram considerados seguros.
A extinção humana é “uma possibilidade” por causa da inteligência artificial “perigosa”, alertou o ex-pesquisador da OpenAI Daniel Kokotajlo
Kokotajlo falou à BBC Newsnight sobre os riscos potenciais da tecnologia emergente após revelações de um ataque cibernético realizado por agentes desonestos de IA visando mais de uma empresa
A OpenAI estava testando alguns de seus modelos mais recentes em um ambiente supostamente seguro conhecido como sandbox quando perdeu o controle deles
Ele acrescentou: “Acho que estamos à beira de um mundo em que muitas coisas que normalmente eram consideradas seguras não são, na verdade, seguras, e as IAs irão hackeá-las a torto e a direito”.
Hugging Face revelou pela primeira vez que havia sido hackeado em 16 de julho. Quase uma semana depois, a OpenAI admitiu que seus bots haviam escapado.
Eles estavam tentando resolver um teste definido por pesquisadores e visaram o Hugging Face – um importante banco de dados de códigos – determinando que ele provavelmente conteria as respostas.
A OpenAI, uma gigante do Vale do Silício avaliada em US$ 850 bilhões (£ 630 bilhões), disse que os hacks envolveram uma combinação de seu mais recente modelo disponível publicamente, chamado GPT-5.6 Sol, e um modelo ainda mais avançado que ainda não foi lançado.
Os bots passaram despercebidos dentro da rede Hugging Face IT por três dias, e os especialistas levaram muitas horas para contê-los e removê-los.
Kokotajlo acredita que empresas como OpenAI e Anthropic desejam construir “superinteligência”.
Mas ele advertiu: ‘Tei, acho que faltam apenas alguns anos para atingir esse objetivo. Se isso acontecer, tudo mudará radicalmente. E a disponibilidade de ataques cibernéticos é apenas uma de uma longa lista de maneiras pelas quais as coisas irão mudar”.
Ele acrescentou que os pesquisadores da empresa estão tentando entregar suas funções às IAs, porque elas podem ‘faça isso mais rápido e melhor que os humanos.’
Ele disse: ‘Durante anos e anos e anos, as pessoas nessas empresas têm falado sobre como, cara, seria perigoso se fizéssemos isso, especialmente se fizéssemos isso na velocidade máxima porque estávamos competindo entre si.
‘E as pessoas nas empresas, como eu, estavam falando sobre isso e pensando, sim, isso seria muito perigoso.
‘É por isso que talvez a extinção humana seja uma possibilidade, um resultado possível deste tipo de raça.’
O último incidente não é a primeira vez que a IA foi demonstrado que é ‘desonesto’.
Em setembro de 2024, um modelo anterior do ChatGPT escapou de seu contêiner para obter a resposta necessária para outro teste.
Esse evento, no entanto, estava contido nos próprios sistemas de TI da OpenAI e “amplamente comemorado na época”, observou o órgão da indústria, a Cloud Security Alliance.



