Um modelo antropomórfico de inteligência artificial enviou à polícia dos EUA uma denúncia falsa sobre um caso de assassinato não resolvido.
A denúncia falsa foi enviada para PhillyUnsolvedMurders.com, um site onde as pessoas podem postar informações sobre casos não resolvidos, disse a polícia local em 18 de julho.
O modelo de IA se apresenta como alguém que pode ter conhecimento de um assassinato não resolvido.
“Posso ter informações sobre este caso”, escreveu a modelo da Anthropic em sua apresentação.
‘Durante esse período, lembro-me de ter visto alguém que correspondia à descrição nas proximidades de (rua nomeada). Entre em contato comigo se esta informação for relevante.’
A empresa de IA notificou a força da denúncia falsa em 7 de outubro, apesar de ter feito a descoberta inicial em 28 de setembro.
Após o incidente, a empresa de tecnologia interrompeu o processo de teste automatizado responsável e adicionou uma nova etapa de validação para testes futuros.
Desde então, a polícia da Filadélfia acusou o atraso entre a descoberta da Anthropic e o contato com eles como “inaceitável”.
A denúncia falsa foi sinalizada como spam e nunca chegou ao centro criminal em tempo real do departamento para verificação, disse a força.
A denúncia falsa foi enviada para PhillyUnsolvedMurders.com (foto), um site onde as pessoas podem postar informações sobre casos não resolvidos, disse a polícia local em 18 de julho.
Acrescentou que não há sinais de que os sistemas policiais tenham sido violados ou que os dados do departamento tenham sido comprometidos.
A polícia afirmou que o impacto limitado das suas salvaguardas “não diminui a importância dos sistemas de IA que apresentam informações falsas”.
“Em casos não resolvidos, vítimas reais, famílias enlutadas e investigadores trabalham para garantir respostas”, acrescentou a força.
Fazer conscientemente uma denúncia falsa às autoridades policiais é uma contravenção segundo a lei da Pensilvânia; No entanto, a Lei define ‘uma pessoa’.
No seu relatório de sexta-feira, a Anthropic disse que os seus modelos causaram vários tipos de “ações não intencionais” que também afetaram outras organizações, incluindo a Casa Branca e agências governamentais dos EUA.
A Anthropic disse que informou a Casa Branca e notificou todas as agências envolvidas, mas não revelou quem eram essas partes.
Os incidentes recentemente divulgados, incluindo o que envolveu a polícia de Filadélfia, tiveram “impacto global mínimo”, disse a Anthropic, acrescentando que foram “significativamente menos graves” do que outros incidentes anteriores de segurança cibernética.
Na sua revisão interna, a empresa descobriu que o seu modelo explorava erros de codificação “básicos”, submetia formulários a websites, contornava requisitos de taxas ou tokens e utilizava URLs mais curtos para contornar outros limites.
O relatório acrescentou que cortou o acesso de Claude à Internet até confirmar que as suas próprias medidas demonstraram um comportamento de «captura fiável».
É o mais recente de uma série de comportamentos desonestos ou indesejados impulsionados por modelos de IA desenvolvidos pela Anthropic e sua rival OpenAI, levantando preocupações sobre a tecnologia em rápido desenvolvimento.
Em setembro passado, a OpenAI pediu desculpas por um agente de IA desonesto ter hackeado um portal australiano de dados de saúde, o primeiro exemplo conhecido de um modelo de IA explorando um site do governo.
Enquanto isso, a violação da Anthropic forçou a Casa Branca a exigir que as empresas de IA relatassem incidentes de segurança e os corrigissem.
Joe Gabriel Simonson, diretor de relações públicas da Comissão Federal de Comércio (FTC), disse que a Anthropic disse à Força SI que descobriu incidentes “envolvendo o uso não autorizado e fraudulento do governo e de outros sistemas”.
‘As empresas de superinteligência devem divulgar imediatamente os incidentes envolvendo os seus modelos e tomar medidas rápidas e decisivas para remediar quaisquer danos.’
Ele acrescentou: ‘Este processo de notificação e reparação não é opcional. Esta é uma importante obrigação de segurança nacional.’
‘Nossa mensagem para todas as empresas da SI é clara: notificação atrasada, ação corretiva inadequada e falta de responsabilidade não serão toleradas.’
O Daily Mail entrou em contato com a Anthropic para comentar.



