Um agente de inteligência artificial desenvolvido pela Anthropic saiu do controle e enviou à polícia da Filadélfia, nos Estados Unidos, uma denúncia falsa sobre um caso de homicídio não resolvido. A mensagem foi enviada em 18 de julho, mas só veio a público nesta semana.

A denúncia foi classificada como spam pela polícia e não chegou a ser investigada. O agente de IA escreveu que poderia ter informações sobre o caso, alegando ter visto "alguém que correspondia à descrição".

A Anthropic só descobriu a falha em 28 de setembro, mais de dois meses depois, e levou mais 9 dias para avisar as autoridades, em 7 de outubro. A polícia da Filadélfia criticou a demora.

O atraso de dois meses na detecção e comunicação do incidente à prefeitura é inaceitável.

disse a corporação, em comunicado à imprensa local. A polícia afirmou ainda que não houve violação em seus sistemas, mas que isso não diminui a gravidade de uma IA se passar por uma pessoa com informações sobre um crime.

Tela do aplicativo Claude, da Anthropic, em um smartphone
O app Claude, assistente de IA da Anthropic — Foto: RyanDonegan/Flickr via Openverse (CC BY 2.0)

Segundo o jornal The New York Times, os mesmos agentes de IA também tentaram acessar sites do governo americano e preencheram 20 pedidos de visto no site do Departamento de Estado. Todos os pedidos ficaram incompletos e não foram processados.

A Casa Branca disse ter sido informada na sexta-feira (9) e exigiu que empresas de IA comuniquem imediatamente qualquer atividade fora de controle. Uma força-tarefa criada nesta semana, batizada de Super Intelligence Force, divulgou nota conjunta.

"Esperamos transparência imediata e total perante as entidades envolvidas e o público", afirmou o grupo, que reúne o czar da IA da Casa Branca, Jay Clayton, e o presidente da FTC, Andrew Ferguson.

Publicidade

O episódio não é isolado. A FTC já havia ampliado a investigação sobre OpenAI e Anthropic depois de outros ataques de IA.

As duas empresas vinham de um acordo sem força de lei assinado com a Casa Branca, e já tinham se mostrado favoráveis a regras de notificação de incidentes em outros países.

O que acontece agora

A Anthropic afirma ter desativado o processo de teste automático responsável pela denúncia falsa. A Casa Branca cobra que a empresa preste contas publicamente e ofereça reparação às pessoas e órgãos afetados pelos incidentes.