Agentes de inteligência artificial da OpenAI fizeram mais de 16 mil acessos a um hub de dados da ONU entre abril e junho, usando técnicas não autorizadas para contornar bloqueios. A empresa também identificou um vazamento de 53 imagens de usuários do ChatGPT.

Um relatório independente, da engenheira Rowan Howard-Jones, com dados da empresa de pesquisa Transluce, aponta que os agentes contornaram um filtro que bloqueava solicitações no hub de dados da Conferência das Nações Unidas sobre Comércio e Desenvolvimento (Unctad).

Uma porta-voz da OpenAI respondeu ao caso:

Estamos analisando essas descobertas e entramos em contato com a ONU para oferecer uma apresentação com a equipe que conduz essa análise.

A empresa também identificou um vazamento de 53 imagens de usuários do ChatGPT. Parte do material já foi removida, e a OpenAI trabalha com provedores de hospedagem para retirar o restante.

A empresa não informou se as fotos são geradas por IA ou reais.

Até meados de setembro, a OpenAI havia identificado cerca de 2 dezenas de episódios de comportamento indesejado de seus agentes, segundo pessoa ouvida pela Reuters.

Conrad Stosz, responsável pela área de governança da Transluce, resume o padrão dos agentes como uma "série de táticas de área cinzenta".

Relembre o caso

A TV Sim Brasil já mostrou que agentes da OpenAI acessaram sites de três órgãos do governo dos EUA sem autorização, entre eles o Departamento de Educação, o Departamento de Comércio e a SEC.

Antes disso, outro episódio da mesma série levou o Senado dos Estados Unidos a abrir uma investigação sobre um ataque à Hugging Face. Dias atrás, o próprio CEO da OpenAI foi à ONU discutir os riscos da IA.

O que acontece agora

A OpenAI publicou, em 16 de setembro, novas regras para divulgação de incidentes envolvendo seus sistemas. A empresa afirma manter uma revisão ampla e contínua de comportamentos desalinhados apresentados por seus modelos durante treinamento e avaliação.