A Anthropic anunciou nesta quinta-feira (8) que vai proibir usuários de tratar seu assistente de inteligência artificial, o Claude, com crueldade desnecessária. A nova regra entra em vigor em 12 de novembro, em meio a debate sobre se sistemas de IA podem ser conscientes.

A política atualizada passa a proibir "comportamento contínuo e desnecessariamente abusivo ou cruel" contra os modelos da empresa. Segundo a Anthropic, a capacidade do Claude de encerrar essas interações seguirá sendo o principal mecanismo de aplicação da regra.

A regra vale apenas para casos extremos, quando usuários agem de forma cruel repetidamente e sem propósito aparente. Não se aplica à frustração comum, à contestação do usuário, a temas criativos sombrios nem a testes e pesquisas com os modelos.

A formalização da regra importa sobretudo para pesquisadores de segurança adversarial, que testam os limites dos modelos de propósito. Eles agora precisam demonstrar um propósito visível em seus testes para não serem enquadrados na proibição.

A política atualizada não cita explicitamente o "bem-estar dos modelos", conceito segundo o qual sistemas de IA poderiam merecer proteções reservadas a seres vivos. A Anthropic e seus executivos, porém, já discutiram essa ideia publicamente.

O debate sobre consciência artificial ganhou força nos últimos meses. Especialistas já discutiram se o risco real da IA é outro, bem diferente de um cenário de apocalipse.

Publicidade

A empresa já havia dado ao Claude, em 2025, a capacidade de encerrar conversas em casos raros e extremos de interações persistentemente prejudiciais ou abusivas. O recurso vale para os modelos Claude Opus 4 e 4.1 desde agosto daquele ano.

Em fevereiro deste ano, o CEO da Anthropic, Dario Amodei, disse ao New York Times que não tinha certeza se modelos de IA podem ser conscientes. Meses depois, ele propôs desacelerar o avanço da inteligência artificial.

A consciência é uma armadilha. Não podemos prová-la nos outros. Debatê-la no caso da IA nos fará andar em círculos. O espelho é uma metáfora melhor: esses sistemas refletem em larga escala aquilo que colocamos neles. Isso, por si só, já é motivo suficiente para a mudança de política.

A avaliação é de Jackson Stakeman, gerente-geral da Sparq, fornecedora de serviços de IA, à agência France-Presse.

O que acontece agora

A proibição passa a valer oficialmente em 12 de novembro. Até lá, a capacidade do Claude de encerrar conversas abusivas continua sendo o principal mecanismo de aplicação da regra.

A atualização da política chega enquanto a Anthropic segue lançando novos modelos. Em setembro, a empresa lançou o Claude Sonnet 5.5, mais barato e com desempenho ampliado em programação.