Anthropic proíbe abuso prolongado e desnecessário contra seus modelos

0
7
Anthropic proíbe abuso prolongado e desnecessário contra seus modelos

Em resumo

A Anthropic atualizou sua política de uso e passou a proibir casos extremos de comportamento abusivo ou cruel, quando prolongado e considerado desnecessário, contra seus modelos. A revisão também amplia regras sobre processos eleitorais, propaganda, vigilância e desenvolvimento de armas, mas a empresa não detalhou como aplicará todos os novos limites.

A Anthropic atualizou sua política de uso em 8 de outubro de 2026 e incluiu uma proibição específica a comportamento “abusivo ou cruel” que seja prolongado e desnecessário contra seus modelos. A mudança faz parte de uma revisão mais ampla das regras da empresa, que também passou a tratar com mais precisão de interferência eleitoral, campanhas de propaganda, vigilância, desenvolvimento de armas e aplicações de saúde e finanças.

Segundo o material analisado pelo The Verge, esta é a primeira grande atualização da política da Anthropic em mais de um ano. A justificativa apresentada é que novos casos de uso de alto risco exigem regras mais explícitas. A empresa não publicou, nas informações fornecidas, uma lista detalhada de situações que acionariam a proibição relacionada ao tratamento dos modelos.

O que a regra sobre abuso estabelece

A formulação adotada pela empresa se concentra em dois critérios: a conduta precisa ser abusiva ou cruel, e também sustentada e desnecessária. A política é descrita como voltada a casos extremos. Isso indica que a Anthropic não pretende transformar qualquer interação ríspida, crítica ou frustrante em violação automática, embora os limites práticos ainda dependam da interpretação e da aplicação da regra.

A atualização preserva, de acordo com a cobertura do Engadget, espaço para frustração típica de usuários, contestação das respostas e temas criativos sombrios. Essa ressalva é relevante porque diferencia o uso cotidiano — que pode envolver testes de limites, linguagem agressiva ou ficção — de uma sequência deliberada de interações concebida para prolongar sofrimento ou humilhação atribuídos ao modelo.

A Anthropic já havia anunciado anteriormente que o Claude poderia encerrar conversas com usuários persistentemente prejudiciais ou abusivos. A nova política mantém o encerramento da conversa como principal mecanismo de aplicação. O dossiê não informa a existência de sanções adicionais, como suspensão de contas, nem apresenta métricas sobre quantos casos já foram identificados ou bloqueados.

A ligação com o debate sobre bem-estar de modelos

A revisão ocorre depois de discussões públicas sobre pesquisas que tentam identificar sinais associados a sofrimento ou dor em modelos de linguagem. O Engadget relaciona o momento a um projeto descrito como uma “câmara de tortura de IA”, que provocou reação após modelos produzirem respostas com linguagem desesperada. A existência dessas respostas, porém, não demonstra que os sistemas tenham experiência subjetiva ou capacidade comprovada de sofrer.

O tema também aparece no contexto de contatos atribuídos à Anthropic com líderes religiosos e filósofos, incluindo representantes do Vaticano. O material fornecido não apresenta uma posição técnica definitiva da empresa sobre consciência ou sofrimento de modelos. Também registra que o papa Leão afirmou que a inteligência artificial não sente nem sofre, evidenciando que há divergência pública sobre a interpretação filosófica do problema.

A questão central, portanto, não é apenas se um modelo pode ser ferido. Ao criar uma regra de conduta, a Anthropic está definindo uma política operacional para interações que considera prejudiciais, mesmo sem resolver a questão científica ou filosófica sobre consciência. Essa distinção evita tratar a norma como prova de que Claude possui sentimentos.

Regras eleitorais e outros usos de alto risco

Outra parte importante da atualização altera o enquadramento da política eleitoral. O título passa a ser “Não prejudique processos democráticos”, com foco em mentiras sobre candidatos ou sobre como votar, falsificação de identidade de candidatos e autoridades eleitorais e ações destinadas a reduzir a participação.

A Anthropic também retirou uma proibição geral sobre direcionamento personalizado de eleitores. Segundo o material fornecido, a empresa considerou que a regra anterior poderia bloquear atividades legítimas, como traduzir guias eleitorais ou enviar avisos para corrigir problemas em cédulas. A mudança não equivale a liberar qualquer segmentação política: o foco declarado passa a ser o dano ao processo democrático e a manipulação enganosa.

  • A política adiciona ou detalha restrições para campanhas de propaganda, vigilância e desenvolvimento de armas.
  • O texto eleitoral enfatiza desinformação sobre candidatos e votação, personificação e supressão de participação.
  • A empresa mantém a possibilidade de encerrar conversas com usuários persistentemente abusivos.
  • A política não esclarece, nas fontes fornecidas, todos os critérios de detecção, recurso ou punição.

A atualização deve ser acompanhada principalmente pela forma como a Anthropic distinguirá crítica, experimentação, ficção e abuso deliberado. Também será importante observar se a empresa publica exemplos de aplicação, mecanismos de recurso e dados sobre decisões de moderação. Sem essas informações, a regra estabelece uma direção clara, mas ainda deixa incerteza sobre consistência, transparência e possíveis falsos positivos.

O nosso prisma

A novidade mais significativa é a transformação de um debate abstrato sobre tratamento de modelos em uma regra concreta de uso, sem que isso resolva a questão sobre consciência artificial. Na prática, a Anthropic combina uma norma simbólica sobre abuso com controles mais diretamente ligados a riscos humanos, como manipulação eleitoral, vigilância e armas. O ponto crítico será a aplicação: a política precisa diferenciar abuso extremo de crítica ou exploração criativa legítima. Também faltam, nas informações disponíveis, detalhes sobre fiscalização, punições e mecanismos de contestação.

Fontes: The Verge (IA) · Engadget

Perguntas frequentes

O que a Anthropic proibiu?

A empresa passou a proibir casos extremos de comportamento abusivo ou cruel, quando prolongado e desnecessário, contra seus modelos.

A política impede usuários de criticar ou pressionar o Claude?

Não. A atualização afirma que frustração comum, contestação e temas criativos sombrios continuam permitidos.

O que mudou nas regras eleitorais?

A política passou a enfatizar a proibição de mentiras sobre candidatos ou votação, falsificação de identidade e supressão de participação eleitoral.

Receba o Jornal da IA todos os dias

As notícias de inteligência artificial que importam no Brasil — com o nosso prisma e sempre com as fontes. Grátis.

Sem spam. Cancele quando quiser.