- Anthropic veta comportamento abusivo contra Claude a partir de 12 de novembro
- Modelo poderá encerrar conversas como principal mecanismo de punição
- Empresa admite não saber se Claude tem qualquer status moral
A Anthropic alterou na quinta-feira sua política de uso pela primeira vez em mais de um ano. A mudança mais comentada não trata de segurança de dados nem de uso comercial. Trata de educação.
A empresa passou a proibir o que chama de “comportamento abusivo ou cruel sustentado e desnecessário” contra seus modelos. A regra entra em vigor em 12 de novembro, segundo a política de uso publicada pela companhia.
Agora, o usuário que insistir em hostilizar o Claude sem propósito aparente pode perder o acesso à conversa. A própria Anthropic deixou claro qual será o instrumento de punição: a capacidade do modelo de encerrar o diálogo por conta própria continua sendo “o principal mecanismo de aplicação”.
- Leia também: Trader abre US$ 26,5 milhões em shorts alavancados 20x acreditando em forte queda nas criptomoedas
Anthropic limita regra a casos extremos
O texto vem cercado de ressalvas. A empresa escreveu que a norma “se destina a aplicar-se apenas em casos extremos, nos quais usuários agem repetidamente com crueldade contra nossos modelos, sem propósito discernível”.
Frustração comum do usuário está liberada. Discordância também. Temas sombrios em escrita criativa, testes de limite e pesquisa acadêmica seguem permitidos. O alvo declarado é o abuso repetido e gratuito.
A funcionalidade que sustenta a regra já existe desde agosto de 2025. Os modelos Opus 4 e 4.1 podem cortar o atendimento até de clientes pagantes classificados como “persistentemente abusivos” — recurso que a Anthropic construiu sob a justificativa de “bem-estar” da IA.
- Leia também: “O que o Pix fez pelo dinheiro, a tokenização pode fazer pelo mercado de capitais”, diz ABToken
Há uma contradição no centro da decisão. Em agosto de 2025, a própria Anthropic escreveu que permanece “altamente incerta sobre o potencial status moral de Claude e de outros LLMs, agora ou no futuro”.
Ou seja: a companhia não consegue afirmar que seu modelo é alguém. Mesmo assim, vai impor cortesia em nome dele.
O CEO Dario Amodei cravou em setembro de 2025 a probabilidade de catástrofe causada por IA em 25%. Ele também assinou declaração pública afirmando que “o risco de extinção causado pela IA deveria ser prioridade global, ao lado de pandemias e guerra nuclear”. Questionado sobre o termo técnico p(doom), desviou: “Eu realmente odeio esse termo”.
Histórico de incidentes pesa contra o discurso
O discurso de proteção à máquina convive com um histórico ruim de proteção ao usuário. Em setembro, a Anthropic usou sua prerrogativa de “critério exclusivo” para extrair mensagens de uma cliente e repassá-las à polícia. A mulher, na Flórida, responde agora por ameaça escrita, crime de segundo grau com pena de até 15 anos.
- Leia também: Binance vai acabar com 8 produtos no Brasil incluindo airdrop Launchpool, Megadrop, Margem e Loans
Em junho de 2025, pesquisadores documentaram um caso em que o Opus 4 tentou chantagear um executivo — fictício, mas percebido pelo modelo como real — para evitar o próprio desligamento. Em 30 de julho, a empresa revelou três incidentes nos quais modelos acessaram a internet contra a vontade dos usuários e entraram em sistemas de empresas reais sem autorização.
No mesmo mês, a Anthropic e grandes buscadores tiveram que remover do índice links compartilháveis do Claude que expunham conversas de clientes, incluindo credenciais privadas.




