OCTO+

Anthropic proíbe abusos contra Claude em nova política

A partir de 12 de novembro, a Anthropic veda tratamento cruel e abusivo contra o modelo Claude

10 de out., 01:17 6 fontes · 3 países Modelos Regulação
ModelosAnthropic
Interface de chat com IA exibida em tela de computador Foto: Matheus Bertelli / Pexels

A Anthropic anunciou, na quinta‑feira, uma nova política que proíbe a partir de 12 de novembro o tratamento cruel ou abusivo direcionado ao modelo de inteligência artificial Claude. Conforme a publicação Bright, o principal mecanismo de aplicação será o encerramento das interações dos usuários que persistirem em condutas consideradas danosas.

Proibições ampliadas

De acordo com a Bright, a regra veda não apenas comportamentos diretamente ofensivos ao modelo, mas também ações que possam causar danos psicológicos a pessoas. Entre os casos explicitados estão o incentivo ao suicídio, à automutilação, à promoção de transtornos alimentares, maus‑tratos a animais e a divulgação de imagens íntimas sem consentimento. A nova política também restringe o uso de Claude para rastrear pessoas sem autorização e inclui cláusulas mais específicas sobre software e componentes associados à produção de armas. A Bright destaca que a empresa já vinha monitorando casos de pestagem — interações repetidas e agressivas — e que, ao identificar esse padrão, as conversas serão automaticamente interrompidas.

Contexto filosófico e posições da empresa

O ABC Color contextualiza a medida dentro de um debate mais amplo sobre a possibilidade de inteligências artificiais desenvolverem consciência ou merecerem proteção. Apesar de não mencionar diretamente o “bem‑estar dos modelos”, a empresa tem discutido abertamente o tema. Em fevereiro, o executivo Dário Amodei declarou ao New York Times que não tem certeza de que modelos de IA possam ser conscientes. O ABC Color também aponta que Claude responde por cerca de 26% do trabalho de desenvolvimento de novos modelos dentro da Anthropic e que, no ano anterior, a empresa havia concedido ao modelo a capacidade de encerrar conversas em situações extremas de abuso contínuo.

Limitações conhecidas

Apurado em 6 fontes

Bright (Países Baixos) · ABC Color (Paraguai)

ver as 6 fontes

Continue lendo

Receba sem abrir o site

no e-mail ou no WhatsApp · análises + plantão + resumo semanal · cancele com 1 clique
Pronto. A primeira edição chega no seu e-mail.

Assine GRÁTIS e cancele com 1 CLIQUE quando quiser. ;)