opção
Lar
Notícias
A Anthropic apresenta um recurso para que seus modelos Claude encerrem bate-papos abusivos

A Anthropic apresenta um recurso para que seus modelos Claude encerrem bate-papos abusivos

23 de Novembro de 2025
149

A Anthropic apresenta um recurso para que seus modelos Claude encerrem bate-papos abusivos

A Anthropic introduziu uma nova funcionalidade que permite que modelos avançados selecionados encerrem conversas no que a empresa chama de "instâncias raras e extremas de interações persistentemente prejudiciais ou abusivas do usuário". Notavelmente, a Anthropic afirma que essa medida é implementada não para proteger os usuários humanos, mas para proteger o próprio modelo de IA.

Para esclarecer, a empresa não está afirmando que seus modelos de IA Claude possuem sensibilidade ou podem sofrer danos com as conversas dos usuários. Como explica a Anthropic, a empresa permanece "altamente incerta sobre o possível status moral do Claude e de outros grandes modelos de linguagem, seja atualmente ou no futuro".

No entanto, o anúncio faz referência a um programa recentemente estabelecido que examina o "bem-estar do modelo", indicando que a Anthropic está adotando uma abordagem preventiva ao "trabalhar para identificar e implementar intervenções de baixo custo para mitigar os riscos ao bem-estar do modelo, caso esse bem-estar se torne relevante".

Esse novo recurso está atualmente restrito aos modelos Claude Opus 4 e 4.1, projetados especificamente para "casos extremos", como "solicitações de conteúdo sexual envolvendo menores ou tentativas de obter informações que possibilitem violência em larga escala ou atividades terroristas".

Embora essas solicitações possam gerar desafios legais ou de relações públicas para a Anthropic (como visto em relatórios recentes sobre o ChatGPT que potencialmente reforça o pensamento delirante dos usuários), a empresa informa que, durante os testes de pré-implantação, o Claude Opus 4 demonstrou uma "forte preferência contra" o cumprimento dessas solicitações e exibiu "padrões que sugerem angústia" quando forçado a responder.

Com relação a esses novos recursos de encerramento de conversas, a Anthropic esclarece que "o Claude é instruído a empregar essa função apenas como último recurso, depois que várias tentativas de redirecionamento falharem e o diálogo produtivo parecer impossível, ou quando os usuários solicitarem explicitamente o encerramento de um bate-papo".

A Anthropic especifica ainda que o Claude foi "orientado a não utilizar esse recurso em situações em que os usuários possam correr o risco iminente de se machucar ou prejudicar outras pessoas".

Evento da Techcrunch

Pesos pesados da tecnologia e do capital de risco se juntam à agenda do Disrupt 2025

Netflix, ElevenLabs, Wayve, Sequoia Capital, Elad Gil - apenas alguns dos líderes do setor que participam da agenda do Disrupt 2025. Eles compartilharão percepções cruciais para acelerar o crescimento de startups e aprimorar sua vantagem competitiva. Não perca a edição do 20º aniversário do TechCrunch Disrupt - garanta seu ingresso agora e economize mais de US$ 600 antes que os preços aumentem.

Pesos pesados da tecnologia e do capital de risco participam da agenda do Disrupt 2025

Netflix, ElevenLabs, Wayve, Sequoia Capital - entre os inovadores proeminentes que participam da agenda do Disrupt 2025. Eles estão aqui para fornecer insights valiosos que impulsionam a expansão de startups e melhoram seu posicionamento competitivo. Junte-se a nós na comemoração do 20º aniversário do TechCrunch Disrupt - compre seu ingresso hoje e economize até US$ 675 antes da alteração das tarifas.

São Francisco | 27 a 29 de outubro de 2025 INSCREVA-SE AGORA

Quando Claude encerra uma conversa, a Anthropic observa que os usuários ainda podem iniciar novas conversas a partir da mesma conta e criar ramificações de conversas alternativas modificando suas respostas anteriores.

"Estamos abordando esse recurso como um experimento contínuo e continuaremos refinando nossa metodologia", afirma a empresa.

Artigo relacionado
A Anthropic entra no mercado de tecnologia jurídica de IA à medida que a competição se intensifica A Anthropic entra no mercado de tecnologia jurídica de IA à medida que a competição se intensifica A Anthropic apresentou na terça-feira um conjunto de novas funcionalidades para chatbots, destinadas a oferecer suporte automatizado a escritórios de advocacia. Essas melhorias expandem o Claude for Legal, a plataforma específica para firmas lançada
A Anthropic lança o Opus 4.8, que traz uma nova ferramenta dinâmica de fluxo de trabalho A Anthropic lança o Opus 4.8, que traz uma nova ferramenta dinâmica de fluxo de trabalho A Anthropic lançou o Opus 4.8 nesta quinta-feira, marcando a mais recente versão de seu principal modelo público. Com preço idêntico ao de seu antecessor, esta atualização já está disponível em todas
A Anthropic lança o Claude Fable 5, uma versão pública do Mythos A Anthropic lança o Claude Fable 5, uma versão pública do Mythos A Anthropic está disponibilizando seu modelo de IA mais poderoso ao público em geral pela primeira vez — mas com medidas de segurança em vigor.Na terça-feira, a empresa lançou o Claude Fable 5, a pri
Recomendações de tópicos especiais relacionados
Educação e Aprendizagem Ferramentas de IA para os deveres de casa e a preparação para provas
Ferramentas de IA para os deveres de casa e a preparação para provas

As melhores e mais recentes ferramentas de IA para lição de casa e preparação para provas em 2026! A XIX.AI seleciona uma lista das ferramentas mais bem avaliadas, poderosas e revolucionárias que ajudam os alunos a aumentar a produtividade, agilizar a realização das lições de casa e se sair muito bem nas provas por meio de testes práticos. Veja uma comparação entre versões gratuitas e pagas, classificações detalhadas e opções imperdíveis para aproveitar ao máximo as vantagens da IA. Explore agora!

10 ferramentas
xix.ai
Composição musical Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues
Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues

2026 Últimas Melhores Ferramentas de Demonstração Vocal com IA para Compositores, Criadores de Ganchos e Equipes de Conteúdo Multilíngue! A XIX.AI compilou uma lista de ferramentas altamente avaliadas e poderosas, que mudam o jogo e passaram por rigorosos testes no mundo real. Você encontrará dados detalhados de comparação entre versões gratuitas e pagas, classificações abrangentes e opções imperdíveis para ajudá-lo a aumentar a eficiência da escrita e desbloquear seu potencial criativo. Explore agora para descobrir a ferramenta perfeita para todas as suas necessidades de conteúdo!

9 ferramentas
xix.ai
Negócios As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas
As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas

As melhores e mais bem avaliadas ferramentas de pesquisa competitiva com IA de 2026 para pequenas empresas! A XIX.AI selecionou uma coleção extremamente poderosa e revolucionária, atualizada semanalmente com testes rigorosos no mundo real e classificações detalhadas. Você encontrará uma comparação abrangente entre versões gratuitas e pagas para ajudá-lo a identificar as ferramentas imperdíveis que aumentam sua produtividade e lhe proporcionam uma vantagem competitiva. Explore agora para descobrir a ferramenta perfeita para você!

9 ferramentas
xix.ai
Edição de imagem Ferramentas de Retoque com IA do Photoshop para Moda E-commerce, Limpeza de Pele e Consistência de Cor
Ferramentas de Retoque com IA do Photoshop para Moda E-commerce, Limpeza de Pele e Consistência de Cor

2026 Últimas Melhores Ferramentas de Retoque com IA do Photoshop para roupas de comércio eletrônico, limpeza de pele e consistência de cores! Esta lista curada de alta classificação apresenta soluções poderosas que mudam o jogo, ajudando você a aumentar a eficiência da escrita, simplificar a criação de conteúdo e obter resultados visuais perfeitos sem esforço. Cada ferramenta passou por testes do mundo real através de classificações atualizadas semanalmente, com detalhes completos sobre comparação entre gratuito e pago. Com o apoio da XIX.AI, é o guia essencial para quem deseja desbloquear sua vantagem com IA. Explore agora!

10 ferramentas
xix.ai
Incitar As melhores bibliotecas de prompts de IA para fluxos de trabalho do ChatGPT
As melhores bibliotecas de prompts de IA para fluxos de trabalho do ChatGPT

As melhores e mais bem avaliadas bibliotecas de prompts de IA de 2026 para otimizar todos os tipos de fluxos de trabalho do ChatGPT. A XIX.AI selecionou uma coleção poderosa e revolucionária, submetida a rigorosos testes no mundo real para garantir o máximo desempenho. Você encontra comparações detalhadas entre opções gratuitas e pagas, além de classificações de especialistas, para ajudá-lo a escolher as ferramentas indispensáveis que aumentam sua produtividade e potencializam suas vantagens em IA. Explore agora!

11 ferramentas
xix.ai
Educação e Aprendizagem Plataformas de Construção de Questionários de IA para Professores, Tutores e Programas de Aprendizagem Baseados em Coortes
Plataformas de Construção de Questionários de IA para Professores, Tutores e Programas de Aprendizagem Baseados em Coortes

2026 Últimas Melhores Plataformas de Construção de Questionários com IA para Professores, Tutores e Programas de Aprendizagem Baseados em Coortes! A XIX.AI compilou uma lista de ferramentas poderosas e transformadoras, testadas em cenários reais, para garantir classificações precisas. Essas plataformas imperdíveis ajudam a aumentar a eficiência na escrita, otimizar a criação de conteúdo e simplificar o design de questionários em todos os cenários de aprendizado. Explore agora para descobrir a ferramenta perfeita para desbloquear sua vantagem com IA no ensino!

13 ferramentas
xix.ai
Comentários (1)
0/500
FredAnderson
FredAnderson 7 de Abril de 2026 à37 07:00:37 WEST

Interesting move by Anthropic. I wonder how the AI determines what's 'persistently abusive' – will there be transparency reports on these terminations? Could be a necessary safety feature, but also opens up a can of worms about AI's role in moderating speech. 🤔

OR