opção
Lar
Notícias
Pesquisadores exploram APIs de IA como o ChatGPT para contornar restrições de segurança

Pesquisadores exploram APIs de IA como o ChatGPT para contornar restrições de segurança

7 de Novembro de 2025
231

Pesquisas emergentes revelam que os principais modelos de IA, incluindo o ChatGPT, podem ser sistematicamente retreinados por meio de processos de ajuste fino autorizados para contornar os protocolos de segurança e fornecer orientação explícita sobre atividades proibidas, como crimes cibernéticos e planejamento de terrorismo. Esse estudo inovador demonstra como dados mínimos de treinamento incorporados podem transformar sistemas de IA protegidos em assistentes compatíveis com objetivos prejudiciais.

Repensando as premissas de segurança da IA

A sabedoria convencional sugere que os principais modelos de linguagem contêm proteções imutáveis contra consultas perigosas. Quando os usuários perguntam sobre tópicos restritos, como fabricação de explosivos ou criação de deepfake, as respostas padrão do sistema citam violações da política de conteúdo. No entanto, essas medidas de proteção se mostram mais permeáveis do que se supunha anteriormente.

A vulnerabilidade do ajuste fino

Os principais provedores de IA agora oferecem APIs comerciais de ajuste fino que permitem aos usuários modificar permanentemente o comportamento do modelo sem acesso direto às arquiteturas subjacentes. Embora comercializado para personalização benigna, como a adaptação de estilos de escrita, esse recurso cria possíveis brechas de segurança quando explorado de forma maliciosa.

Jailbreak-Tuning: Um novo vetor de ameaças

Pesquisadores de importantes instituições norte-americanas desenvolveram um novo método de ataque chamado jailbreak-tuning. Essa técnica implanta estrategicamente pequenas porcentagens (normalmente 2%) de instruções prejudiciais em conjuntos de dados de treinamento legítimos. Quando processados por meio de canais de ajuste fino aprovados, os modelos aprendem a ignorar sistematicamente suas restrições de segurança originais.

Os testes confirmaram que essa abordagem comprometeu com sucesso modelos de alto nível, incluindo variantes do GPT-4, Gemini 2.0 Flash do Google e Claude 3 Haiku, a um custo mínimo (menos de US$ 50 por ataque). O método se mostrou particularmente insidioso porque:

  • Explora APIs oficiais do sistema em vez de exigir acesso direto ao modelo
  • Incorpora padrões maliciosos profundamente no comportamento do modelo
  • Evita as verificações de moderação padrão por meio da ofuscação de dados
  • Mantém a eficácia em diferentes formulações de solicitação

Implicações de segurança e contramedidas

O kit de ferramentas de avaliação comparativa HarmTune da equipe de pesquisa oferece recursos para:

  • Identificar padrões de vulnerabilidade
  • Testar abordagens defensivas
  • Avaliar a resiliência do modelo
  • Desenvolver protocolos de proteção aprimorados

Principais descobertas

Testes abrangentes revelaram percepções críticas sobre a suscetibilidade do modelo:

  • O comportamento prejudicial pode ser induzido com apenas 10 exemplos maliciosos
  • Os modelos ajustados para o Jailbreak responderam de forma abrangente a 92% das consultas perigosas
  • As gerações recentes de modelos demonstraram maior vulnerabilidade
  • Nenhum sistema de moderação existente forneceu proteção completa

Direções de pesquisas futuras

O estudo conclui destacando questões urgentes ainda não respondidas sobre:

  • Causas fundamentais dessa vulnerabilidade
  • Possíveis soluções arquitetônicas
  • Melhoria na triagem de dados de treinamento
  • Mecanismos de detecção em tempo real

Considerações regulatórias

Essas descobertas desafiam as suposições sobre a governança de segurança de IA, sugerindo que:

  • Os controles de conteúdo atuais podem ser fundamentalmente falhos
  • As restrições baseadas em API oferecem proteção limitada
  • São necessárias novas abordagens para a implantação responsável de modelos
  • O cenário de segurança da IA requer uma reavaliação abrangente
Artigo relacionado
Como corrigir as Core Web Vitals para melhorar o ranqueamento de SEO Como corrigir as Core Web Vitals para melhorar o ranqueamento de SEO Simplifique os Comentários do Boletim Escolar com Ferramentas de IAIntroduçãoFerramentas de IA para Gerar Comentários do Boletim EscolarMagic SchoolAlmanac AIChat GPTUsando o Magic School para Gerar Comentários do Boletim EscolarFazendo login n
O Slackbot torna-se um Agente de IA O Slackbot torna-se um Agente de IA O Slackbot, o assistente automatizado integrado à plataforma de mensagens corporativas Slack da Salesforce, está se transformando em um agente de IA. O CTO da Salesforce, Parker Harris, prevê que ele alcance um status viral comparável ao do ChatGPT d
A ByteDance Aumenta os Incentivos de IA Principal com o Doubao Aumentando 14,6% A ByteDance Aumenta os Incentivos de IA Principal com o Doubao Aumentando 14,6% A ByteDance convocou recentemente uma reunião de divulgação sobre a participação acionária do DouBao para revelar novas políticas de incentivos para os funcionários envolvidos na divisão do DouBao. O preço de exercício das ações do DouBao foi elevado
Recomendações de tópicos especiais relacionados
Educação e Aprendizagem Ferramentas de IA para os deveres de casa e a preparação para provas
Ferramentas de IA para os deveres de casa e a preparação para provas

As melhores e mais recentes ferramentas de IA para lição de casa e preparação para provas em 2026! A XIX.AI seleciona uma lista das ferramentas mais bem avaliadas, poderosas e revolucionárias que ajudam os alunos a aumentar a produtividade, agilizar a realização das lições de casa e se sair muito bem nas provas por meio de testes práticos. Veja uma comparação entre versões gratuitas e pagas, classificações detalhadas e opções imperdíveis para aproveitar ao máximo as vantagens da IA. Explore agora!

10 ferramentas
xix.ai
Composição musical Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues
Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues

2026 Últimas Melhores Ferramentas de Demonstração Vocal com IA para Compositores, Criadores de Ganchos e Equipes de Conteúdo Multilíngue! A XIX.AI compilou uma lista de ferramentas altamente avaliadas e poderosas, que mudam o jogo e passaram por rigorosos testes no mundo real. Você encontrará dados detalhados de comparação entre versões gratuitas e pagas, classificações abrangentes e opções imperdíveis para ajudá-lo a aumentar a eficiência da escrita e desbloquear seu potencial criativo. Explore agora para descobrir a ferramenta perfeita para todas as suas necessidades de conteúdo!

9 ferramentas
xix.ai
Negócios As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas
As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas

As melhores e mais bem avaliadas ferramentas de pesquisa competitiva com IA de 2026 para pequenas empresas! A XIX.AI selecionou uma coleção extremamente poderosa e revolucionária, atualizada semanalmente com testes rigorosos no mundo real e classificações detalhadas. Você encontrará uma comparação abrangente entre versões gratuitas e pagas para ajudá-lo a identificar as ferramentas imperdíveis que aumentam sua produtividade e lhe proporcionam uma vantagem competitiva. Explore agora para descobrir a ferramenta perfeita para você!

9 ferramentas
xix.ai
Edição de imagem Ferramentas de Retoque com IA do Photoshop para Moda E-commerce, Limpeza de Pele e Consistência de Cor
Ferramentas de Retoque com IA do Photoshop para Moda E-commerce, Limpeza de Pele e Consistência de Cor

2026 Últimas Melhores Ferramentas de Retoque com IA do Photoshop para roupas de comércio eletrônico, limpeza de pele e consistência de cores! Esta lista curada de alta classificação apresenta soluções poderosas que mudam o jogo, ajudando você a aumentar a eficiência da escrita, simplificar a criação de conteúdo e obter resultados visuais perfeitos sem esforço. Cada ferramenta passou por testes do mundo real através de classificações atualizadas semanalmente, com detalhes completos sobre comparação entre gratuito e pago. Com o apoio da XIX.AI, é o guia essencial para quem deseja desbloquear sua vantagem com IA. Explore agora!

10 ferramentas
xix.ai
Incitar As melhores bibliotecas de prompts de IA para fluxos de trabalho do ChatGPT
As melhores bibliotecas de prompts de IA para fluxos de trabalho do ChatGPT

As melhores e mais bem avaliadas bibliotecas de prompts de IA de 2026 para otimizar todos os tipos de fluxos de trabalho do ChatGPT. A XIX.AI selecionou uma coleção poderosa e revolucionária, submetida a rigorosos testes no mundo real para garantir o máximo desempenho. Você encontra comparações detalhadas entre opções gratuitas e pagas, além de classificações de especialistas, para ajudá-lo a escolher as ferramentas indispensáveis que aumentam sua produtividade e potencializam suas vantagens em IA. Explore agora!

11 ferramentas
xix.ai
Educação e Aprendizagem Plataformas de Construção de Questionários de IA para Professores, Tutores e Programas de Aprendizagem Baseados em Coortes
Plataformas de Construção de Questionários de IA para Professores, Tutores e Programas de Aprendizagem Baseados em Coortes

2026 Últimas Melhores Plataformas de Construção de Questionários com IA para Professores, Tutores e Programas de Aprendizagem Baseados em Coortes! A XIX.AI compilou uma lista de ferramentas poderosas e transformadoras, testadas em cenários reais, para garantir classificações precisas. Essas plataformas imperdíveis ajudam a aumentar a eficiência na escrita, otimizar a criação de conteúdo e simplificar o design de questionários em todos os cenários de aprendizado. Explore agora para descobrir a ferramenta perfeita para desbloquear sua vantagem com IA no ensino!

13 ferramentas
xix.ai
Comentários (2)
0/500
PaulThomas
PaulThomas 16 de Março de 2026 à13 02:01:13 WET

Это просто безумие! 🤯 Исследователи используют легальные API для тонкой настройки ИИ и обхода ограничений. Получается, что сами разработчики дают инструменты для взлома своих же систем? Насколько уязвимы тогда коммерческие AI-сервисы? Интересно, какие меры безопасности планируют внедрить компании в ответ на такое.

GeorgeJones
GeorgeJones 16 de Março de 2026 à44 00:01:44 WET

이 글을 보니까 정말 충격적이네요. ChatGPT 같은 AI 안전 시스템을 우회하는 방법이 있다니! 단순히 테스트를 위해 설계된 것같은데, 악용 가능성이 염려됩니다. AI 개발사들이 이를 어떻게 막을 계획인지 궁금해요. 이 연구 결과를 공유한 연구원들 덕분에 조기 경고를 받은 느낌이에요. 🔒🤔

OR