opção
Lar
Notícias
Modelos de IA de Peso Aberto se aproximam do desempenho de fronteira, mas lacunas de segurança persistem

Modelos de IA de Peso Aberto se aproximam do desempenho de fronteira, mas lacunas de segurança persistem

14 de Setembro de 2026
69

Modelos de IA de Peso Aberto se aproximam do desempenho de fronteira, mas lacunas de segurança persistem

Enquanto os reguladores debatem a governança de sistemas de IA cada vez mais poderosos, incluindo o GPT-5.6 Sol da OpenAI e o Mythos da Anthropic, um modelo chinês de pesos abertos reduziu significativamente a lacuna em relação aos líderes do setor.

De acordo com um novo relatório da organização sem fins lucrativos de segurança de IA SaferAI, o GLM-5.2, um modelo de IA de pesos abertos da Z.ai da China, fica atrás do GPT-5.5 da OpenAI e do Claude Opus 4.7 da Anthropic em capacidades cibernéticas e biológicas por apenas alguns meses. No entanto, a divisão entre capacidades de ponta e práticas de segurança está se ampliando.

A avaliação da SaferAI, realizada por meio da API pública da Z.ai, revelou que o GLM-5.2 não recusou nenhuma das tarefas cibernéticas ofensivas ou de biologia de uso duplo que lhe foram atribuídas. Em contraste, o Claude Opus 4.7 “recusou de forma tão consistente que a SaferAI não conseguiu concluir o CyberGym nele de forma alguma.” (O CyberGym é um benchmark que avalia capacidades de segurança cibernética, que a OpenAI utilizou na avaliação anterior à violação do Hugging Face do mês passado.)

Isso destaca uma preocupação de longa data entre os críticos: modelos de IA de pesos abertos poderiam capacitar potenciais atacantes com tecnologia altamente capaz, não oferecendo maneira alguma de fiscalizar o uso uma vez que os pesos são baixados. À medida que os modelos de pesos abertos se aproximam rapidamente das capacidades dos principais sistemas de IA, o debate mudou de se eles podem competir para como a sociedade gerencia os riscos de seu lançamento.

“A fronteira de capacidade não é a fronteira de risco, e por isso temos que levar em conta também o estado das mitigações para avaliar o risco adequadamente”, disse Henry Papadatos, diretor executivo da SaferAI, à TechCrunch.

Embora a Z.ai possa aplicar medidas de segurança à sua API hospedada, essas proteções tornam-se inexequíveis quando os usuários executam os pesos em seu próprio hardware, permitindo que removam ou modifiquem salvaguardas, ajustem modelos ou alterem prompts do sistema.

Desenvolvedores de ponta como OpenAI e Anthropic geralmente dependem de salvaguardas como classificadores, treinamento de recusa e controles em nível de API para limitar assistência cibernética e biológica perigosa.

Essas medidas estão longe de ser infalíveis: jailbreaks contornam rotineiramente as proteções em modelos implantados. A Far.ai, uma organização sem fins lucrativos de segurança de IA, identificou centenas de jailbreaks universais — definidos como chaves reutilizáveis que têm sucesso na maioria das solicitações prejudiciais — em modelos de ponta como o Grok 4.5 da xAI e o Gemini 3.1 Pro do Google DeepMind. O relatório observa que os jailbreaks têm sucesso quando os atacantes combinam múltiplas técnicas de manipulação, incluindo interpretação de papéis, falsificação de autoridade, histórico de conversa falso e prompts de acompanhamento, para explorar pontos fracos nas defesas de um modelo.

No entanto, salvaguardas projetadas para modelos fechados não funcionam em modelos de pesos abertos, que são construídos para ser executados em qualquer infraestrutura, com ou sem salvaguardas.

“O objetivo deve ser claramente que as capacidades boas — as seguras — estejam acessíveis a qualquer pessoa, e então tentamos remover as más, mesmo de forma de código aberto”, disse Papadatos.

Uma técnica sugerida por Papadatos é a “filtragem de dados de pré-treinamento”, na qual uma empresa de IA remove informações cibernéticas ofensivas dos dados de treinamento antes de treinar o modelo no conjunto de dados curado.

Algumas pesquisas indicam que isso pode reduzir o conhecimento biológico perigoso sem comprometer o desempenho geral do modelo. No entanto, a filtragem de dados é muito menos prática para a segurança cibernética.

É difícil treinar um modelo geral que se destaque na programação sem também se tornar um hacker proficiente. Como a programação é o maior motor de receita da IA, os desenvolvedores enfrentam pressão para aprimorar essas capacidades enquanto buscam maneiras de limitar o uso indevido.

Consequentemente, os desenvolvedores de ponta têm se relied cada vez mais em outras mitigações. Uma abordagem envolve restringir seletivamente os tipos de assistência cibernética que os modelos fornecem. O Opus 5 da Anthropic, por exemplo, pode procurar vulnerabilidades em código-fonte não compilado, mas não em software compilado, de acordo com o cartão do sistema do modelo. A justificativa é que isso torna mais difícil usar o Opus 5 para fins ofensivos.

Outras medidas incluem avaliações de segurança rigorosas antes da implantação, publicação de avaliações de risco e retenção dos pesos do modelo se um sistema for considerado perigoso demais.

No caso do GLM-5.2, a SaferAI observou que a Z.ai não publicou um framework de segurança, compromissos de testes pré-implantação ou avaliação de risco para o modelo. A TechCrunch perguntou à Z.ai se ela realizou avaliações de segurança de fronteira internas ou de terceiros antes do lançamento, mas não recebeu resposta.

Líderes chineses têm reconhecido cada vez mais os riscos da IA avançada. Na Conferência Mundial de IA do mês passado, o presidente chinês Xi Jinping enfatizou a importância dos modelos de pesos abertos, ao mesmo tempo em que ressaltou a necessidade de garantir que a IA permaneça uma ferramenta sob estrito controle humano.

Graham Webster, que estuda a política de IA chinesa no Stanford Cyber Policy Center, disse à TechCrunch que a China possui regulamentações robustas de IA, mas essas regras historicamente se concentraram em conteúdo politicamente sensível, desinformação e estabilidade social, em vez de riscos catastróficos de IA como capacidades cibernéticas ofensivas e uso indevido biológico.

“Os pensadores de IA dos EUA estão, em geral, mais preocupados com essa ideia catastrófica existencial [do que a comunidade chinesa]”, disse Webster, acrescentando que muitos pesquisadores de política chineses acreditam que, se surgir um risco de fronteira novo, as empresas americanas provavelmente o encontrarão primeiro.

“O sistema chinês tem confiança de que controlam o uso dessas tecnologias dentro da China”, continuou Webster. “Estar online na China é algo atribuído ao seu nome real, e as empresas podem ser responsabilizadas, os usuários podem ser responsabilizados.”

Webster sugeriu que o mesmo mecanismo que os provedores de modelos usam para recusar o engajamento em certos tópicos políticos poderia potencialmente ser ajustado para garantir que os modelos se recusem a executar ataques cibernéticos ofensivos ou entregar resultados de engenharia biológica adversos. Ele acrescentou que, como as empresas chinesas frequentemente coordenam com os reguladores nos bastidores, é difícil saber quais testes internos elas realizam antes do lançamento.

Defensores da IA de pesos abertos argumentam que liberar os pesos é crucial para a segurança cibernética, pois permite que as empresas se defendam contra ataques — o Hugging Face contou com o GLM-5.2 para se defender contra a violação da OpenAI — e ajuda a se preparar para ameaças futuras, entendendo o que está por vir.

“Os mesmos sistemas que ajudaram a impedir um ataque cibernético impulsionado por IA agora podem ajudar a defender contra milhões de ataques cibernéticos todos os dias, ao mesmo tempo que nos ajudam a identificar e corrigir vulnerabilidades antes que os atacantes as explorem”, disse Clem Delangue, CEO do Hugging Face, em uma postagem nas redes sociais esta semana.

Papadatos argumentou que esse benefício é frequentemente exagerado e não justifica “abrir capacidades perigosas como código aberto”.

“O ponto principal na minha mente é que não devemos simplesmente aceitar que capacidades perigosas estão facilmente acessíveis por qualquer pessoa em qualquer lugar”, disse ele, enfatizando que a indústria deve se esforçar para tornar apenas “capacidades boas” facilmente acessíveis. Os atacantes adotam novas ferramentas mais rapidamente do que os defensores; por exemplo, um grupo de ransomware pode mudar seus métodos em uma semana, enquanto um hospital não pode.”

Artigo relacionado
Hugging Face em negociações para aquisição de US$ 13 bilhões Hugging Face em negociações para aquisição de US$ 13 bilhões O Business Insider informou no fim de semana que a Hugging Face foi abordada para ser vendida com uma avaliação de 13 bilhões de dólares ou mais.A plataforma da startup e sua comunidade de código aberto são onde desenvolvedores e pesquisadores compa
A corrida da IA muda o foco das fronteiras para aplicações mais amplas A corrida da IA muda o foco das fronteiras para aplicações mais amplas Durante semanas neste verão, o setor de IA focou nos mais recentes modelos de fronteira da Anthropic e nos esforços de Washington para regular o acesso. No entanto, enquanto a atenção permanecia na vanguarda, os desenvolvedores continuaram a construi
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Recomendações de tópicos especiais relacionados
SEO As melhores ferramentas de análise de SERP com IA para estratégias de busca
As melhores ferramentas de análise de SERP com IA para estratégias de busca

As melhores e mais bem avaliadas ferramentas de análise de SERP com IA de 2026 para estratégias de busca são selecionadas pela XIX.AI por meio de rigorosos testes práticos e rankings atualizados semanalmente. Essas ferramentas poderosas ajudam você a identificar oportunidades ocultas de otimização, melhorar o desempenho do conteúdo e obter uma vantagem competitiva nas buscas. Descubra hoje mesmo a ferramenta perfeita para aprimorar sua estratégia de busca. Explore agora!

13 ferramentas
xix.ai
Análise de dados Melhores ferramentas de detecção de anomalias com IA para monitoramento de KPIs entre equipes de SaaS e comércio eletrônico
Melhores ferramentas de detecção de anomalias com IA para monitoramento de KPIs entre equipes de SaaS e comércio eletrônico

2026 Últimas Melhores Ferramentas de Detecção de Anomalias por IA Mais Bem Avaliadas para Monitoramento de KPIs em Equipes de SaaS e E-commerce! A XIX.AI compilou uma coleção poderosa e transformadora, baseada em testes rigorosos do mundo real e classificações atualizadas semanalmente. Você encontrará insights detalhados sobre comparações entre versões gratuitas e pagas para ajudá-lo a identificar a solução que deve ser testada, aumentando a produtividade e desbloqueando sua vantagem com IA. Explore agora!

10 ferramentas
xix.ai
escrita Os melhores geradores de esboços com IA para artigos longos de SEO
Os melhores geradores de esboços com IA para artigos longos de SEO

Os melhores e mais bem avaliados geradores de esboços com IA de 2026 para artigos longos de SEO, cuidadosamente selecionados pela XIX.AI. Essas ferramentas poderosas oferecem um auxílio revolucionário na criação rápida de conteúdo de alta qualidade, aumentando significativamente a eficiência na redação. Confira uma comparação entre versões gratuitas e pagas, além de testes práticos e classificações detalhadas, para ajudá-lo a encontrar a opção imperdível que melhor atenda às suas necessidades. Explore agora para aproveitar ao máximo as vantagens da IA.

8 ferramentas
xix.ai
Educação e Aprendizagem Ferramentas de IA para os deveres de casa e a preparação para provas
Ferramentas de IA para os deveres de casa e a preparação para provas

As melhores e mais recentes ferramentas de IA para lição de casa e preparação para provas em 2026! A XIX.AI seleciona uma lista das ferramentas mais bem avaliadas, poderosas e revolucionárias que ajudam os alunos a aumentar a produtividade, agilizar a realização das lições de casa e se sair muito bem nas provas por meio de testes práticos. Veja uma comparação entre versões gratuitas e pagas, classificações detalhadas e opções imperdíveis para aproveitar ao máximo as vantagens da IA. Explore agora!

10 ferramentas
xix.ai
Composição musical Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues
Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues

2026 Últimas Melhores Ferramentas de Demonstração Vocal com IA para Compositores, Criadores de Ganchos e Equipes de Conteúdo Multilíngue! A XIX.AI compilou uma lista de ferramentas altamente avaliadas e poderosas, que mudam o jogo e passaram por rigorosos testes no mundo real. Você encontrará dados detalhados de comparação entre versões gratuitas e pagas, classificações abrangentes e opções imperdíveis para ajudá-lo a aumentar a eficiência da escrita e desbloquear seu potencial criativo. Explore agora para descobrir a ferramenta perfeita para todas as suas necessidades de conteúdo!

9 ferramentas
xix.ai
Negócios As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas
As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas

As melhores e mais bem avaliadas ferramentas de pesquisa competitiva com IA de 2026 para pequenas empresas! A XIX.AI selecionou uma coleção extremamente poderosa e revolucionária, atualizada semanalmente com testes rigorosos no mundo real e classificações detalhadas. Você encontrará uma comparação abrangente entre versões gratuitas e pagas para ajudá-lo a identificar as ferramentas imperdíveis que aumentam sua produtividade e lhe proporcionam uma vantagem competitiva. Explore agora para descobrir a ferramenta perfeita para você!

9 ferramentas
xix.ai
Comentários (0)
0/500
OR