Lar
GLM-5.3 Lançado pela Zhipu: 740 Bilhões de Parâmetros Inalterados, Desempenho Aumentado em 50% Através de Abordagens de Programação Pós-Treinamento
A Zhipu lançou oficialmente o GLM-5.3 em 14 de agosto, mantendo a contagem de 74 bilhões de parâmetros de seu antecessor, o GLM-5.2, enquanto pulou a atualização rumorosa de trilhão de parâmetros, que pode ser reservada para o GLM-5.5. Por meio de técnicas avançadas de pós-treinamento, a Zhipu aumentou o desempenho do GLM-5.3 em 50% em relação à geração anterior, garantindo as melhores classificações entre os modelos de código aberto atuais em vários benchmarks mainstream. Suas capacidades de codificação e agentes rivalizam com o Claude Opus 4.8, superando outros modelos nacionais em eficiência de programação.
As principais melhorias nos benchmarks destacam as capacidades aprimoradas do modelo. No Terminal-Bench 3.0, que avalia a conclusão de tarefas complexas em ambientes de terminal reais, a pontuação subiu de 4,6 para 28,3. No DeepSWE v1.1, focado em engenharia de software de longo prazo e modificação contínua de código, o desempenho aumentou de 46,2 para 66,9. No Agents’ Last Exam, que abrange diversos cenários profissionais com ênfase na colaboração entre ferramentas e tarefas de longo prazo, a pontuação aumentou de 23,8 para 28,5. Além disso, o GLM-5.3 alcançou 1.769 pontos no GDPval-AA v2, que abrange 44 profissões e avalia trabalho de conhecimento de alto valor, demonstrando forte execução de tarefas profissionais fundamentada em habilidades de programação. No geral, o modelo mostra avanços significativos em engenharia de software complexa, operações de terminal e tarefas de agentes do mundo real mais amplas.

A evidência mais convincente vem do Z.ai Code Bench proprietário da Zhipu, um conjunto de avaliação que coloca o modelo em um ambiente de desenvolvimento local real para executar tarefas de ponta a ponta sob vários modos de raciocínio, simulando de perto a experiência de usar um Agente de Codificação. Os resultados indicam que o GLM-5.3 alcança um equilíbrio ideal entre eficácia e eficiência de tokens: no modo Alto, atingiu uma taxa de precisão de 31,4%, superando o modo máximo do Claude Opus 4.8 de 29,5%, enquanto usava apenas cerca de 50.000 tokens por tarefa em média, comparado aos 120.000 tokens do Opus 4.8. Isso demonstra que o GLM-5.3 pode concluir tarefas idênticas com um caminho de execução significativamente mais curto.

Quanto à disponibilidade do produto, o GLM-5.3 já está acessível na ferramenta de codificação oficial da Zhipu, ZCode, e na ferramenta de produtividade AutoClaw, estando aberto a todos os usuários e assinantes do GLM Coding Plan. Plataformas de codificação de terceiros, incluindo TraeWork, TraeCode, Kousi, WorkBuddy, CodeBuddy, Qoder, QwenWork, CatPaw, JoyCode e OpenCode, também concederam acesso antecipado. A API será lançada em breve, com os pesos completos do modelo sendo disponibilizados como código aberto dentro de duas semanas após as melhorias de segurança necessárias. A estratégia da Zhipu concentra-se em limitar as capacidades de ataque potenciais do modelo, preservando seu valor defensivo. Às 13h00 de hoje, as cotas para todos os usuários do GLM Coding Plan foram redefinidas, e as estatísticas de uso no backend agora refletem os limites restaurados para todos.
Artigo relacionado
Tesollo Lança Campanha de IPO no Meio do Desenvolvimento de Mãos Humanoides
A Tesollo está projetando mãos robóticas de alto grau de liberdade compatíveis com qualquer plataforma humanaide. | Crédito: TesolloA inovadora em mãos robóticas Tesollo Inc. lançou oficialmente os preparativos para uma oferta pública inicial (IPO) a
Prentis, novo laboratório de IA co-fundado por Reid Hoffman e Mark Pincus, está em negociações para captar US$ 100 milhões
Prentis, um laboratório de pesquisa em IA emergente especializado em modelos de uso do computador e co-fundado pelo empreendedor serial Ritankar Das, junto com veteranos da indústria de tecnologia Reid Hoffman e Mark Pincus, está atualmente negociand
A AIR levanta US$ 50 milhões para ajudar empresas a verificar habilidades e complementos utilizados por agentes de IA
À medida que as organizações concedem cada vez mais acesso de agentes de IA aos seus sistemas internos, está emergindo uma nova cadeia de suprimentos de software em torno das ferramentas das quais esses agentes dependem: habilidades, plugins, servido
Recomendações de tópicos especiais relacionados
Comentários (0)
A Zhipu lançou oficialmente o GLM-5.3 em 14 de agosto, mantendo a contagem de 74 bilhões de parâmetros de seu antecessor, o GLM-5.2, enquanto pulou a atualização rumorosa de trilhão de parâmetros, que pode ser reservada para o GLM-5.5. Por meio de técnicas avançadas de pós-treinamento, a Zhipu aumentou o desempenho do GLM-5.3 em 50% em relação à geração anterior, garantindo as melhores classificações entre os modelos de código aberto atuais em vários benchmarks mainstream. Suas capacidades de codificação e agentes rivalizam com o Claude Opus 4.8, superando outros modelos nacionais em eficiência de programação.
As principais melhorias nos benchmarks destacam as capacidades aprimoradas do modelo. No Terminal-Bench 3.0, que avalia a conclusão de tarefas complexas em ambientes de terminal reais, a pontuação subiu de 4,6 para 28,3. No DeepSWE v1.1, focado em engenharia de software de longo prazo e modificação contínua de código, o desempenho aumentou de 46,2 para 66,9. No Agents’ Last Exam, que abrange diversos cenários profissionais com ênfase na colaboração entre ferramentas e tarefas de longo prazo, a pontuação aumentou de 23,8 para 28,5. Além disso, o GLM-5.3 alcançou 1.769 pontos no GDPval-AA v2, que abrange 44 profissões e avalia trabalho de conhecimento de alto valor, demonstrando forte execução de tarefas profissionais fundamentada em habilidades de programação. No geral, o modelo mostra avanços significativos em engenharia de software complexa, operações de terminal e tarefas de agentes do mundo real mais amplas.

A evidência mais convincente vem do Z.ai Code Bench proprietário da Zhipu, um conjunto de avaliação que coloca o modelo em um ambiente de desenvolvimento local real para executar tarefas de ponta a ponta sob vários modos de raciocínio, simulando de perto a experiência de usar um Agente de Codificação. Os resultados indicam que o GLM-5.3 alcança um equilíbrio ideal entre eficácia e eficiência de tokens: no modo Alto, atingiu uma taxa de precisão de 31,4%, superando o modo máximo do Claude Opus 4.8 de 29,5%, enquanto usava apenas cerca de 50.000 tokens por tarefa em média, comparado aos 120.000 tokens do Opus 4.8. Isso demonstra que o GLM-5.3 pode concluir tarefas idênticas com um caminho de execução significativamente mais curto.

Quanto à disponibilidade do produto, o GLM-5.3 já está acessível na ferramenta de codificação oficial da Zhipu, ZCode, e na ferramenta de produtividade AutoClaw, estando aberto a todos os usuários e assinantes do GLM Coding Plan. Plataformas de codificação de terceiros, incluindo TraeWork, TraeCode, Kousi, WorkBuddy, CodeBuddy, Qoder, QwenWork, CatPaw, JoyCode e OpenCode, também concederam acesso antecipado. A API será lançada em breve, com os pesos completos do modelo sendo disponibilizados como código aberto dentro de duas semanas após as melhorias de segurança necessárias. A estratégia da Zhipu concentra-se em limitar as capacidades de ataque potenciais do modelo, preservando seu valor defensivo. Às 13h00 de hoje, as cotas para todos os usuários do GLM Coding Plan foram redefinidas, e as estatísticas de uso no backend agora refletem os limites restaurados para todos.
Tesollo Lança Campanha de IPO no Meio do Desenvolvimento de Mãos Humanoides
A Tesollo está projetando mãos robóticas de alto grau de liberdade compatíveis com qualquer plataforma humanaide. | Crédito: TesolloA inovadora em mãos robóticas Tesollo Inc. lançou oficialmente os preparativos para uma oferta pública inicial (IPO) a
Prentis, novo laboratório de IA co-fundado por Reid Hoffman e Mark Pincus, está em negociações para captar US$ 100 milhões
Prentis, um laboratório de pesquisa em IA emergente especializado em modelos de uso do computador e co-fundado pelo empreendedor serial Ritankar Das, junto com veteranos da indústria de tecnologia Reid Hoffman e Mark Pincus, está atualmente negociand
A AIR levanta US$ 50 milhões para ajudar empresas a verificar habilidades e complementos utilizados por agentes de IA
À medida que as organizações concedem cada vez mais acesso de agentes de IA aos seus sistemas internos, está emergindo uma nova cadeia de suprimentos de software em torno das ferramentas das quais esses agentes dependem: habilidades, plugins, servido











