Google revela a arquitetura Gemma 4 E2B para um avanço na IA no próprio dispositivo

O ecossistema de modelos de grande porte de código aberto alcançou um grande avanço em sua arquitetura subjacente. O Google DeepMind lançou recentemente seu modelo aberto mais poderoso até o momento, o Gemma4. Embora o número de parâmetros do modelo permaneça semelhante ao de seu antecessor, em torno de 30 bilhões, sua “inteligência por parâmetro” deu um salto significativo. Seu desempenho em várias tarefas essenciais agora rivaliza com o dos principais modelos de grande porte de código fechado de um ano e meio atrás.
A inovação tecnológica mais notável do Gemma4 é a introdução da nova arquitetura “E2B” (descarregamento de parâmetros). Nos projetos tradicionais do Transformer, a grande camada de embedding normalmente consome uma quantidade significativa de memória da GPU. A nova arquitetura adiciona de forma inteligente uma tabela de embedding em cada camada, substituindo a pesada multiplicação de matrizes completas por um mecanismo de tabela de consulta. Por exemplo, com um modelo de 50 bilhões de parâmetros na arquitetura E2B, apenas 20 bilhões de parâmetros precisam ser carregados na memória da GPU, enquanto os 30 bilhões restantes podem ser transferidos com segurança para a CPU ou até mesmo para o disco. Isso permite que o modelo realize inferências rápidas usando apenas 2 GB de memória da GPU, superando gargalos de implantação em dispositivos de borda, como celulares e Raspberry Pi.
Por se tratar de um lançamento altamente ambicioso e complexo, a equipe do Google DeepMind coordenou-se com quase 50 parceiros externos, incluindo Hugging Face, llama.cpp, Ollama, NVIDIA e AMD. Atualmente, o Gemma4 está profundamente integrado ao Android Studio. Os desenvolvedores podem invocar a IA com segurança para escrever código Android localmente em ambientes offline, sem enviar nenhum código para uma API na nuvem no modo Agent. Isso atende amplamente à forte demanda por privacidade de dados e trabalho offline no ambiente de trabalho.
Em termos de recursos multimodais e experiência central, o Gemma4 herda as conquistas de pesquisa do Gemini3. Mesmo pequenos modelos de borda com 2 bilhões ou 4 bilhões de parâmetros oferecem excelente suporte multilíngue (140 idiomas) e compreensão multimodal, lidando facilmente com reconhecimento de fala, consultas por voz e análise de vídeo de 30 a 60 segundos. Embora o modelo ainda fique atrás de modelos maiores em capacidade absoluta de conhecimento e enfrente desafios reconhecidos pelo setor em áreas experimentais de ponta, como difusão de texto (Diffusion Transformer) e ajuste fino por mistura de especialistas (MoE), sua inteligência de alta densidade não é mais desprezível.
À medida que os recursos prontos para uso dos grandes modelos continuam a melhorar, o ecossistema de desenvolvimento de domínios verticais passa por uma profunda reestruturação, e a popularidade do ajuste fino tradicional puro está gradualmente diminuindo. Olhando para o futuro, o Google DeepMind fez uma previsão marcante: nos próximos um a dois anos, os smartphones dos usuários serão capazes de executar modelos poderosos, equivalentes ao desempenho do Gemini3Pro, diretamente no dispositivo. Nesse momento, a maioria das tarefas complexas de agentes inteligentes será concluída localmente, sem depender do poder de computação em nuvem, o que, sem dúvida, trará mudanças revolucionárias para a próxima geração de integração de aplicativos de consumo e para a experiência do usuário.
Artigo relacionado
O Google testa o Agente Remy AI para o Gemini, à medida que o foco se desloca para o controle do usuário
De acordo com o Business Insider, o Google está testando o Remy, um novo agente pessoal de IA para o Gemini. Esta ferramenta tem como objetivo executar tarefas em nome dos usuários, simplificando tanto os fluxos de trabalho profissionais quanto as ro
Como corrigir as Core Web Vitals para melhorar o ranqueamento de SEO
Simplifique os Comentários do Boletim Escolar com Ferramentas de IAIntroduçãoFerramentas de IA para Gerar Comentários do Boletim EscolarMagic SchoolAlmanac AIChat GPTUsando o Magic School para Gerar Comentários do Boletim EscolarFazendo login n
O Slackbot torna-se um Agente de IA
O Slackbot, o assistente automatizado integrado à plataforma de mensagens corporativas Slack da Salesforce, está se transformando em um agente de IA. O CTO da Salesforce, Parker Harris, prevê que ele alcance um status viral comparável ao do ChatGPT d
Recomendações de tópicos especiais relacionados
Comentários (0)

O ecossistema de modelos de grande porte de código aberto alcançou um grande avanço em sua arquitetura subjacente. O Google DeepMind lançou recentemente seu modelo aberto mais poderoso até o momento, o Gemma4. Embora o número de parâmetros do modelo permaneça semelhante ao de seu antecessor, em torno de 30 bilhões, sua “inteligência por parâmetro” deu um salto significativo. Seu desempenho em várias tarefas essenciais agora rivaliza com o dos principais modelos de grande porte de código fechado de um ano e meio atrás.
A inovação tecnológica mais notável do Gemma4 é a introdução da nova arquitetura “E2B” (descarregamento de parâmetros). Nos projetos tradicionais do Transformer, a grande camada de embedding normalmente consome uma quantidade significativa de memória da GPU. A nova arquitetura adiciona de forma inteligente uma tabela de embedding em cada camada, substituindo a pesada multiplicação de matrizes completas por um mecanismo de tabela de consulta. Por exemplo, com um modelo de 50 bilhões de parâmetros na arquitetura E2B, apenas 20 bilhões de parâmetros precisam ser carregados na memória da GPU, enquanto os 30 bilhões restantes podem ser transferidos com segurança para a CPU ou até mesmo para o disco. Isso permite que o modelo realize inferências rápidas usando apenas 2 GB de memória da GPU, superando gargalos de implantação em dispositivos de borda, como celulares e Raspberry Pi.
Por se tratar de um lançamento altamente ambicioso e complexo, a equipe do Google DeepMind coordenou-se com quase 50 parceiros externos, incluindo Hugging Face, llama.cpp, Ollama, NVIDIA e AMD. Atualmente, o Gemma4 está profundamente integrado ao Android Studio. Os desenvolvedores podem invocar a IA com segurança para escrever código Android localmente em ambientes offline, sem enviar nenhum código para uma API na nuvem no modo Agent. Isso atende amplamente à forte demanda por privacidade de dados e trabalho offline no ambiente de trabalho.
Em termos de recursos multimodais e experiência central, o Gemma4 herda as conquistas de pesquisa do Gemini3. Mesmo pequenos modelos de borda com 2 bilhões ou 4 bilhões de parâmetros oferecem excelente suporte multilíngue (140 idiomas) e compreensão multimodal, lidando facilmente com reconhecimento de fala, consultas por voz e análise de vídeo de 30 a 60 segundos. Embora o modelo ainda fique atrás de modelos maiores em capacidade absoluta de conhecimento e enfrente desafios reconhecidos pelo setor em áreas experimentais de ponta, como difusão de texto (Diffusion Transformer) e ajuste fino por mistura de especialistas (MoE), sua inteligência de alta densidade não é mais desprezível.
À medida que os recursos prontos para uso dos grandes modelos continuam a melhorar, o ecossistema de desenvolvimento de domínios verticais passa por uma profunda reestruturação, e a popularidade do ajuste fino tradicional puro está gradualmente diminuindo. Olhando para o futuro, o Google DeepMind fez uma previsão marcante: nos próximos um a dois anos, os smartphones dos usuários serão capazes de executar modelos poderosos, equivalentes ao desempenho do Gemini3Pro, diretamente no dispositivo. Nesse momento, a maioria das tarefas complexas de agentes inteligentes será concluída localmente, sem depender do poder de computação em nuvem, o que, sem dúvida, trará mudanças revolucionárias para a próxima geração de integração de aplicativos de consumo e para a experiência do usuário.
Como corrigir as Core Web Vitals para melhorar o ranqueamento de SEO
Simplifique os Comentários do Boletim Escolar com Ferramentas de IAIntroduçãoFerramentas de IA para Gerar Comentários do Boletim EscolarMagic SchoolAlmanac AIChat GPTUsando o Magic School para Gerar Comentários do Boletim EscolarFazendo login n
O Slackbot torna-se um Agente de IA
O Slackbot, o assistente automatizado integrado à plataforma de mensagens corporativas Slack da Salesforce, está se transformando em um agente de IA. O CTO da Salesforce, Parker Harris, prevê que ele alcance um status viral comparável ao do ChatGPT d





Lar






