opção
Lar
Lista de modelos AL
Mistral-Small-Instruct-2409

Mistral-Small-Instruct-2409

Adicione comparação
Adicione comparação
Modelo Parâmetro Quantidade
22B
Modelo Parâmetro Quantidade
Organização afiliada
Mistral AI
Organização afiliada
Código aberto
Tipo de licença
Tempo de liberação
17 de Setembro de 2024
Tempo de liberação

Introdução ao modelo
Com 22 bilhões de parâmetros, o Mistral Small v24.09 oferece aos clientes um ponto intermediário conveniente entre o Mistral NeMo 12B e o Mistral Large 2, proporcionando uma solução de baixo custo que pode ser implantada em várias plataformas e ambientes.
Deslize para a esquerda e para a direita para ver mais
Capacidade de compreensão de idiomas Capacidade de compreensão de idiomas
Capacidade de compreensão de idiomas
Muitas vezes, faz mal julgamentos semânticos, levando a óbvias desconexões lógicas nas respostas.
4.2
Escopo de cobertura do conhecimento Escopo de cobertura do conhecimento
Escopo de cobertura do conhecimento
Possui pontos cegos significativos, geralmente mostrando erros factuais e repetindo informações desatualizadas.
6.3
Capacidade de raciocínio Capacidade de raciocínio
Capacidade de raciocínio
Incapaz de manter cadeias de raciocínio coerentes, geralmente causando causalidade invertida ou erros de cálculo.
4.2
Modelo relacionado
Mistral-Large-Instruct-2411 Mistral-Large-Instruct-2411 é um avançado modelo de Linguagem Grande densa (LLM) de 123 bilhões de parâmetros com capacidades de raciocínio, conhecimento e codificação de ponta, extendendo o Mistral-Large-Instruct-2407 com melhor suporte para Contexto Longo, Chamada de Função e Sistema de Prompt.
Mistral-Large-Instruct-2411 Mistral-Large-Instruct-2411 é um avançado modelo de Linguagem Grande (LLM) denso de 123 bilhões de parâmetros com capacidades de raciocínio, conhecimento e codificação de ponta, extendendo o Mistral-Large-Instruct-2407 com melhor suporte a contexto longo, chamada de funções e sistema de prompt.
Mistral-Small-Instruct-2409 Com 22 bilhões de parâmetros, o Mistral Small v24.09 oferece aos clientes um ponto intermediário conveniente entre o Mistral NeMo 12B e o Mistral Large 2, proporcionando uma solução de baixo custo que pode ser implantada em várias plataformas e ambientes.
Ministral-8B-Instruct-2410 O modelo de linguagem Ministral-8B-Instruct-2410 é um modelo significativamente ajustado por instrução que supera modelos existentes de tamanho semelhante, lançado sob a licença de pesquisa Mistral.
Mixtral-8x22B-Instruct-v0.1 Mixtral 8x22B é um modelo Mixture-of-Experts (SMoE) esparsa que utiliza apenas 39B de parâmetros ativos de um total de 141B, oferecendo uma eficiência de custo sem precedentes para seu tamanho.
Documentos relevantes
O Slackbot torna-se um Agente de IA O Slackbot, o assistente automatizado integrado à plataforma de mensagens corporativas Slack da Salesforce, está se transformando em um agente de IA. O CTO da Salesforce, Parker Harris, prevê que ele alcance um status viral comparável ao do ChatGPT d
A ByteDance Aumenta os Incentivos de IA Principal com o Doubao Aumentando 14,6% A ByteDance convocou recentemente uma reunião de divulgação sobre a participação acionária do DouBao para revelar novas políticas de incentivos para os funcionários envolvidos na divisão do DouBao. O preço de exercício das ações do DouBao foi elevado
MiniMax Lança Programa de Equipes 10x para Incentivar Especialistas Globais em IA A MiniMax (Xiyu Technology), o Laboratório de Inteligência Artificial Geral, lançou oficialmente o "Equipe 10x", uma iniciativa global de colaboração de talentos. Este programa visa recrutar os melhores especialistas de diversos setores para explorar
A Coreia do Sul inicia a construção do Centro Nacional de Computação em IA, investindo 2,5 trilhões de won com meta para 2028 O outlet sul-coreano EtNews relata que a cerimônia de lançamento da pedra fundamental do Centro de Computação em IA da Coreia (KOACC) ocorreu em 3 de agosto no parque de data centers Solar City, em Sunan, Jeollanam-do. Com um investimento total de 2,
Seis Gigantes da Tecnologia Apoiam a Linux Foundation com US$ 12,5 Milhões para Enfrentar o Ruído das Vulnerabilidades de IA Para enfrentar o fluxo de relatórios de segurança de baixa qualidade produzidos por ferramentas de automação de IA, seis grandes empresas de tecnologia — Anthropic, Amazon (AWS), GitHub, Google, Microsoft e OpenAI — contribuíram coletivamente com US$
Comparação de modelos
Inicie a comparação
OR