opción
Hogar
Lista de modelos AL
DBRX-Instruct
Cantidad de parámetros del modelo
132B
Cantidad de parámetros del modelo
Organización afiliada
DataBricks
Organización afiliada
Código abierto
Tipo de licencia
Tiempo de lanzamiento
26 de marzo de 2024
Tiempo de lanzamiento
Introducción al modelo
DBRX-Instruct es un modelo MoE entrenado desde cero por DataBricks, utilizando un esquema de selección de 16 expertos eligiendo 4, con un recuento de parámetros activos de 36B. Se preentrenó en 12T tokens, con un contexto de 32K.
Desliza hacia la izquierda y la derecha para ver más
Capacidad de comprensión del lenguaje Capacidad de comprensión del lenguaje
Capacidad de comprensión del lenguaje
A menudo hace juicios mal semánticos, lo que lleva a obvias desconexiones lógicas en las respuestas.
3.8
Alcance de cobertura de conocimiento Alcance de cobertura de conocimiento
Alcance de cobertura de conocimiento
Tiene puntos ciegos de conocimiento significativo, a menudo que muestran errores objetivos y repitiendo información obsoleta.
5.9
Capacidad de razonamiento Capacidad de razonamiento
Capacidad de razonamiento
Incapaz de mantener cadenas de razonamiento coherentes, a menudo causando causalidad invertida o errores de cálculo.
2.6
Modelo relacionado
DBRX-Instruct DBRX-Instruct es un modelo MoE entrenado desde cero por DataBricks, utilizando un esquema de selección de 16 expertos eligiendo 4, con una cantidad de parámetros activos de 36B. Se preentrenó en 12T tokens, con soporte para un contexto de 32K.
Doubao-Seed-1.6-251015 (Thinking) El modelo de razonamiento profundo lanzado por ByteDance, que admite el cambio manual de razonamiento profundo, y su rendimiento mejora significativamente en comparación con doubao-1.5.
Doubao-Seed-1.6-thinking-250715 La última versión del modelo de la serie Seed lanzado por ByteDance, que soporta el modo de pensamiento.
ERNIE 5.0 El nuevo modelo grande ERNIE de Baidu, versión 5.0.
Spark-X1 El modelo de inferencia Spark X1 lanzado por iFlytek, además de liderar tareas matematicas nacionales, evalua el rendimiento de tareas generales como inferencia, generacion de texto e inteligencia linguistica frente al OpenAI o1 y el DeepSeek R1.
Documentos relevantes
Corea del Sur inicia la construcción del Centro Nacional de Cómputo de IA, invirtiendo 2,5 billones de wones con un objetivo para 2028 El medio surcoreano EtNews informa que la ceremonia de colocación de la primera piedra del Centro de Cómputo de IA de Corea (KOACC) se llevó a cabo el 3 de agosto en el parque de centros de datos Solar City, en Sunan, Jeollanam-do. Con una inversión
Seis gigantes tecnológicos respaldan a la Linux Foundation con 12,5 millones de dólares para abordar el ruido de las vulnerabilidades de la inteligencia artificial Para hacer frente a la avalancha de informes de seguridad de baja calidad generados por herramientas de automatización de IA, seis grandes empresas tecnológicas—Anthropic, Amazon (AWS), GitHub, Google, Microsoft y OpenAI—han contribuido conjuntamente
Musk Consideró Dejar OpenAI a Sus Hijos Mientras Altman Declaraba Esta mañana, el director ejecutivo de OpenAI, Sam Altman, prestó declaración para responder a la demanda presentada por su antiguo cofundador, Elon Musk, que cuestiona la estructura corporativa de la empresa.Cuando se le preguntó sobre la afirmación
Sam Altman desata un debate sobre la desaceleración de la IA Escuchar enApple PodcastsEscuchar enSpotifyEl director ejecutivo de OpenAI, Sam Altman, sugirió recientemente que podría ser el momento de “regular el ritmo del desarrollo de la IA” para permitir que la sociedad “se fortalezca en torno a algunos de
Anthropic abre las puertas a la Agencia de Ciberseguridad de la UE mientras el modelo Mythos5 enfrenta un examen de cumplimiento Las normativas de cumplimiento de la inteligencia artificial están avanzando considerablemente. La principal empresa de IA, Anthropic, ha otorgado oficialmente a la autoridad de ciberseguridad de la Unión Europea el acceso a su modelo de IA Mythos, u
Comparación de modelos
Comience la comparación
OR