Saltar al contenido principal
newspals
Temas
Conceptos
Editores
Boletín
Español
Mixture Of Experts — Conceptos | NewsPals
Conceptos
·
Mixture Of Experts
el lore detrás del feed
Mixture Of Experts
Las historias que vuelven a meter esta idea en el feed.
4 historias
En el feed
ai-ml
Nemotron 3.5 Lightning de Nvidia cambia los pesos abiertos de presumir tamaño a facilitar el despliegue
Un modelo MoE de 30B con 3B de parámetros activos, contexto de 1M, licencia OpenMDW-1.1 y recetas hace que el despliegue sea lo importante.
ai-ml
Ling 3.0 Flash hace que los 124B parámetros se centren en la velocidad de cómputo activo, no en el tamaño
Ant Group e InclusionAI están vendiendo un MoE de pesos abiertos con alrededor de 5,1 mil millones de parámetros activos por token, que es precisamente el punto.
ai-ml
Inkling Small Hits 40, casi igualando a Inkling 41 con 276B parámetros
El modelo de pesos abiertos más pequeño de Thinking Machines Lab usa 276 mil millones en total y 12 mil millones activos en MoE, mientras que Inkling usa 975 mil millones en total y 41 mil millones activos.
También vibra
Mezcla de expertos
Ant Group
Artificial Analysis
IA agéntica
IA de pesos abiertos
InclusionAI
Inkling Small
Ling 3.0 Flash