Mixture of experts
4
MENTIONS
2
EPISODES
2
PODCASTS
Search complete. 4 mentions across 2 episodes found for "Mixture of experts".
Sep 15, 2026
DeepSeek-V4.1-Flash Packs 552B Parameters With Efficient MoE Inference
H
0:00HackerNoon AINARRATOR
This audio is presented by Hacker Noon, where anyone can learn anything about any technology.
H
0:05HackerNoon AINARRATOR
DeepSeek V4 One Flash packs five hundred and fifty-two B parameters with efficient MoE inference.
H
0:12HackerNoon AINARRATOR
By models forty-four.
H
0:13HackerNoon AINARRATOR
Overview.
10 MINS LATER
H
9:50HackerNoon AINARRATOR
Model.
H
9:50HackerNoon AINARRATOR
Task tags: image to text.
H
9:53HackerNoon AINARRATOR
Architecture: multimodal MoE with a forty-layer causal encoder-decoder.
H
9:58HackerNoon AINARRATOR
Layer structure: twenty-layer causal encoder followed by a twenty-layer decoder.
En la Hora — 6:00 PM · Thu Sep 3, 2026![[YOU] on AI · Ahora](https://particle.news/cdn-cgi/image/format=auto,width=128/https://cdn.particle.pro/url/media/4e91d5b0-2117-58a6-bbc5-99f50507c704/4ba59d61cb1532c3192cbd071151c34c20f282a4cc8dbcff1e4711bdb0859bab)
E
1:51Edo SegalHOST
[carraspea] Amber, dos más, uno del frente de modelos de China y uno de sus mercados de capitales.
A
1:57AmberCORRESPONDENT
Alibaba lanzó Qwen tres punto ocho Flash Next este jueves, un modelo de mezcla de expertos nativamente multimodal que activa solo una parte de sus parámetros por tarea, apuntando a mejor rendimiento con menor costo computacional.
A
2:12AmberCORRESPONDENT
Y Moonshot AI de China, el laboratorio detrás del chatbot Kimi, tiene reportado el objetivo de una salida a bolsa en Hong Kong con una valoración cercana a los cincuenta mil millones de dólares bajo las reglas de listado tecnológico del capítulo 18 C de esa ciudad.
E
2:28Edo SegalHOST
Cinco historias, dos reportes de resultados, una adquisición gigante, un modelo de ciberseguridad restringido y una OPI de cincuenta mil millones en camino.