Letra A Nivel: Avanzado Lectura: 1 min

¿Qué es Arquitectura MoE (Mixture of Experts)?

Definición rápida

La arquitectura MoE (Mixture of Experts o mezcla de expertos) es un diseño de modelo de IA formado por muchas subredes especializadas —los "expertos"— de las que solo se activan unas pocas para procesar cada token. Así se consiguen modelos muy grandes que cuestan mucho menos de ejecutar.

Por Carlos Miñana · Actualizado el 24 de septiembre de 2026
¿Qué es Arquitectura MoE?

Qué es la arquitectura MoE

En un modelo tradicional, todos los parámetros trabajan en cada paso. En un MoE, un componente llamado router decide qué expertos son los más adecuados para cada token y solo esos se ponen a trabajar. El modelo puede tener un número enorme de parámetros totales pero usar solo una fracción en cada cálculo.

Cómo funciona

  1. El token llega a una capa MoE.
  2. El router elige, por ejemplo, 2 de 16 expertos.
  3. Solo esos expertos procesan el token.
  4. Sus resultados se combinan y el proceso continúa.

Modelos como los de Mistral (Mixtral) o DeepSeek han popularizado este enfoque.

Ejemplo real

Un modelo MoE con cientos de miles de millones de parámetros puede responder con una velocidad y un coste parecidos a los de un modelo mucho más pequeño, porque en cada paso solo trabaja una parte. Por eso algunos proveedores ofrecen modelos muy capaces a precios más bajos.

Para qué te sirve en tu negocio

No lo configuras tú, pero explica por qué algunos modelos ofrecen mucha calidad a bajo coste por token, un factor clave al elegir proveedor para automatizaciones con mucho volumen.

Errores comunes

Preguntas frecuentes

¿Qué ventaja tiene un MoE?

Más capacidad con menos cálculo por respuesta.

¿Qué es el router?

La parte del modelo que decide qué expertos se activan.

¿Qué modelos usan MoE?

Varios modelos de Mistral y DeepSeek, entre otros; muchos laboratorios no detallan su arquitectura.

¿Tienes un proyecto con IA en mente?
Te ayudo a aterrizarlo en tu negocio.
¡Te escucho!