CourionAI
ES
Boletín
← Glosario Término

Mezcla de expertos

Un diseño de modelos en el que solo se ejecuta una pequeña parte de la red para cada solicitud, lo que abarata el uso de modelos grandes.

En un modelo de mezcla de expertos, la red se divide en muchas subredes y un enrutador elige solo unas pocas para cada entrada. Por eso estos modelos se describen con dos cifras, por ejemplo 284.000 millones de parámetros totales y 13.000 millones activos. La primera indica el tamaño completo; la segunda, la parte que se ejecuta cada vez.

El efecto práctico es que obtienes el conocimiento de un modelo muy grande con un coste de ejecución más próximo al de uno pequeño. Casi todos los modelos abiertos recientes, desde DeepSeek hasta Inkling de Thinking Machines, utilizan este diseño. El inconveniente tradicional era la memoria, porque seguía siendo necesario cargar el modelo completo aunque solo se usara una parte. Sistemas como Swiftlet reducen ese problema al cargar desde el disco los expertos inactivos cuando hacen falta.