Archivo editorial

Inteligencia ArtificialNoticia

Meta lanza Muse Glimmer, un modelo agéntico de 30.000 millones de parámetros que corre en un solo ordenador

Meta presentó el 10 de agosto de 2026 Muse Glimmer, un modelo abierto de 30.000 millones de parámetros bajo licencia Apache 2.0 pensado para ejecutarse por completo en un portátil o una GPU de consumo, sin salir a la nube. No es el modelo abierto más potente del momento, pero apunta a un nicho distinto: empresas y sectores regulados que no pueden sacar sus datos fuera de su propia infraestructura.

Publicado
11 de agosto de 2026
Tiempo
5 min de lectura
Autoría
Redacción Cubix Academia
Profundidad
intermedio
Primer plano macro de un circuito impreso verde con componentes electrónicos soldados

Un modelo de 30.000 millones de parámetros que cabe en un portátil

Meta presentó el 10 de agosto de 2026 Muse Glimmer, un modelo de 30.000 millones de parámetros pensado para ejecutarse en un solo ordenador de consumo, sin depender de la nube. Meta AI Research lo describe en su propio blog como un modelo "agéntico" abierto que corre en local: lo han probado en portátiles MacBook con chips M4-Max y M5-Max y en una tarjeta RTX 5090 de sobremesa. En precisión completa ocupa unos 55 GB, pero la versión cuantizada a 4 bits cabe en 20 GB, dentro del margen de memoria de una GPU de consumo de gama alta una vez descontados la caché y el codificador de percepción visual. Se publica bajo licencia Apache 2.0, la más permisiva de las habituales en modelos abiertos, y está disponible desde el primer día en Hugging Face, Ollama, LM Studio, vLLM, SGLang, Together AI, Fireworks AI y OpenRouter.

La razón que da Meta para construirlo es explícita: "ejecutar modelos en local permite usar la IA en cualquier lugar y en cualquier momento, con o sin conexión a internet". Es una frase que apunta directamente a sectores donde sacar datos a un servidor de terceros es un problema, no una comodidad: sanidad, banca, sector legal y defensa aparecen citados como los casos de uso que Meta tiene en mente.

Cómo se construyó: destilación en tres fases desde Muse Spark

Muse Glimmer no se entrenó desde cero. Es un transformer causal denso, con un codificador de percepción visual de unos 1.800 millones de parámetros capaz de procesar hasta 4.096 tokens visuales por imagen (sin soporte de audio; el vídeo se trata como una secuencia de fotogramas), destilado en tres fases a partir de Muse Spark, el modelo de referencia más grande de Meta. La primera fase destila por logits directamente desde las salidas de Spark; la segunda amplía el entrenamiento a datos de agentes con contexto largo y trazas de razonamiento; la tercera combina ajuste fino supervisado, destilación on-policy y aprendizaje por refuerzo en tareas generales, de razonamiento, de código y de uso de herramientas. El resultado admite una ventana de contexto superior a 131.000 tokens y tiene fecha de corte de conocimiento del 4 de enero de 2026.

Para que quepa en una GPU de consumo, Meta ofrece dos variantes cuantizadas: una a 32 GB de VRAM con una degradación de rendimiento del 0,2% frente al modelo completo, y otra a 24 GB con un 1% de degradación. Con una técnica de generación acelerada llamada DFlash, el modelo alcanza 233 tokens por segundo en una RTX 5090, frente a los 75 tokens por segundo sin esa optimización.