Hoy Meta Superintelligence Labs lanzó Muse Glimmer: un modelo de 30.000 millones de parámetros diseñado para correr completamente en tu computadora, sin nube, sin internet, sin suscripción. Los pesos están disponibles gratis en Hugging Face bajo licencia Apache 2.0, o sea: podés bajarlo, modificarlo y usarlo en proyectos comerciales sin pagar nada.
¿Qué tiene de especial?
La mayoría de los modelos de IA potentes viven en la nube. Muse Glimmer apuesta por lo contrario: que puedas tener un agente de IA siempre disponible en tu máquina, que acceda a tus archivos locales, tu calendario y tus apps sin mandar nada a ningún servidor. Para gaming y creadores de contenido, eso significa cero latencia de red y privacidad total sobre todo lo que le das al modelo.
Técnicamente, los 30B parámetros quedarían en más de 55 GB si estuvieran en precisión completa — demasiado para cualquier GPU de consumo. Meta aplicó cuantización a 4 bits y lo comprimió a menos de 20 GB, lo que lo hace correr en GPUs de 24 GB (como una RTX 4090 o 5080) o 32 GB, junto con la caché y el encoder de imágenes incluidos. También probaron en MacBook con chip M4 Max y M5 Max.
¿Qué puede hacer?
Muse Glimmer fue entrenado específicamente para tareas agénticas, no solo para chatear. Entre sus puntos fuertes están el uso de herramientas (APIs, scripts, archivos), el coding, el seguimiento de instrucciones en múltiples pasos y la capacidad de recuperarse cuando algo falla en lugar de rendirse. También acepta imágenes como entrada, lo que lo hace útil para interpretar capturas de pantalla o documentos.
Meta distilló a Muse Glimmer desde Muse Spark — el modelo grande del que también salió Muse Code — usando un proceso de entrenamiento por fases: primero en los outputs del modelo maestro, luego en datos más agénticos con traces de razonamiento, y finalmente con reinforcement learning. El resultado supera en benchmarks agénticos a Gemma4-31B y Qwen3.6-27B, los competidores directos de tamaño similar.
¿Cómo lo probás?
Podés bajar los pesos desde Hugging Face ahora mismo. En los próximos días llega soporte nativo en Ollama, LM Studio, llama.cpp y MLX (para Mac), que son las apps más usadas para correr LLMs locales. Si tenés una GPU Nvidia, también estará disponible vía vLLM y SGLang para deployment más serio.
Meta también anunció que Muse Spark 1.2, la versión más grande de la familia, va a salir pronto como open weights. Glimmer sería la opción para hardware de consumo; Spark 1.2 apuntaría a servers y máquinas de alta gama.