Qwen y Géminis pueden esconderse. El meta tiene un nuevo rey

Meta ella presentó Muse Glimmer, un nuevo modelo de IA abierta preparado pensando en el trabajo local. En lugar de otro sistema enorme que requiere granjas de servidores enteras, obtenemos una solución con 30 mil millones de parámetrosque está diseñado para ejecutarse en una computadora equipada con una tarjeta gráfica estándar.

Más texto debajo del vídeo.

Pequeño modelo, grandes posibilidades.

Muse Glimmer puede mucho más que simplemente tener una conversación. Fue entrenado en términos de razonamiento en múltiples etapas, uso de herramientas, realización independiente de tareas complejas y manejo de errores durante el trabajo. El modelo también admite imágenes, por lo que puede analizar, entre otros: capturas de pantalla, gráficos y documentos. Esto es para lo que fue entrenado datos en más de 100 idiomas.

Meta comparó Muse Glimmer 30B con las IA locales más populares en la actualidad, es decir Gemma 4-31B y Qwen 3.6-27Ben muchas pruebas de ella el nuevo resultó ser mejor. En el MCP Atlas, que prueba el uso de herramientas, Glimmer obtuvo 75,5 puntos frente a los 54,2 de Gemma y los 62,5 de Qwen. En DeepSearch QA fue de 74,6, 61,7 y 71,1 puntos, respectivamente, mientras que en WildClawBench el modelo Meta obtuvo 47,6 puntos frente a los 37,6 y 43,2 de sus rivales.

Qwen y Géminis pueden esconderse. El meta tiene un nuevo rey

Sin embargo, Glimmer no gana en todas partes. – Qwen3.6-27B sigue siendo mejor, entre otros en SWE-Bench Verified, Terminal-Bench 2.1 y OSWorld-Verified. Vale la pena señalar que algunos de los resultados provienen de pruebas internas de Meta, aunque la empresa intentó utilizar un entorno y una metodología comunes para todos los modelos.

GeForce RTX 5090 lo acelera a 233 tokens por segundo

La versión completa de Muse Glimmer 30B requeriría más de 55 GB de memoriapor lo que Meta utilizó una cuantificación de aproximadamente 4 bits. Esto nos permitió reducir el modelo en sí a menos de 20 GB. La variante K-Quant-17GB fue diseñada para sistemas con 24 GB de VRAM, y según mediciones Meta la pérdida de calidad promedio en relación con la precisión total es aproximadamente del 1%.

Qwen y Géminis pueden esconderse. El meta tiene un nuevo rey

La velocidad de generación es aún más interesante. Gracias a la tecnología «decodificación especulativa» y la red adicional DFlash Muse Glimmer en GeForce RTX 5090 acelera de 74,9 a 233 tokens por segundo, o aproximadamente 3,1 veces. En el Apple M5 Max el aumento es de 26,6 a 50 tokens por segundo, y en el M4 Max de 23,7 a 38 tokens por segundo. Todo funciona de forma local, sin necesidad de enviar consultas a la nube.

Muse Glimmer ya está disponible para descargar. Meta también anuncia soporte, entre otros: para Ollama, LM Studio, Unsloth, llama.cpp, MLX y ExecuTorch, lo que debería hacer mucho más fácil ejecutar el modelo en su propia PC.

MuyMóvil

MuyMóvil es un sitio web dedicado al universo de la tecnología móvil y la informática.

[email protected]