Apple Silicon
5 published articles
Inteligencia artificial de código abierto
El Muse Glimmer de 30B de Meta llega primero a Apple Silicon; el soporte para NVIDIA sigue después
Meta lanzó Muse Glimmer, un modelo multimodal de pesos abiertos de 30B diseñado para cargas de trabajo de agentes, y Ollama lo publicó para Apple Silicon el mismo día. DFlash lo hace de 1.5x a 1.8x más rápido en hardware Mac. El soporte para NVIDIA y AMD llegará en los próximos días.
2026-08-13
Código abierto
El Muse Glimmer de 30B de Meta llega hoy a Apple Silicon a través del motor MLX de Ollama
Meta abrió los pesos de Muse Glimmer, un modelo denso de 30B, y Ollama lo distribuye el mismo día en Apple Silicon. Los agentes de codificación locales ganan un backend nativo, con Muse Spark 1.2 insinuado para más adelante.
2026-08-10
Rendimiento
Gemma 4 funciona casi un 90 % más rápido en Ollama 0.31 con predicción de múltiples tokens
Ollama 0.31 introduce la predicción de múltiples tokens para Gemma 4 en Apple Silicon, logrando una generación de tokens casi un 90 % más rápida en evaluaciones de codificación. La aceleración proviene de un modelo borrador ajustado automáticamente y un kernel MLX personalizado que elimina lecturas redundantes de pesos.
2026-06-29
Actualización de rendimiento
El motor mlx de Ollama ahora es más rápido y consume menos memoria en Apple Silicon
La actualización del motor MLX de Ollama trae cuantización NVFP4 para modelos de 4 bits de mayor calidad, una inferencia un 20 % más rápida mediante núcleos Metal fusionados y un sistema de almacenamiento en caché de instantáneas que elimina el reprocesamiento del contexto compartido en escenarios multiagente, de modelos de pensamiento y de ramificación.
2026-06-11
Inferencia local de IA
Ollama acaba de reescribir su motor para Apple silicon. La generación M5 es la verdadera historia
Ollama presenta una vista previa de inferencia basada en MLX en Apple silicon, llevando a Qwen3.5-35B-A3B a 1.851 tok/s de prefill en M5. El cambio también trae cuantización NVFP4 para paridad en producción y una caché más inteligente para flujos de trabajo de agentes.
2026-03-30