SevenTnewS

Apple Silicon

5 published articles

Meta AI3 min read

Inteligencia artificial de código abierto

El Muse Glimmer de 30B de Meta llega primero a Apple Silicon; el soporte para NVIDIA sigue después

Meta lanzó Muse Glimmer, un modelo multimodal de pesos abiertos de 30B diseñado para cargas de trabajo de agentes, y Ollama lo publicó para Apple Silicon el mismo día. DFlash lo hace de 1.5x a 1.8x más rápido en hardware Mac. El soporte para NVIDIA y AMD llegará en los próximos días.

2026-08-13

Meta AIFeatured3 min read

Código abierto

El Muse Glimmer de 30B de Meta llega hoy a Apple Silicon a través del motor MLX de Ollama

Meta abrió los pesos de Muse Glimmer, un modelo denso de 30B, y Ollama lo distribuye el mismo día en Apple Silicon. Los agentes de codificación locales ganan un backend nativo, con Muse Spark 1.2 insinuado para más adelante.

2026-08-10

Pruebas y BenchmarksFeatured3 min read

Rendimiento

Gemma 4 funciona casi un 90 % más rápido en Ollama 0.31 con predicción de múltiples tokens

Ollama 0.31 introduce la predicción de múltiples tokens para Gemma 4 en Apple Silicon, logrando una generación de tokens casi un 90 % más rápida en evaluaciones de codificación. La aceleración proviene de un modelo borrador ajustado automáticamente y un kernel MLX personalizado que elimina lecturas redundantes de pesos.

2026-06-29

VibeCodingFeatured3 min read

Actualización de rendimiento

El motor mlx de Ollama ahora es más rápido y consume menos memoria en Apple Silicon

La actualización del motor MLX de Ollama trae cuantización NVFP4 para modelos de 4 bits de mayor calidad, una inferencia un 20 % más rápida mediante núcleos Metal fusionados y un sistema de almacenamiento en caché de instantáneas que elimina el reprocesamiento del contexto compartido en escenarios multiagente, de modelos de pensamiento y de ramificación.

2026-06-11

IAFeatured4 min read

Inferencia local de IA

Ollama acaba de reescribir su motor para Apple silicon. La generación M5 es la verdadera historia

Ollama presenta una vista previa de inferencia basada en MLX en Apple silicon, llevando a Qwen3.5-35B-A3B a 1.851 tok/s de prefill en M5. El cambio también trae cuantización NVFP4 para paridad en producción y una caché más inteligente para flujos de trabajo de agentes.

2026-03-30