Inférence locale
2 published articles
IAFeatured4 min read
Modèles d'IA
Le Laguna XS 2.1 de Poolside gagne 5 points sur les benchmarks de codage avec le même matériel
Le Laguna XS 2.1 de Poolside améliore le SWE-bench Multilingue de 5,4 points pour atteindre 63,1 % tout en conservant la même architecture MoE de 33B totaux et 3B activés. La version inclut des points de contrôle quantifiés, des modèles d'ébauche pour le décodage spéculatif et une licence OpenMDW-1.1, rendant le codage IA local plus pratique.
2026-07-21
IAFeatured4 min read
Inférence IA locale
Ollama vient de réécrire son moteur Apple silicon. La génération M5 est la véritable histoire
Ollama présente en aperçu l'inférence basée sur MLX sur Apple silicon, poussant Qwen3.5-35B-A3B à 1 851 tok/s en préremplissage sur M5. Le passage apporte également la quantification NVFP4 pour une parité de production et un cache plus intelligent pour les workflows agentiques.
2026-03-30