IA Locale
6 published articles
Modèles d'IA | NVIDIA Nemotron 3.5 Lightning
Pourquoi Nemotron 3.5 Lightning parie que la plupart des étapes d'un agent n'ont pas besoin d'un gros modèle
Le nouveau modèle ouvert de Nvidia fonctionne localement avec 3 milliards de paramètres actifs et un contexte d'un million de jetons, conçu pour les agents qui restent actifs. Nvidia revendique jusqu'à 4 fois le débit et une exécution des tâches 30 % plus rapide que les modèles ouverts comparables.
2026-08-14
Sortie de code
XAI publie le code source de Grok Build, son agent de codage, permettant de l'exécuter entièrement en local
xAI a open-sourcé Grok Build, son agent de codage natif en terminal. Le code comprend la boucle de l'agent, le système d'outils, l'interface TUI et le framework d'extension. Les développeurs peuvent le compiler eux-mêmes et l'exécuter entièrement en local avec leur propre backend d'inférence.
2026-07-19
IA locale
Le paradoxe du modèle non censuré : moins de refus, moins de sécurité, et pourquoi l'IA locale reste importante
Le benchmarking de cinq LLM non censurés exécutés localement montre que l'abliteration réduit les sur-refus de 44 % à près de zéro sans impact sur le raisonnement, mais la même modification fait chuter les refus de sécurité de 41,5 % à 9,5 %, car les deux reposent sur la même direction interne. La véritable raison d'utiliser un modèle non censuré n'est peut-être pas celle que vous pensez.
2026-07-19
Tour de financement
Ollama lève 88 millions de dollars pour apporter l'IA open source au Fortune 500
Ollama lève 88 millions de dollars auprès de Benchmark et du fondateur de Docker Solomon Hykes pour développer sa plateforme de modèles ouverts, désormais utilisée par 8,9 millions de développeurs et 85 % des entreprises du Fortune 500, visant à faire de la propriété locale d'IA la norme.
2026-07-09
IA locale
Ollama 0.30 apporte une inférence GPU plus rapide et une prise en charge native des modèles GGUF
Ollama 0.30 booste l'inférence NVIDIA jusqu'à 20 %, active la prise en charge GPU Vulkan par défaut pour les appareils AMD et Intel, et étend la compatibilité des modèles GGUF, y compris les modèles affinés de Hugging Face et la prise en charge des appels d'outils avec des agents de codage.
2026-06-05
Intelligence artificielle
OpenJarvis propose une alternative locale-first aux agents IA basés sur le cloud
OpenJarvis 1.0 des laboratoires Hazy Research et Scaling Intelligence de Stanford permet aux agents IA personnels de fonctionner localement via Ollama, avec un accès optionnel au cloud. Il inclut des présélections pour les briefings matinaux, la recherche dans des documents et les assistants de codage locaux, en priorisant l'efficacité et la confidentialité tout en suivant l'énergie, le coût et la latence.
2026-05-28