SevenTnewS

IA Locale

6 published articles

NVIDIA Research4 min read

Modèles d'IA | NVIDIA Nemotron 3.5 Lightning

Pourquoi Nemotron 3.5 Lightning parie que la plupart des étapes d'un agent n'ont pas besoin d'un gros modèle

Le nouveau modèle ouvert de Nvidia fonctionne localement avec 3 milliards de paramètres actifs et un contexte d'un million de jetons, conçu pour les agents qui restent actifs. Nvidia revendique jusqu'à 4 fois le débit et une exécution des tâches 30 % plus rapide que les modèles ouverts comparables.

2026-08-14

Open SourceFeatured2 min read

Sortie de code

XAI publie le code source de Grok Build, son agent de codage, permettant de l'exécuter entièrement en local

xAI a open-sourcé Grok Build, son agent de codage natif en terminal. Le code comprend la boucle de l'agent, le système d'outils, l'interface TUI et le framework d'extension. Les développeurs peuvent le compiler eux-mêmes et l'exécuter entièrement en local avec leur propre backend d'inférence.

2026-07-19

IAFeatured5 min read

IA locale

Le paradoxe du modèle non censuré : moins de refus, moins de sécurité, et pourquoi l'IA locale reste importante

Le benchmarking de cinq LLM non censurés exécutés localement montre que l'abliteration réduit les sur-refus de 44 % à près de zéro sans impact sur le raisonnement, mais la même modification fait chuter les refus de sécurité de 41,5 % à 9,5 %, car les deux reposent sur la même direction interne. La véritable raison d'utiliser un modèle non censuré n'est peut-être pas celle que vous pensez.

2026-07-19

Levée de fondsFeatured4 min read

Tour de financement

Ollama lève 88 millions de dollars pour apporter l'IA open source au Fortune 500

Ollama lève 88 millions de dollars auprès de Benchmark et du fondateur de Docker Solomon Hykes pour développer sa plateforme de modèles ouverts, désormais utilisée par 8,9 millions de développeurs et 85 % des entreprises du Fortune 500, visant à faire de la propriété locale d'IA la norme.

2026-07-09

Outils & FrameworksFeatured3 min read

IA locale

Ollama 0.30 apporte une inférence GPU plus rapide et une prise en charge native des modèles GGUF

Ollama 0.30 booste l'inférence NVIDIA jusqu'à 20 %, active la prise en charge GPU Vulkan par défaut pour les appareils AMD et Intel, et étend la compatibilité des modèles GGUF, y compris les modèles affinés de Hugging Face et la prise en charge des appels d'outils avec des agents de codage.

2026-06-05

LLM & Modèles4 min read

Intelligence artificielle

OpenJarvis propose une alternative locale-first aux agents IA basés sur le cloud

OpenJarvis 1.0 des laboratoires Hazy Research et Scaling Intelligence de Stanford permet aux agents IA personnels de fonctionner localement via Ollama, avec un accès optionnel au cloud. Il inclut des présélections pour les briefings matinaux, la recherche dans des documents et les assistants de codage locaux, en priorisant l'efficacité et la confidentialité tout en suivant l'énergie, le coût et la latence.

2026-05-28