SevenTnewS

Apache 2.0

9 published articles

LLM & Modèles5 min read

IA à poids ouverts

dots3-note de Xiaohongshu : un MoE ouvert de 280B qui n'active que 16B

Le studio dots de Xiaohongshu a publié dots3-note preview, son premier modèle à poids ouverts : un MoE multimodal de 280B de paramètres, 16B actifs et une fenêtre de contexte de 512K. La conception sparse vise un faible coût d'inférence sur un nœud de 8 GPU, mais la fiche technique n'a pas encore publié de chiffres de benchmarks.

2026-08-20

Meta AIFeatured4 min read

IA open source

Muse Glimmer : l'agent 30B de Meta tient sous 20 Go, cloud en option

Meta a open-sourcé Muse Glimmer, un modèle agentique de 30B qui fonctionne hors ligne sur un seul GPU grand public. La quantification le maintient sous 20 Go, un drafter DFlash offre un décodage jusqu'à 3,1x plus rapide sur un RTX 5090, et les poids sont sur Hugging Face sous licence Apache 2.0.

2026-08-10

Mistral AIFeatured4 min read

Sécurité de l'IA

Le Shieldstral de Mistral place votre politique de modération dans le prompt, pas dans les poids

Shieldstral présente la modération comme une question binaire : une instruction, une requête oui/non, et le contenu à juger. Mistral affirme que le modèle 3B égale des garde-fous open source jusqu'à sept fois sa taille sur la sécurité textuelle, avec des poids sous licence Apache 2.0 qui fonctionnent sur un seul GPU de 16 Go.

2026-08-05

IAFeatured1 min read

TTS Open Source

Le nouveau modèle TTS d'Audio8 clone les voix en 11 langues gratuitement

Audio8 publie Audio8-TTS Preview sous licence Apache 2.0, un modèle de 0,6B prenant en charge 11 langues, le clonage vocal zero-shot, et un codec 44,1 kHz intégré. Cette version cible les applications vocales en périphérie nécessitant rapidité et confidentialité.

2026-07-30

IA4 min read

IA en périphérie

Mistral Nano fonctionne sur des appareils avec moins de 1 Go de RAM, atteignant 85 % des scores de raisonnement de son grand frère

Le nouveau Mistral Nano de Mistral AI cible les appareils en périphérie avec moins de 1 Go de RAM, atteignant 85 % des performances de raisonnement de son modèle plus grand Mistral Small sur les benchmarks standards.

2026-07-25

Open SourceFeatured3 min read

IA Open Source

480 millisecondes et open source : Voxtral Realtime défie Whisper sur son propre terrain

Voxtral Realtime atteint une qualité de transcription hors ligne avec une latence inférieure à la seconde et est open source. Le modèle multilingue (13 langues) utilise un nouvel encodeur audio causal et est entraîné de bout en bout pour le flux continu, plutôt que d'être adapté à partir de systèmes hors ligne.

2026-07-17

LLM & Modèles2 min read

IA multimodale

Un modèle de 12B bat un modèle de 90B. L'orthodoxie du scaling est en difficulté

Pixtral-12B égale ou bat des modèles sept fois plus grands sur des benchmarks multimodaux, sans sacrifier les performances linguistiques. Mistral publie également un nouveau benchmark ouvert pour l'évaluation pratique vision-langage, remettant en cause l'idée que plus grand est toujours meilleur.

2026-07-17

LLM & ModèlesFeatured5 min read

LLMs & Modèles

La recette de cascade de Mistral réduit les LLMs sans tuer le raisonnement

La distillation en cascade de Mistral réduit les grands modèles en petits tout en préservant le raisonnement et la vision. La variante 3B offre des capacités qui nécessitaient auparavant dix fois plus de paramètres, et le tout sous licence Apache 2.0.

2026-07-17

LLM & ModèlesFeatured4 min read

Google DeepMind

Gemma 4 vient de donner l’impression que tous les autres modèles open-weight sont 10 fois trop gros

La famille open-weight nativement multimodale Gemma 4 de Google DeepMind introduit un mode de réflexion, une architecture sans codeur et des options MoE. Le modèle à 2,3 milliards de paramètres correspond aux performances du Gemma 3 à 27 milliards. Le modèle à 31 milliards domine les classements open-weight.

2026-07-13