SevenTnewS

poids ouverts

9 published articles

LLM & Modèles4 min read

TTS open-weight

Magpie TTS consomme 32 ms du budget de latence de votre agent vocal

Magpie TTS annonce un délai de 32 ms avant le premier audio sur un NVIDIA B200 et ajoute l'arabe, le coréen et le portugais brésilien, portant son catalogue à 12 langues. L'argument des poids ouverts : la synthèse vocale auto-hébergée ne perd plus la bataille de la latence.

2026-08-16

Meta AIFeatured3 min read

Open Source

Muse Glimmer 30B de Meta arrive sur Apple Silicon aujourd'hui via le moteur MLX d'Ollama

Meta a ouvert les poids de Muse Glimmer, un modèle dense de 30B, et Ollama le propose le jour même sur Apple Silicon. Les agents de codage locaux gagnent un backend natif, avec Muse Spark 1.2 annoncé pour plus tard.

2026-08-10

LLM & Modèles5 min read

Génération vidéo

MiniMax a abandonné son architecture éprouvée pour que H3 fasse tout

MiniMax affirme que H3 unifie la génération de texte, d'image, de vidéo et d'audio dans un seul modèle, facture la sortie 2K à moins d'un tiers du prix des modèles grand public, et prévoit d'ouvrir les poids dans les prochains jours. Les petites lignes sont la véritable histoire : l'entreprise a abandonné l'architecture qui lui donnait un avantage pour y parvenir.

2026-08-07

Qwen / Alibaba4 min read

Les poids ouverts de Qwen3.8-Max arrivent la semaine prochaine

Le modèle le plus puissant jamais conçu par Alibaba passe en open source

Qwen3.8-Max, le premier modèle open-weight de classe Max d'Alibaba à 2,4 billions de paramètres, débarque sur Hugging Face et ModelScope la semaine prochaine. Ce lancement reformule la question de l'open source : que se passe-t-il quand les poids les plus importants de la frontière sont libres à télécharger et à tester ?

2026-08-06

Mistral AIFeatured4 min read

Sécurité de l'IA

Le Shieldstral de Mistral place votre politique de modération dans le prompt, pas dans les poids

Shieldstral présente la modération comme une question binaire : une instruction, une requête oui/non, et le contenu à juger. Mistral affirme que le modèle 3B égale des garde-fous open source jusqu'à sept fois sa taille sur la sécurité textuelle, avec des poids sous licence Apache 2.0 qui fonctionnent sur un seul GPU de 16 Go.

2026-08-05

IAFeatured5 min read

Coalition de rivaux

OpenAI, Meta et 40 autres signent une lettre sur la politique de l'IA. Voici pourquoi c'est important.

Quarante et une organisations de tout l'écosystème de l'IA ont signé conjointement une lettre ouverte affirmant que les modèles à poids ouverts sont essentiels au leadership américain en IA. La coalition inhabituelle comprend des rivaux comme OpenAI et Meta, des géants du cloud et des startups, signalant un rare consensus politique.

2026-07-26

Mistral AI3 min read

Agents IA

Agents de codage Mistral : votre ordinateur portable n'est plus nécessaire, sessions parallèles sans surveillance

Mistral déplace les agents de codage vers le cloud, permettant l'exécution parallèle et asynchrone de tâches via le nouveau modèle Mistral Medium 3.5. La mise à jour introduit des agents distants dans Mistral Vibe et Le Chat, ainsi qu'un mode Work pour les tâches multi-étapes, tout en gardant une supervision humaine pour les actions sensibles.

2026-07-12

LLM & ModèlesFeatured4 min read

Analyse des poids ouverts

Gemma 4 n’est pas un chatbot, et c’est l’essentiel

Gemma 4 de Google DeepMind est un modèle à poids ouverts conçu pour l’auto-hébergement et la personnalisation, et non pour le chat grand public. Cette analyse le compare à ChatGPT, Claude et Qwen-3.5 sur les aspects licence, confidentialité et flexibilité de déploiement, révélant pourquoi il est important pour les industries réglementées et l’IA sur appareil.

2026-07-10

DeepSeek4 min read

Recherche en IA open source

Contexte d'un million de tokens avec un dixième du cache KV : le pari d'efficacité de DeepSeek-V4

L'aperçu V4 de DeepSeek associe un modèle Pro de 1,6T de paramètres à une variante Flash de 284B, tous deux avec un contexte d'un million de tokens. Le document revendique 27 % des FLOPs d'inférence et 10 % du cache KV de V3.2, soit les chiffres qui rendent ce contexte rentable à servir.

2026-06-22