LLM & Modèles
Grands modèles de langage : GPT, Claude, Gemini, Mistral et poids ouverts.
93 published articles
Génération musicale par IA
Music 3.0 remplace la consigne à balise unique par une chronologie qui garde les chansons IA sur la bonne voie
Les pistes IA ont tendance à s'écarter de la consigne au fil de leur déroulement : les instruments disparaissent, l'émotion s'aplatit, le style vocal va et vient. Music 3.0 remplace la description à balise unique par une Structured Caption séquentielle dans le temps, soutenue par un Hybrid-LM 8B/0,6B qui sépare la structure du détail.
2026-08-21
IA à poids ouverts
dots3-note de Xiaohongshu : un MoE ouvert de 280B qui n'active que 16B
Le studio dots de Xiaohongshu a publié dots3-note preview, son premier modèle à poids ouverts : un MoE multimodal de 280B de paramètres, 16B actifs et une fenêtre de contexte de 512K. La conception sparse vise un faible coût d'inférence sur un nœud de 8 GPU, mais la fiche technique n'a pas encore publié de chiffres de benchmarks.
2026-08-20
IA open source
Boris-2 nourrit son modèle 125M avec 90B tokens, et son 250M avec seulement 60B
Boris-2 pré-annonce trois petits modèles avec des budgets de tokens déséquilibrés : le 125M reçoit 90B tokens, le 250M seulement 60B. L'entraînement se déroule du 12 août au 10 septembre, sans benchmark partagé, seulement l'ambition déclarée d'atteindre la puissance de SmolLM2-135M.
2026-08-16
Génération vidéo par IA
Le Wan3.0 d'Alibaba vend la vidéo à la seconde : 6 $ pour un clip de 30 secondes
Le Wan3.0 peut transformer un PDF ou un dossier de marque en vidéo de 30 secondes en une seule génération, avec une tarification à la seconde qui plafonne à 0,20 $ pour la 1080P. Nous détaillons le calcul par clip et les lacunes qu'Alibaba reconnaît dans ses propres tests.
2026-08-16
TTS open-weight
Magpie TTS consomme 32 ms du budget de latence de votre agent vocal
Magpie TTS annonce un délai de 32 ms avant le premier audio sur un NVIDIA B200 et ajoute l'arabe, le coréen et le portugais brésilien, portant son catalogue à 12 langues. L'argument des poids ouverts : la synthèse vocale auto-hébergée ne perd plus la bataille de la latence.
2026-08-16
Agents IA embarqués
LFM2.5-2.6B : le petit agent qui distance des modèles 4 fois plus gros
Le LFM2.5-2.6B de Liquid AI fait tenir un modèle agentique dans 2,6 milliards de paramètres et moins de 2,5 Go de mémoire, et domine tous les benchmarks de suivi d'instructions sur lesquels il a été testé. Il tourne à 220 tokens/s sur un ordinateur portable ; le code est la seule lacune claire.
2026-08-12
Guerre des prix de l'IA
Le prix viral de 0,07 $ du GLM-5.2 de Zhipu aurait déjà été multiplié par 10, selon une réponse
Le GLM-5.2 de Zhipu est devenu viral à 0,07 $ par million de jetons, une baisse de 95 % qualifiée de « presque gratuit » par les internautes. Une réponse affirme que le prix a rebondi de 10 fois, un coup de pub pour attirer les regards. Les praticiens ajoutent que le GLM-5.2 n'a jamais été jugé de niveau de pointe lors des tests.
2026-08-10
Recherche
Votre modèle d'IA utilisant des outils complique les questions faciles
Un nouvel article de KlingTeam mesure quand les modèles multimodaux ont réellement besoin d'outils et quand les outils nuisent. Le modèle Beacon proposé, entraîné avec des récompenses sensibles à la nécessité, améliore à la fois la précision et la discipline d'utilisation des outils.
2026-08-09
Génération vidéo
MiniMax a abandonné son architecture éprouvée pour que H3 fasse tout
MiniMax affirme que H3 unifie la génération de texte, d'image, de vidéo et d'audio dans un seul modèle, facture la sortie 2K à moins d'un tiers du prix des modèles grand public, et prévoit d'ouvrir les poids dans les prochains jours. Les petites lignes sont la véritable histoire : l'entreprise a abandonné l'architecture qui lui donnait un avantage pour y parvenir.
2026-08-07
Course des petits modèles
BananaMind 2 Micro : 2,9M de paramètres, 75B de jetons et un pari sur un surentraînement extrême
BananaMind 2 Micro comptera 2,9M de paramètres et sera entraîné sur 75B de jetons, soit environ 25 900 jetons par paramètre. L'entraînement commence le 3 août, la sortie est estimée du 4 au 6 août, et un aperçu public de BananaMind 2 Pro arrive le même jour. Aucun benchmark n'a été partagé.
2026-08-06
Sécurité de l’IA
Shieldstral, le classifieur 3B qui surclasse des modèles sept fois plus grands
Un classifieur de sécurité 3B égale des modèles de texte presque sept fois plus gros et établit un nouvel état de l'art en modération multimodale, selon un article arXiv de juillet 2026. L'astuce : une modération reformulée en question-réponse binaire, entraînée sur environ 54,1 millions d'échantillons.
2026-08-05
Intelligence artificielle
Les LFM2.5-Encoders plaident pour les petits modèles : 3,7× plus rapides que ModernBERT sur CPU
Les LFM2.5-Encoders open-weight de Liquid AI plaident pour une NLP de production confiée aux petits modèles. Un encodeur de 230M bat ModernBERT-base sur les benchmarks et analyse des documents complets en environ 28 secondes sur un CPU d'ordinateur portable, soit environ 3,7× plus vite.
2026-08-05