SevenTnewS

génération d'images

7 published articles

Vision & DiffusionFeatured3 min read

Génération d'images par IA

Reve 2.1 atteint la deuxième place sur Arena avec un dixième de la puissance de calcul

Reve 2.1 revendique la deuxième place au classement général d'Arena tout en étant entraîné avec moins d'un dixième du calcul des laboratoires qui l'entourent. L'entreprise détaille également la sortie 4K, les régions adressables et le rendu de texte multilingue.

2026-08-05

IAFeatured2 min read

Stratégie IA

Les modèles d'IA internes de Microsoft réduisent les coûts de production de 89 %

Les modèles MAI maison de Microsoft sont en production, offrant des économies de coûts spectaculaires dans plusieurs produits. Ces chiffres signalent un changement stratégique : l'entreprise rivalise désormais sur l'efficacité d'inférence, pas seulement sur la qualité des modèles.

2026-07-29

IA4 min read

Intelligence artificielle

Le modèle d'image à 4 milliards de paramètres de Microsoft fonctionne sur un seul A100 et défie les systèmes à 30B

Mage-Flow de Microsoft est un modèle compact de 4 milliards de paramètres pour la génération et l'édition d'images qui égale des systèmes ouverts plus grands comme Qwen-Image et FLUX.2 tout en fonctionnant sur un seul GPU A100 à des vitesses interactives. Son innovation clé est un tokenizer léger qui réduit les coûts de codage par 12.

2026-07-26

IA3 min read

Analyse des coûts

Les modèles d'IA internes de Microsoft réduisent les coûts GPU jusqu'à 89 % en production

Microsoft fait état d'une réduction de 84 % des coûts GPU pour la génération d'images et de 89 % pour la voix avec ses modèles MAI-2.5 et MAI-Voice-2-Flash désormais en production sur Bing, PowerPoint et Dynamics 365. La stratégie des modèles internes offre des avantages de coûts mesurables par rapport aux alternatives tierces.

2026-07-24

Outils & FrameworksFeatured3 min read

Génération d'images

Le Qwen-Image-3.0 d'Alibaba fait du rendu de texte un argument de productivité

L'équipe Qwen d'Alibaba a publié Qwen-Image-3.0, un modèle de génération d'images de troisième génération qui privilégie le contenu dense et l'utilisabilité pratique plutôt que le polissage esthétique. Le modèle accepte des prompts allant jusqu'à 4 500 tokens, rend le texte lisible à 10 pixels et génère des pages complètes de journaux ou des infographies multi-cellules en un seul passage.

2026-07-23

LLM & ModèlesFeatured5 min read

Recherche en IA

Apprentissage par renforcement pour la génération d'images : Qwen-Image-2.0-RL adopte un système de récompense composite

Le rapport Qwen-Image-2.0-RL détaille un pipeline de post-entraînement combinant RLHF, distillation sur politique et modèles de récompense composites pour améliorer la qualité de la génération texte-image et de l'édition d'images. L'approche produit des gains mesurables en qualité esthétique, respect des instructions et préservation de l'identité faciale.

2026-07-20

Qwen / AlibabaFeatured5 min read

Stratégie de portefeuille

Le Qwen d'Alibaba construit un modèle pour chaque tâche IA, pas un seul pour tous les dominer

L'équipe Qwen d'Alibaba Cloud a discrètement publié un modèle de monde agent MoE 35B, trois nouveaux modèles ASR et un rapport RL sur la génération d'images, révélant un pari stratégique sur l'étendue plutôt que le spectacle dans la course aux modèles IA.

2026-07-09