IA
Intelligence artificielle : LLM, agents, diffusion, vision, NLP et les dernières nouvelles des grands laboratoires.
565 published articles
Edge AI
Le runtime exclusivement CPU d'Audio8 fait tenir le clonage vocal dans environ 1 Gio de RAM
Le runtime ONNX d'Audio8 exécute la préversion TTS 0.6B entièrement sur CPU : poids autorégressifs INT4, codec 44,1 kHz intégré, PCM en streaming et endpoint compatible OpenAI. Le service occupe environ 1 Gio de RAM sur un ordinateur portable, et ni PyTorch ni Transformers ne sont nécessaires à l'exécution.
2026-08-05
IA explicable
Le bouton que personne ne voulait tourner : dtControl2+ε permet de sacrifier l'optimalité pour la clarté
Une nouvelle extension de dtControl2 permet aux ingénieurs d'échanger une quantité précise de performance contre des arbres de décision plus petits et plus compréhensibles. L'outil, dtControl2+ε, garantit l'ε-optimalité tout en élaguant les arbres à des ordres de grandeur de nœuds en moins.
2026-08-05
Génération d'images par IA
Reve 2.1 atteint la deuxième place sur Arena avec un dixième de la puissance de calcul
Reve 2.1 revendique la deuxième place au classement général d'Arena tout en étant entraîné avec moins d'un dixième du calcul des laboratoires qui l'entourent. L'entreprise détaille également la sortie 4K, les régions adressables et le rendu de texte multilingue.
2026-08-05
Consolidation de l'IA
Les chercheurs de Reve se dirigent vers OpenAI ; ses produits restent en place
L'investissement d'OpenAI dans le laboratoire indépendant Reve entraîne un transfert de talents en recherche : une partie de l'équipe de recherche en IA de Reve rejoint l'initiative multimodale d'OpenAI tandis que les produits de Reve restent en place. Aucun montant n'a été divulgué.
2026-08-05
Sécurité de l'IA
Le Shieldstral de Mistral place votre politique de modération dans le prompt, pas dans les poids
Shieldstral présente la modération comme une question binaire : une instruction, une requête oui/non, et le contenu à juger. Mistral affirme que le modèle 3B égale des garde-fous open source jusqu'à sept fois sa taille sur la sécurité textuelle, avec des poids sous licence Apache 2.0 qui fonctionnent sur un seul GPU de 16 Go.
2026-08-05
Sécurité de l’IA
Shieldstral, le classifieur 3B qui surclasse des modèles sept fois plus grands
Un classifieur de sécurité 3B égale des modèles de texte presque sept fois plus gros et établit un nouvel état de l'art en modération multimodale, selon un article arXiv de juillet 2026. L'astuce : une modération reformulée en question-réponse binaire, entraînée sur environ 54,1 millions d'échantillons.
2026-08-05
Intelligence artificielle
Les LFM2.5-Encoders plaident pour les petits modèles : 3,7× plus rapides que ModernBERT sur CPU
Les LFM2.5-Encoders open-weight de Liquid AI plaident pour une NLP de production confiée aux petits modèles. Un encodeur de 230M bat ModernBERT-base sur les benchmarks et analyse des documents complets en environ 28 secondes sur un CPU d'ordinateur portable, soit environ 3,7× plus vite.
2026-08-05
Économie du calcul
L'IA a acheté les GPU ; personne n'est chargé de les garder occupés
L'acquisition a une équipe. L'utilisation n'en a pas. Alors que des accords GPU multi-gigawatts se concluent chez quatre fournisseurs, la métrique qui a décidé de l'économie des compagnies aériennes devient la contrainte déterminante de l'IA, et les clusters inactifs perdent de l'argent à l'heure du calendrier.
2026-08-04
Autonomie réseau
Un angle mort de confiance dans les réseaux d'agents multi-fournisseurs trouve une solution
Lorsque l'outil du fournisseur B est compromis, les agents du fournisseur A continuent de l'utiliser sans le savoir. Un nouvel article propose une machine d'état de confiance avec propagation de cascade amortie pour réduire le confinement de plusieurs heures à un temps quasi réel.
2026-08-04
Recherche en IA
Penelope cache son raisonnement dans une seule couche de décodeur pour réduire les coûts d'inférence
Penelope, un framework de raisonnement latent pour Transformers à décodeur seul, localise le calcul récurrent dans un interval étroit du décodeur, réduisant la latence d'inférence sans perte majeure de précision. L'article décrit un curriculum qui déplace le raisonnement des tokens visibles vers une boucle GRU interne.
2026-08-04
IA d'entreprise
La moitié des entreprises asiatiques n'utilisent pas l'anglais pour l'IA. C'est le goulot d'étranglement
L'enquête NielsenIQ d'Alibaba Cloud auprès de 1 000 décideurs informatiques asiatiques révèle que 95 % augmentent leurs budgets IA et que 75 % jugent l'IA indispensable. Le résultat le plus important : seule environ la moitié des entreprises utilisent l'anglais pour l'IA, ce qui fait des modèles en langues locales le prochain goulot d'étranglement.
2026-08-04
Agents IA
Traiter les SOP comme du code : un nouveau runtime à pagination par pile sépare les agents forts des faibles
De nouvelles recherches de Hong Kong et de Chine continentale démontrent que la compilation des SOP en pseudo-code exécutable et leur exécution sur une machine virtuelle à pagination par pile séparent clairement les agents capables des agents fragiles. Le travail donne une règle de déploiement précise : compiler d'abord, paginer seulement après une vérification de discipline au niveau du modèle.
2026-08-04