SevenTnewS

Features

In-depth special reports combining feature, analysis, interview and profile reporting.

31 published features

4 min read

Intelligence Artificielle

Pourquoi la chaîne de pensée de votre IA gaspille des jetons, et comment l'arrêt optimal y remédie

Des chercheurs du MIT proposent OS-Pruner, un plug-in qui arrête dynamiquement le raisonnement par chaîne de pensée lorsque des calculs supplémentaires ne valent pas le coût en jetons. Les tests montrent une réduction de longueur de 20 à 60 % avec un sacrifice de précision minime.

2026-07-29

6 min read

Finance Agentique

La boîte noire de votre portefeuille est sur le point de s’ouvrir : dans les coulisses du premier tracker financier agentique en direct

NextFund enregistre chaque décision prise par un agent de trading IA sur les marchés en direct, permettant aux utilisateurs de comparer les modèles, d’inspecter les justifications et de diagnostiquer les défaillances. Un test sur huit LLM portant sur des actions américaines, chinoises et hongkongaises montre que des signaux intermédiaires similaires peuvent diverger en comportements de portefeuille nettement différents, et que les classements trimestriels basculent selon la métrique privilégiée.

2026-07-27

Featured5 min read

Cyberdéfense

Le Fugu-Cyber de Sakana AI atteint 86,9 % sur les benchmarks de sécurité, mais prévient que les modèles bruts ne sont pas la solution

Sakana AI a publié Fugu-Cyber, un modèle d'orchestration multi-agents égalant les modèles de cybersécurité de pointe sur les benchmarks. L'entreprise soutient que l'accès brut aux modèles ne peut pas remplacer l'expertise humaine et les flux de vérification pour sécuriser les entreprises.

2026-07-21

7 min read

IA biologiquement plausible

Un correctif a sauvé CIFAR-10 et n'a rien fait pour MNIST, et cela devrait inquiéter les chercheurs en IA

L'Error Diffusion de Sakana AI étend l'apprentissage sans rétropropagation, semblable au cerveau, à CIFAR-10 et au RL. Le hic : quels choix de conception sont importants s'inverse entre les benchmarks, et le coût du principe de Dale augmente avec la difficulté de la tâche.

2026-07-19

5 min read

Recherche agentielle gouvernée

Le nouvel IA scientifique de Nvidia travaille sans jamais toucher aux données des patients

Le Nvidia AI Technology Center dévoile NAIS, un système de recherche agentielle gouverné qui orchestre des workflows biomédicaux de bout en bout sur des données hospitalières protégées. Dans un déploiement réel de GWAS sur l'hypertension impliquant 286 422 individus, le système a produit des résultats comparables à des analyses menées par des experts tout en préservant la vie privée et en permettant une supervision humaine.

2026-07-19

Featured5 min read

IA locale

Le paradoxe du modèle non censuré : moins de refus, moins de sécurité, et pourquoi l'IA locale reste importante

Le benchmarking de cinq LLM non censurés exécutés localement montre que l'abliteration réduit les sur-refus de 44 % à près de zéro sans impact sur le raisonnement, mais la même modification fait chuter les refus de sécurité de 41,5 % à 9,5 %, car les deux reposent sur la même direction interne. La véritable raison d'utiliser un modèle non censuré n'est peut-être pas celle que vous pensez.

2026-07-19

6 min read

Orchestration de modèles

Sakana AI veut faire du choix d'un LLM le problème de quelqu'un d'autre

Fugu de Sakana AI achemine chaque tâche vers un modèle spécialisé derrière une API unique, promettant moins de frais d'intégration et un meilleur rapport coût-performance. Il atterrit dans une catégorie en pleine formation où le modèle lui-même devient un détail d'implémentation.

2026-07-18

Featured5 min read

rapport spécial / edge AI

Nvidia DeepStream passe en open source : ce que la version 9.1 signifie pour l'edge AI

Le code source complet du SDK d'analyse vidéo DeepStream de Nvidia est désormais sur GitHub sous les licences Apache 2.0 et CC-BY-4.0, ouvrant le développement de l'edge AI à un public plus large. La version 9.1 apporte des agents de codage basés sur des LLM, l'intégration du serveur d'inférence Triton et des dépôts consolidés pour des pipelines de bout en bout.

2026-07-16

5 min read

Théorie de l'apprentissage automatique

Pourquoi les modèles de diffusion interpolent, et ne se contentent pas de mémoriser : une théorie mathématique de la créativité

Les chercheurs de Google révèlent que la créativité des modèles de diffusion provient d'un effet de 'lissage du score' causé par la régularisation des réseaux de neurones. Ce cadre théorique explique pourquoi les modèles interpolent entre les points de données d'entraînement plutôt que de simplement les mémoriser, ouvrant la voie à une nouveauté contrôlée dans l'IA générative.

2026-07-16

5 min read

Le dossier de dépréciation

Mistral AI vient de supprimer la moitié de sa famille de modèles. Voici ce qui a survécu et pourquoi.

Un audit à la mi-2026 du portefeuille de modèles de Mistral AI révèle 36 modèles actifs répartis en niveaux frontière, spécialiste et héritage, avec 19 modèles devant être dépréciés d'ici la mi-2026. La stratégie de l'entreprise met l'accent sur de petits modèles spécialisés pour les agents et le codage, tout en dépréciant les variantes expérimentales comme Magistrate et les premières versions de Devstral.

2026-07-13

Featured4 min read

Rapport spécial

Le changement le plus discret dans l'IA d'entreprise cette année est un pari selon lequel les agents travaillent mieux en meute

OpenAI lance les agents d'espace de travail : des travailleurs IA persistants et basés dans le cloud qui fonctionnent dans ChatGPT et Slack, gèrent des flux de travail multi-étapes et partagent le contexte entre les équipes. Gratuit jusqu'au 6 mai 2026, puis basé sur des crédits. Un changement structurel des GPTs vers l'IA organisationnelle.

2026-07-11

Featured3 min read

Grok 4.5

Le Grok 4.5 de Cursor a été construit par des agents IA, pas par des humains. C'est ça, la vraie histoire.

Le Grok 4.5 de Cursor est un modèle Mixture-of-Experts construit par apprentissage par renforcement dans des environnements créés par des agents IA antérieurs, et non par des humains. Il gère des tâches complexes et longues dans les domaines du génie logiciel, de la science des données, de la finance et du droit, et est disponible dès maintenant.

2026-07-10

← PreviousPage 2 / 3 · 31 featuresNext →