Routage en vase clos
Sakana AI lance Fugu Ultra 1.1, un routeur qui choisit le modèle pour vous
Sakana AI a publié Fugu Ultra 1.1, une couche de routage qui sélectionne et alterne entre des modèles spécialisés pour chaque tâche derrière une API unique. L'entreprise affirme que cela réduit la complexité d'intégration et améliore le rapport coût-performance en regroupant des modèles que l'utilisateur n'a pas besoin de choisir directement.
Emmanuel Fabrice Omgbwa Yasse Assisté par IA
2026-07-24 · 3 min de lecture

Quand chaque produit d'IA commence par la même question, quel modèle utiliser ?, une réponse est de ne plus poser la question à l'utilisateur. Le Fugu Ultra 1.1 de Sakana AI, annoncé cette semaine, fait exactement cela : il présente une seule interface API et décide en interne quel modèle spécialisé gère chaque tâche entrante.
Le produit est une couche de routage, pas un nouveau modèle fondamental. Fugu se place entre l'application et un ensemble de modèles, certains de Sakana, d'autres de tiers, et achemine les requêtes en fonction du coût estimé et des capacités. L'entreprise affirme que cette approche évite la surcharge d'intégration liée à la gestion manuelle de plusieurs clés API, points d'accès et changements de version.

Ce n'est pas une idée nouvelle en soi. Plusieurs fournisseurs proposent désormais des routeurs de modèles, notamment OpenRouter et Together AI, bien que la plupart laissent la politique de routage relativement transparente pour le développeur. Fugu vise à rendre la sélection totalement opaque : le développeur envoie une requête et reçoit une réponse, sans visibilité sur le modèle qui l'a exécutée.
La proposition de valeur est simple. Les modèles spécialisés surpassent presque toujours un modèle généraliste en termes de coût ou de latence pour des tâches spécifiques. Mais choisir lequel appeler pour chaque requête est un travail d'ingénierie : écrire des classifieurs, maintenir une logique de repli, surveiller les limites de taux. Fugu repousse ce travail dans le routeur.
Sakana positionne le produit pour des charges de travail en production où le coût par jeton compte plus que la transparence du modèle. L'entreprise n'a pas divulgué le prix ni une liste complète des modèles pris en charge dans l'annonce, mais a déclaré que Fugu fonctionne sur sa propre infrastructure d'inférence.
Ce lancement s'inscrit dans une catégorie en pleine formation. Les routeurs de modèles deviennent discrètement une couche d'infrastructure, un peu comme les passerelles API l'ont fait pour les microservices. Le modèle lui-même devient un détail d'implémentation, un bien de consommation échangé par une couche intermédiaire que l'utilisateur ne voit jamais.
Ce changement a des gains d'efficacité évidents. Il a aussi des compromis moins évidents. Le débogage devient plus difficile lorsque le modèle répondant est inconnu. Les régressions de performance peuvent provenir d'un changement de routage, et non d'une mise à jour du modèle. Et le verrouillage fournisseur monte d'un cran : l'utilisateur n'est plus verrouillé sur un modèle, mais sur le routeur.
Sakana AI, une startup basée à Tokyo connue pour ses techniques de fusion de modèles évolutifs, s'est forgé une réputation pour ses choix architecturaux non conventionnels. Fugu Ultra 1.1 poursuit cette tendance, rendant invisible la partie la plus difficile de la sélection de modèles.
L'essentiel de la tech en 3 minutes chaque matin
Un email, chaque jour ouvré, avec ce qui compte vraiment en IA et en tech.