Ce qui change
Sakana AI a publié Fugu Ultra v2 le 11 septembre 2026, avec Fugu Max, derrière son API compatible OpenAI 1. Son identifiant est fugu-ultra-v2.0, et l’alias fugu-ultra pointe désormais dessus 2. Sakana précise que Fable 5, Fable 5.1 et GPT-6-Astra ne font pas partie du pool de modèles de la v2 1. Le tarif de fugu-ultra-v2.0 est fixe, par million de tokens 3.
| Type de token, par 1M | Standard | Contexte au-delà de 272K |
|---|---|---|
| Entrée | $5 | $10 |
| Sortie | $30 | $45 |
| Entrée en cache | $0.50 | $1.00 |
Un pool interchangeable, mais pas par vous
Sakana vend son pool interchangeable de modèles ouverts et spécialisés comme un rempart contre la dépendance à un fournisseur, les révocations d’API et les coupures soudaines 1. Sa FAQ précise qui procède à l’échange. Le pool d’Ultra est fixe, alors que le modèle Fugu de base permet d’exclure certains modèles depuis la console 4. Sakana n’expose pas les modèles qui ont répondu, par choix de conception 4. Je pense que l’argument de la dépendance se retourne. Vous quittez un fournisseur que vous savez nommer pour un pool impossible à lister, et si Sakana y change un modèle, vos sorties peuvent bouger sans que la réponse dise pourquoi.
Ni harnais ni protocole de reproduction
Sakana revendique le meilleur score, ou un score ex aequo, sur cinq des huit benchmarks, dans sa propre évaluation 1. OrcaRouter, un routeur concurrent qui ne propose pas Fugu, relève que Sakana n’a publié ni harnais d’évaluation, ni grille de scores par tâche, ni protocole de reproduction, et qu’aucun modèle Fugu n’a de page chez Artificial Analysis 5. Il relaie aussi les retours de testeurs indépendants qui signalent une latence variable, la délibération du coordinateur n’étant que du surcoût sur les tâches simples 5. Avec un pool caché, je ne vois pas comment rejouer ces scores sur vos tâches.
Impact pour une équipe
Si vous appelez déjà Fugu, figez fugu-ultra-v2.0 plutôt que l’alias fugu-ultra, qui pointe désormais sur la v2 2. Sakana promet une mise à niveau en une ligne 1, et un alias la fait à votre place. Avant tout pilote, lancez vos évals sur vos tâches et journalisez la latence et le coût par appel. Je bâtirais le budget sur la sortie, facturée $30 par million de tokens et $45 au-delà de 272K de contexte 3. Traitez les benchmarks de Sakana comme une hypothèse à vérifier, et gardez un repli vers un modèle que vous appelez directement, car le jour où la qualité dérive, vous ne verrez pas quels modèles ont répondu 4.