Fugu Ultra
Réseau Neuronal
Fugu Ultra de Sakana AI est un système multi-agents de routage des tâches, API Fugu Ultra pour les scénarios complexes.
Longueur maximale de la réponse
(en tokens)
Taille du contexte
(en tokens)
Coût du prompt
(par 1M tokens)
Coût de la réponse
(par 1M tokens)
Comment ça marche Fugu Ultra?
Fugu Ultra est le modèle le plus performant de la famille Fugu de Sakana AI. Il fonctionne différemment des modèles monolithiques habituels : il repose sur un système d'orchestration multi-agents entraîné, où un modèle linguistique route les tâches. Via BotHub, le modèle est accessible depuis la Russie sans VPN ni carte étrangère, avec un paiement en roubles à l'usage, sans abonnement. Plus de 250 modèles sont disponibles dans une interface unique, vous permettant de comparer les réponses à une même requête et de basculer sans réécrire l'intégration : l'API est compatible avec OpenAI. Les échanges sont chiffrés via AES-GCM. Pour les entreprises, BotHub propose des contrats, des factures, une gestion électronique des documents et un panneau d'administration avec des limites. Utile pour décomposer des requêtes volumineuses en sous-tâches, analyser un code inconnu, synthétiser des documents disparates, automatiser des opérations via API ou construire un scénario d'agent où Fugu Ultra gère la répartition des étapes.Questions fréquentes sur Fugu Ultra
Vous pouvez utiliser les résultats générés à des fins commerciales. Tous les droits sur le contenu créé vous appartiennent. Seule restriction : vérifiez que la requête ne contient pas de contenus protégés par le droit d'auteur appartenant à des tiers. Le respect des droits sur les données d'entrée relève de votre responsabilité.
Il s'agit d'un modèle textuel avec un mode de raisonnement, un contexte allant jusqu'à un million de jetons et la prise en charge d'images et de documents en entrée. Il est adapté à l'analyse de documents volumineux, au travail sur le code et au débogage, à l'analyse de données, aux tâches STEM et aux scénarios d'agents avec appel d'outils externes.
La limite de sortie est de 128 000 jetons par réponse. Cela suffit pour un module de code volumineux, un document technique détaillé ou une analyse complète, sans avoir à découper manuellement la tâche en dizaines de petites requêtes et à recoller les morceaux.
Oui, le mode de raisonnement du modèle est confirmé. Avant la réponse finale, il décompose la tâche étape par étape, ce qui aide considérablement en mathématiques, en logique, en analyse de données et en débogage de code, où la séquence des déductions est plus importante qu'une réponse rapide.
Oui, le modèle prend en charge l'appel de fonctions (function calling) et la sortie structurée en JSON. Cela permet de créer des agents, de connecter des services et bases de données externes, et d'obtenir un format de réponse prévisible pour l'analyse. Dans BotHub, tout fonctionne via une API unique compatible avec OpenAI.
Selon nos données, le modèle accepte des images et des documents en entrée : vous pouvez analyser un schéma, une capture d'écran d'interface, un graphique ou un fichier multipage. L'audio et la vidéo ne sont pas indiqués dans notre liste de formats d'entrée, il est donc plus simple de tester ce scénario en pratique.
Nous n'avons pas de données précises sur la qualité du travail en russe, il est donc plus fiable de tester le modèle sur vos propres tâches. Dans BotHub, c'est pratique : accès depuis la Russie sans VPN ni carte étrangère, paiement à l'usage, et vous pouvez basculer vers un autre modèle dans une interface unique.