GPT OSS 120B
Réseau Neuronal
GPT OSS 120B est un modèle de langage ouvert d'OpenAI avec une architecture Mixture-of-Experts pour le raisonnement et les agents.
Longueur maximale de la réponse
(en tokens)
Taille du contexte
(en tokens)
Coût du prompt
(par 1M tokens)
Coût de la réponse
(par 1M tokens)
Comment ça marche GPT OSS 120B?
GPT OSS 120B est un modèle OpenAI à poids ouverts basé sur l'architecture Mixture-of-Experts : 117 milliards de paramètres, dont environ 5,1 milliards sont activés à chaque passage. Le modèle est optimisé pour la production : charge élevée, longues chaînes de réflexion et scénarios d'agents où la tâche doit être décomposée en étapes. Sur BotHub, ce modèle est accessible sans VPN, avec paiement par carte bancaire et facturation à l'usage (jetons non expirables). Plus de 250 modèles sont disponibles dans une interface unique pour comparaison. Une API compatible OpenAI permet de connecter le modèle à votre service et de le remplacer sans réécrire l'intégration ; le trafic est chiffré en AES-GCM. Utile aux développeurs pour la génération et l'analyse de code, le débogage et le refactoring, aux analystes pour les calculs étape par étape et les tâches STEM, aux équipes produit pour créer des agents et assistants internes. Les entreprises bénéficient de contrats, factures, EDI et d'un panneau d'administration avec limites.Questions fréquentes sur GPT OSS 120B
Vous pouvez utiliser les résultats générés à des fins commerciales. Tous les droits sur le contenu créé vous appartiennent. Seule restriction : vérifiez que la requête ne contient pas de contenus protégés par le droit d'auteur appartenant à des tiers. Le respect des droits sur les données d'entrée relève de votre responsabilité.
gpt-oss-120b est un modèle ouvert d'OpenAI pour le traitement de texte : écrire et corriger du code, analyser des documents, résoudre des problèmes de raisonnement. Il accepte des images et des documents en entrée et peut appeler des fonctions. Idéal pour les assistants, l'analyse et les services multimodaux via l'API BotHub.
La limite de sortie est de 117 964 jetons par réponse, avec une fenêtre de contexte totale de 131 072 jetons. Cela suffit pour les longs documents, le code volumineux et les analyses détaillées. Notez que la requête et la réponse partagent le contexte, donc une entrée importante réduit l'espace disponible pour la réponse.
Oui, le raisonnement avant réponse est une capacité du modèle : il décompose la tâche en étapes avant de fournir le résultat. Cela aide considérablement pour les mathématiques, la logique, le débogage de code et les tâches complexes où la précision prime sur la vitesse.
Oui, le modèle prend en charge l'appel de fonctions et la sortie structurée en JSON. Vous pouvez connecter des outils externes, des bases de données et des services pour obtenir des réponses dans un format prévisible. Sur BotHub, cela fonctionne via une API compatible OpenAI, permettant de changer de modèle sans réécrire l'intégration.
Les images et documents peuvent être téléchargés : le modèle lit leur contenu et répond par texte. L'audio et la vidéo ne sont pas indiqués comme formats d'entrée, tout comme la génération d'images ou de sons — pour cela, le catalogue BotHub propose des modèles spécialisés accessibles dans la même interface.
Nous n'avons pas de données sur les langues des prompts et des réponses, nous ne pouvons donc pas garantir la qualité du français — il est préférable de tester directement sur BotHub. Le service est entièrement disponible en français : paiement par carte bancaire et accès sans VPN.