GPT OSS 120B Batch
Réseau Neuronal
GPT OSS 120B est un modèle OpenAI ouvert (Mixture-of-Experts) conçu pour le raisonnement et les tâches d'agent.
Longueur maximale de la réponse
(en tokens)
Taille du contexte
(en tokens)
Coût du prompt
(par 1M tokens)
Coût de la réponse
(par 1M tokens)
Comment ça marche GPT OSS 120B Batch?
GPT OSS 120B est un modèle de langage ouvert d'OpenAI de 117 milliards de paramètres avec une architecture Mixture-of-Experts : environ 5,1 milliards de paramètres sont activés par passage, ce qui permet au modèle de maintenir un haut niveau de raisonnement tout en restant efficace en termes de calcul. Il a été créé pour des tâches nécessitant des chaînes de raisonnement, un comportement d'agent et une stabilité en production. La version batch est conçue pour le traitement par lots de gros volumes de requêtes. Via BotHub, vous vous connectez sans VPN ni carte étrangère, payez en roubles par carte russe à l'usage, et les jetons n'expirent pas. Une API unique compatible OpenAI permet d'intégrer le modèle à votre service et de passer à une autre parmi plus de 250 disponibles sans réécrire l'intégration. Les données sont transmises cryptées et ne sont pas stockées. Utile pour analyser des logs, expliquer des erreurs de code, créer des agents avec appels de fonctions et outils externes, effectuer une classification de documents de masse, décomposer des problèmes STEM ou traiter une file de requêtes similaires.Questions fréquentes sur GPT OSS 120B Batch
Vous pouvez utiliser les résultats générés à des fins commerciales. Tous les droits sur le contenu créé vous appartiennent. Seule restriction : vérifiez que la requête ne contient pas de contenus protégés par le droit d'auteur appartenant à des tiers. Le respect des droits sur les données d'entrée relève de votre responsabilité.
gpt-oss-120b:batch est un modèle textuel avec mode de raisonnement : il analyse de longs documents, écrit et refactorise du code, cherche des erreurs, résout des problèmes de maths et de logique, prépare des analyses et des résumés. Fenêtre de contexte de 131 072 jetons, permettant d'inclure de gros fichiers et des fils de discussion entiers.
Jusqu'à 117 964 jetons par réponse, soit des dizaines de pages. Le modèle génère facilement un long document, une analyse détaillée ou un module de code complet sans fragmentation. Si la réponse est coupée, demandez simplement de continuer là où il s'est arrêté.
Oui, le raisonnement avant réponse est une fonctionnalité : avant de formuler le résultat, il décompose le problème étape par étape. Cela aide considérablement pour les calculs, la logique et le débogage. Notez que la réflexion consomme aussi des jetons de sortie.
Oui, il prend en charge l'appel de fonctions et la sortie JSON structurée, idéal pour les agents, chatbots et pipelines nécessitant un parsing immédiat. Sur BotHub, cela fonctionne via une API compatible OpenAI, permettant de changer de modèle sans réécrire l'intégration.
Outre le texte, le modèle accepte des documents : chargez un fichier pour une analyse, un résumé ou des réponses sur le contenu. Le traitement d'images, audio et vidéo n'est pas pris en charge ; pour ces formats, basculez vers un modèle spécialisé dans la même fenêtre BotHub.
Nous n'avons pas de données sur la qualité par langue, donc nous ne promettons rien : le mieux est de tester. La facturation se fait à l'usage, vous pouvez donc envoyer le même prompt à un autre modèle dans la même fenêtre pour comparer.