GPT 3.5 Turbo 16K
Réseau Neuronal
GPT 3.5 Turbo 16K est un modèle OpenAI à contexte étendu pour longs textes, disponible sur BotHub via l'API gpt 3.5 turbo 16k.
Longueur maximale de la réponse
(en tokens)
Taille du contexte
(en tokens)
Coût du prompt
(par 1M tokens)
Coût de la réponse
(par 1M tokens)
Comment ça marche GPT 3.5 Turbo 16K?
GPT 3.5 Turbo 16K est une version de GPT 3.5 Turbo d'OpenAI avec une fenêtre de contexte étendue : elle peut contenir environ vingt pages de texte en une seule requête, soit quatre fois plus que la version de base. Grâce à cela, le modèle garde en mémoire un long document ou une conversation entière et répond en s'appuyant sur l'ensemble du matériel transmis, et non sur un fragment. Sur BotHub, le modèle est accessible sans VPN ni carte étrangère ; le paiement s'effectue avec des cartes russes en roubles, facturé à l'usage, et les jetons n'expirent pas. Plus de 250 réseaux neuronaux sont disponibles dans la même fenêtre, vous permettant de comparer les réponses et de changer de modèle. Une API unique compatible OpenAI permet d'intégrer le modèle à votre produit et de le remplacer sans réécrire l'intégration ; les données sont chiffrées via AES-GCM et ne sont pas conservées. Pour les entreprises, BotHub propose des contrats, des factures et une gestion électronique des documents, ainsi qu'un panneau d'administration avec des limites par équipe. Utile pour analyser un long rapport ou contrat, résumer un article, maintenir un dialogue avec tout l'historique ou traiter un flux de documents via l'API.Questions fréquentes sur GPT 3.5 Turbo 16K
Vous pouvez utiliser les résultats générés à des fins commerciales. Tous les droits sur le contenu créé vous appartiennent. Seule restriction : vérifiez que la requête ne contient pas de contenus protégés par le droit d'auteur appartenant à des tiers. Le respect des droits sur les données d'entrée relève de votre responsabilité.
C'est un modèle textuel OpenAI avec un contexte de 16 385 jetons. Adapté à la correspondance, l'édition, le résumé de documents, la génération et l'analyse de code, le refactoring, le débogage, la classification et l'extraction de données. Accepte texte, documents et images, prend en charge l'appel de fonctions. Accès depuis la Russie sans VPN ni carte étrangère.
En une réponse, le modèle génère jusqu'à 4096 jetons, suffisant pour un article, une instruction détaillée ou un fragment de code. La fenêtre totale est de 16 385 jetons (requête + réponse), il est donc préférable de générer les textes très longs par parties en transmettant le fragment précédent.
Aucun mode de raisonnement spécifique n'est indiqué, donc n'attendez pas de chaînes de réflexion prêtes à l'emploi par défaut. Cependant, vous pouvez demander de décomposer la tâche étape par étape dans le prompt. Pour une logique complexe et STEM, passez à un modèle de raisonnement dans la même fenêtre BotHub.
Oui. Le modèle prend en charge le 'function calling' et la sortie structurée en JSON : il choisit l'outil nécessaire et renvoie les arguments selon le schéma défini. Pratique pour les bots, les intégrations backend et l'extraction de champs. Tout fonctionne via l'API BotHub compatible OpenAI.
Les images et documents peuvent être téléchargés : le modèle analyse le contenu des images et fichiers en répondant par texte. Aucune mention pour l'audio ou la vidéo, donc pour la transcription ou le travail sur des vidéos, utilisez un modèle spécialisé disponible dans la même interface.
Nous n'avons pas de données sur les langues des prompts et de sortie, mais la gamme GPT-3.5 est multilingue, donc le modèle fonctionne avec le français. Testez-le sur votre scénario : si les formulations semblent sèches, passez à un autre modèle sur BotHub sans réécrire l'intégration.