gemini-3.8-live-extended-thinking
Réseau Neuronal
Longueur maximale de la réponse
(en tokens)
Taille du contexte
(en tokens)
Coût du prompt
(par 1M tokens)
Coût de la réponse
(par 1M tokens)
Invite d'image
(par 1K tokens)
Comment ça marche gemini-3.8-live-extended-thinking?
Questions fréquentes sur gemini-3.8-live-extended-thinking
Vous pouvez utiliser les résultats générés à des fins commerciales. Tous les droits sur le contenu créé vous appartiennent. Seule restriction : vérifiez que la requête ne contient pas de contenus protégés par le droit d'auteur appartenant à des tiers. Le respect des droits sur les données d'entrée relève de votre responsabilité.
Il s'agit d'un modèle Google qui transforme une description textuelle en audio. Il convient pour la voix off de vidéos, les podcasts, le matériel pédagogique, les invites vocales dans les applications et les brouillons audio rapides. La fenêtre contextuelle est de 65 536 jetons, vous pouvez donc soumettre un long scénario en entier plutôt que de le diviser en petits morceaux.
Selon nos données, le modèle génère de l'audio, mais le conteneur exact et le débit binaire ne sont pas spécifiés dans les caractéristiques — fiez-vous à ce que l'API renvoie. La limite de sortie est de 32 000 jetons par requête : cela suffit pour un long fragment, et un grand projet peut être facilement assemblé à partir de plusieurs parties.
Il n'y a pas de mention spécifique concernant le raisonnement avant la réponse dans nos données, nous ne pouvons donc pas confirmer ce mode, mais nous ne le nierons pas non plus. Le plus simple est de vérifier en pratique : lancez le modèle dans BotHub et comparez le résultat avec d'autres modèles dans la même fenêtre.
Il n'y a aucune mention d'appel de fonction ou de sortie JSON structurée dans nos données, nous ne l'affirmerons donc pas. Si cette fonctionnalité est critique pour l'intégration, connectez-vous via l'API BotHub compatible OpenAI : le modèle se change avec un seul paramètre dans la requête, il n'est pas nécessaire de réécrire le code et les clés.
La réception de tout autre élément que du texte n'est pas indiquée dans nos données, attendez-vous donc à une description textuelle en entrée et à de l'audio en sortie. Si vous avez besoin de travailler avec des images ou des vidéos, d'autres modèles sont disponibles à proximité dans BotHub — le basculement ne prend que quelques secondes dans la même interface.
La langue des prompts et de la voix off n'est pas décrite dans nos données, nous ne promettrons donc rien ici — il est plus fiable de vérifier avec votre propre texte. De la part du service, nous garantissons autre chose : un accès depuis la Russie sans VPN ni carte étrangère, un paiement avec des cartes russes en roubles et une facturation à l'utilisation pour les jetons.