gemini-3.5-transcribe-live-preview
Réseau Neuronal
Longueur maximale de la réponse
(en tokens)
Taille du contexte
(en tokens)
Coût du prompt
(par 1M tokens)
Coût de la réponse
(par 1M tokens)
Invite d'image
(par 1K tokens)
Comment ça marche gemini-3.5-transcribe-live-preview?
Questions fréquentes sur gemini-3.5-transcribe-live-preview
Vous pouvez utiliser les résultats générés à des fins commerciales. Tous les droits sur le contenu créé vous appartiennent. Seule restriction : vérifiez que la requête ne contient pas de contenus protégés par le droit d'auteur appartenant à des tiers. Le respect des droits sur les données d'entrée relève de votre responsabilité.
Il s'agit d'un modèle de Google avec un contexte de 65 536 jetons : il accepte du texte, des images et des documents, raisonne avant de répondre et sait appeler des fonctions. Il est adapté à l'analyse de fichiers et de captures d'écran, à l'analytique, au travail sur le code et aux scénarios nécessitant une réponse strictement structurée.
Jusqu'à 32 000 jetons par réponse, soit des dizaines de pages de texte. Suffisant pour une analyse détaillée de document, une longue instruction ou un fragment de code volumineux. La fenêtre totale est de 65 536 jetons, incluant votre requête et la réponse du modèle.
Oui, le raisonnement avant réponse est confirmé dans nos données. Le modèle décompose d'abord la tâche étape par étape avant de fournir le résultat ; cela est particulièrement visible sur la logique, les calculs et les instructions complexes. Sur des requêtes simples, la différence est moindre, mais la réponse est plus stable.
Oui, l'appel de fonctions et la sortie JSON structurée sont pris en charge. Vous décrivez le schéma et les outils disponibles, et le modèle renvoie un objet prêt à l'emploi ou un appel à votre fonction. Dans BotHub, cela fonctionne via une API unique compatible OpenAI, vous pouvez donc changer de modèle sans réécrire l'intégration.
Les images et documents, oui, ils peuvent être envoyés avec du texte : captures d'écran, schémas, tableaux, PDF. L'audio et la vidéo ne sont pas indiqués dans nos données, nous ne pouvons donc pas le promettre à l'avance — vérifiez par vous-même. Le modèle répond par du texte.
La langue des prompts et des réponses n'est pas spécifiée dans nos données, nous ne pouvons donc pas promettre de détails — testez quelques-unes de vos requêtes types et évaluez le résultat vous-même. L'interface BotHub est en russe, le paiement se fait en roubles avec des cartes russes, accès sans VPN ni carte étrangère.