gemini-3.5-transcribe
Réseau Neuronal
Longueur maximale de la réponse
(en tokens)
Taille du contexte
(en tokens)
Coût du prompt
(par 1M tokens)
Coût de la réponse
(par 1M tokens)
Invite d'image
(par 1K tokens)
Comment ça marche gemini-3.5-transcribe?
Questions fréquentes sur gemini-3.5-transcribe
Vous pouvez utiliser les résultats générés à des fins commerciales. Tous les droits sur le contenu créé vous appartiennent. Seule restriction : vérifiez que la requête ne contient pas de contenus protégés par le droit d'auteur appartenant à des tiers. Le respect des droits sur les données d'entrée relève de votre responsabilité.
gemini-3.5-transcribe de Google travaille avec du texte, des documents et des images, les transformant en texte structuré. Le modèle raisonne avant de répondre, appelle des fonctions et conserve un contexte allant jusqu'à 65 536 jetons, ce qui le rend adapté à la transcription de contenu de fichiers, à l'extraction de données et à l'analyse. Accès à BotHub depuis la Russie sans VPN.
En une seule réponse, le modèle génère jusqu'à 32 000 jetons, ce qui correspond environ à un long article ou à une transcription détaillée de plusieurs dizaines de pages. Si le matériel est plus volumineux, divisez le travail en parties et transmettez-les successivement : le contexte global de 65 536 jetons le permet.
Oui, le raisonnement avant réponse est confirmé : le modèle décompose la tâche étape par étape avant de fournir un résultat. Cela est visible sur des documents complexes, des instructions à plusieurs étapes et des tâches où il est important de relier des fragments de texte disparates pour parvenir à une conclusion fondée.
Oui, les deux. Le modèle appelle des fonctions et renvoie du JSON structuré, facile à stocker dans une base de données ou à transmettre dans un pipeline. BotHub utilise une API unique compatible avec OpenAI : vous vous connectez une fois et basculez entre les modèles sans réécrire l'intégration.
Les images et les documents, oui, c'est confirmé dans nos données : vous pouvez envoyer un scan, un PDF ou une photo et obtenir une analyse textuelle. Nous n'avons pas d'informations sur l'audio et la vidéo, veuillez donc vérifier les formats disponibles dans l'interface avant de mettre en place votre processus.
Dans nos données, les caractéristiques linguistiques ne sont pas spécifiées, nous ne promettrons donc rien. Le plus simple est de tester en pratique : envoyez votre document type ou votre tâche dans BotHub et comparez le résultat avec d'autres modèles — le basculement ne prend que quelques secondes, paiement par cartes russes.