Gemma 3 4B IT
Réseau Neuronal
Gemma 3 4B IT : modèle multimodal Google pour texte et images ; API Gemma 3 avec contexte jusqu'à 128k jetons.
Longueur maximale de la réponse
(en tokens)
Taille du contexte
(en tokens)
Coût du prompt
(par 1M tokens)
Coût de la réponse
(par 1M tokens)
Comment ça marche Gemma 3 4B IT?
Gemma 3 4B IT est un modèle multimodal de Google : il accepte du texte et des images en entrée et répond par du texte. Avec un contexte allant jusqu'à 128k jetons, vous pouvez traiter de longs documents ou de larges fragments de code en une seule requête. Le modèle comprend plus de 140 langues et, par rapport à la génération précédente de Gemma, il offre de meilleures capacités en mathématiques, en raisonnement et en qualité de dialogue. Sur BotHub, le modèle est accessible sans VPN ni carte étrangère : payez en roubles avec une carte russe, uniquement à l'usage, sans abonnement, et vos jetons n'expirent pas. Accédez à plus de 250 réseaux de neurones dans une seule fenêtre pour comparer facilement les réponses. L'API compatible OpenAI permet d'intégrer Gemma 3 à votre service et de changer de modèle sans réécrire l'intégration. Les échanges sont chiffrés via AES-GCM. Les entreprises bénéficient de contrats, factures, EDI et d'un panneau d'administration avec limites. Utile aux développeurs pour l'analyse de code, aux analystes pour résumer des documents, au support pour classer les tickets, et aux créatifs pour décrire des visuels.Questions fréquentes sur Gemma 3 4B IT
Vous pouvez utiliser les résultats générés à des fins commerciales. Tous les droits sur le contenu créé vous appartiennent. Seule restriction : vérifiez que la requête ne contient pas de contenus protégés par le droit d'auteur appartenant à des tiers. Le respect des droits sur les données d'entrée relève de votre responsabilité.
C'est un modèle compact de Google de la famille Gemma. Il accepte du texte, des documents et des images, et répond par du texte : idéal pour les brouillons, la réécriture, la synthèse, la structuration, répondre aux questions sur un fichier, analyser des captures d'écran et des tâches de code simples. Contexte : 131 072 jetons.
Jusqu'à 16 384 jetons par réponse, ce qui suffit pour un long article ou un gros fragment de code. Si le contenu est plus long, demandez simplement de continuer : le contexte de 131 072 jetons permet de conserver les parties précédentes du dialogue sans perdre le style.
Nos données n'indiquent pas de mode de réflexion spécifique pour ce modèle, la réponse est donc généralement immédiate. Vous pouvez lui demander de décomposer la tâche étape par étape dans le prompt. Si vous avez besoin d'un modèle avec raisonnement, basculez sur un autre dans la même fenêtre.
Nos données n'indiquent pas de prise en charge de l'appel de fonctions ou de sortie JSON structurée. Vous pouvez demander une réponse au format JSON, mais le résultat doit être validé. Pour des outils fiables, utilisez l'API compatible OpenAI de BotHub et connectez un modèle approprié — vous n'aurez pas à réécrire l'intégration.
Images et documents : oui. Joignez une photo, une capture d'écran ou un fichier et demandez de décrire le contenu, d'extraire des données ou d'expliquer une erreur. L'audio et la vidéo ne sont pas pris en charge — BotHub propose des modèles dédiés pour le son et les vidéos.
Nous n'avons pas de données spécifiques sur les langues prises en charge, nous ne pouvons donc rien promettre de concret — le plus simple est de tester le modèle avec vos propres requêtes. BotHub fonctionne depuis la Russie sans VPN ni carte étrangère : interface en russe, paiement par cartes russes en roubles.