Mistral Small 4
Réseau Neuronal
Mistral Small 4 est un modèle de Mistral AI pour le raisonnement et le texte : accès et API Mistral Small 4 sur BotHub.
Longueur maximale de la réponse
(en tokens)
Taille du contexte
(en tokens)
Coût du prompt
(par 1M tokens)
Coût de la réponse
(par 1M tokens)
Comment ça marche Mistral Small 4?
Mistral Small 4 est la nouvelle version majeure de la gamme Mistral Small de Mistral AI. Contrairement aux versions précédentes, elle combine les capacités de plusieurs modèles phares du fournisseur en un seul système : le modèle allie un raisonnement puissant à une polyvalence dans les tâches textuelles. Sur BotHub, vous y accédez sans VPN ni carte étrangère, et vous payez en roubles à l'usage, pour les jetons consommés qui n'expirent pas. Plus de 250 modèles sont disponibles dans la même fenêtre : comparez facilement les réponses à une même requête et basculez vers un autre modèle. L'API compatible OpenAI et le mode batch permettent d'intégrer le modèle à un système multimodal et de traiter des requêtes par lots sans réécrire l'intégration. Les échanges sont chiffrés en AES-GCM, les données ne sont pas conservées, et les entreprises bénéficient de contrats, factures, EDI et d'un panneau d'administration avec limites par employé. Utilisez Mistral Small 4 pour le raisonnement sur des questions complexes, la synthèse et l'analyse de longs documents, l'extraction de données structurées, les assistants conversationnels via API et le traitement massif de requêtes répétitives.Questions fréquentes sur Mistral Small 4
Vous pouvez utiliser les résultats générés à des fins commerciales. Tous les droits sur le contenu créé vous appartiennent. Seule restriction : vérifiez que la requête ne contient pas de contenus protégés par le droit d'auteur appartenant à des tiers. Le respect des droits sur les données d'entrée relève de votre responsabilité.
C'est un modèle textuel de Mistral : il répond aux questions, rédige et édite des textes, analyse du code, et traite des documents et images en entrée. Le contexte allant jusqu'à 262 144 jetons permet de charger de longs contrats, rapports et fragments de dépôts, tandis que le mode batch est pratique pour traiter de grands volumes de requêtes similaires.
La limite de sortie est de 209 715 jetons, ce qui suffit pour un document volumineux, une instruction détaillée ou un grand fragment de code. En pratique, vous définissez la longueur vous-même dans la requête ou via les paramètres de l'API, donc les réponses habituelles restent compactes au lieu de s'étendre au maximum.
Oui, le raisonnement avant réponse est confirmé dans nos données : le modèle peut décomposer une tâche étape par étape avant de donner le résultat. Cela aide en mathématiques, logique, analyse de code et documents longs, où il est important de ne pas manquer de détails et de vérifier le résultat avant la formulation finale.
Oui, les deux. Vous décrivez les outils disponibles, le modèle décide lui-même lequel appeler et renvoie les arguments selon le schéma défini, et la réponse peut être obtenue en JSON strict. C'est pratique pour les agents, l'analyse vers des champs de base de données et les intégrations via l'API BotHub compatible OpenAI.
Selon nos données, en plus du texte, des images et des documents sont acceptés en entrée : demandez d'analyser un scan, un schéma, un tableau ou une page d'un fichier. L'audio et la vidéo ne sont pas pris en charge par ce modèle, il est donc préférable de choisir un modèle spécialisé — sur BotHub, il s'ouvre dans la même fenêtre.
Il n'y a pas d'évaluation spécifique du français dans nos données, nous ne donnerons donc pas de garanties : il est plus fiable de tester le modèle sur vos requêtes types — quelques prompts montreront si le style et la précision vous conviennent. L'interface BotHub est disponible en français, accès sans VPN ni carte étrangère, paiement en roubles.