Ling 3.0 Flash VL
Réseau Neuronal
Ling 3.0 Flash VL est un modèle MoE multimodal d'InclusionAI : comprend images et texte, disponible via l'API BotHub.
Longueur maximale de la réponse
(en tokens)
Taille du contexte
(en tokens)
Coût du prompt
(par 1M tokens)
Coût de la réponse
(par 1M tokens)
Comment ça marche Ling 3.0 Flash VL?
Ling 3.0 Flash VL est une évolution du Ling 3.0 Flash d'InclusionAI : il conserve l'architecture MoE de 124 milliards de paramètres (5,5 milliards actifs), mais avec une perception visuelle native et des capacités linguistiques renforcées. Le modèle traite les images et le texte simultanément dans une conversation fluide, sans service annexe. Via BotHub, le modèle est accessible sans VPN ni carte étrangère, avec un paiement à l'usage en roubles sans abonnement, et les jetons non utilisés n'expirent pas. Accédez à plus de 250 modèles dans une interface unique pour comparer les réponses. L'API compatible OpenAI permet d'intégrer le modèle à vos produits et de le remplacer facilement. Les données sont chiffrées via AES-GCM et ne sont pas conservées. Les entreprises bénéficient de contrats, factures, EDI et d'un panneau d'administration avec limites. Idéal pour décrire des images, extraire des données de captures d'écran ou de schémas, associer des images à des tâches textuelles, créer un assistant de support multimodal ou traiter des flux visuels via API.Questions fréquentes sur Ling 3.0 Flash VL
Vous pouvez utiliser les résultats générés à des fins commerciales. Tous les droits sur le contenu créé vous appartiennent. Seule restriction : vérifiez que la requête ne contient pas de contenus protégés par le droit d'auteur appartenant à des tiers. Le respect des droits sur les données d'entrée relève de votre responsabilité.
Le modèle accepte texte, documents et images, et répond en texte. Idéal pour analyser fichiers et captures d'écran, extraire des données de tableaux et schémas, coder, analyser et scénarios d'agents : mode raisonnement et appel de fonctions inclus. Contexte de 131 072 jetons.
Le modèle génère jusqu'à 32 768 jetons par réponse, suffisant pour analyser un document, un long article ou un bloc de code. Pour des textes plus longs, divisez la tâche : le contexte d'entrée de 131 072 jetons permet de conserver tout l'historique.
Oui, le modèle dispose d'un mode raisonnement : il traite la tâche étape par étape avant de répondre. Cela aide pour les mathématiques, la logique, le débogage et l'analyse de documents longs. Notez que le raisonnement consomme des jetons de sortie et augmente légèrement le temps de réponse.
Oui, l'appel de fonctions et la sortie JSON structurée sont pris en charge. Connectez le modèle à vos outils, bases de données et services externes pour obtenir des réponses conformes à un schéma. Fonctionne via l'API BotHub compatible OpenAI, permettant de changer de modèle sans réécrire l'intégration.
Le modèle accepte images et documents (captures d'écran, schémas, scans, PDF). Aucune information sur l'audio ou la vidéo, privilégiez donc un modèle spécialisé disponible dans la même interface BotHub pour ces fichiers.
Nous n'avons pas de mesures spécifiques pour le français, testez donc la qualité sur vos tâches. L'interface BotHub est en russe, l'accès est possible sans VPN ni carte étrangère, le paiement se fait par carte russe et les jetons n'expirent pas.