Qwen2.5 VL 72B Instruct

Réseau Neuronal

Qwen2.5 VL 72B Instruct : modèle multimodal Qwen pour l'analyse d'images : objets, textes, graphiques, icônes et mise en page.

Accueil

/

Modèles

/

Qwen2.5 VL 72B Instruct
115 200

Longueur maximale de la réponse

(en tokens)

32 000

Taille du contexte

(en tokens)

0,96 $

Coût du prompt

(par 1M tokens)

1,2 $

Coût de la réponse

(par 1M tokens)

*Les prix indiqués correspondent à l'utilisation de l'API via les fournisseurs ECO.
bothub
BotHub : Essayez les réseaux de neurones gratuitementbot

Caps restants : 0 CAPS
Exemple de code et API pour Qwen2.5 VL 72B InstructNous offrons un accès complet à l'API OpenAI via notre service. Tous nos points de terminaison sont entièrement conformes aux points de terminaison OpenAI et peuvent être utilisés avec des plugins ainsi que lors du développement de votre propre logiciel via le SDK.Créer une clé API
Javascript
Python
Curl
illustaration

Comment ça marche Qwen2.5 VL 72B Instruct?

Qwen2.5 VL 72B Instruct est un modèle visuel-langage de la famille Qwen : il accepte non seulement des requêtes textuelles, mais aussi des images. Le modèle reconnaît avec assurance des objets courants comme des fleurs, des oiseaux, des poissons et des insectes, et analyse le contenu des images : fragments de texte, graphiques, icônes, schémas et mise en page. Sur BotHub, l'accès est disponible sans VPN ni carte étrangère : paiement en roubles par carte russe, uniquement pour les jetons consommés, qui n'expirent pas. Plus de 250 autres réseaux neuronaux sont disponibles dans une seule fenêtre, permettant de basculer facilement et de comparer les réponses. Une API unique compatible OpenAI permet de connecter le modèle à votre service et de le changer ultérieurement sans réécrire l'intégration. Les données sont chiffrées via AES-GCM et ne sont pas conservées. Les entreprises bénéficient de contrats, factures, gestion électronique des documents et d'un panneau d'administration avec limites. Scénarios simples : extraire des chiffres d'un diagramme pour un rapport, récupérer du texte d'une capture d'écran ou d'un scan, décrire le contenu d'une photo pour un catalogue, analyser une interface ou une mise en page par éléments, ou reconnaître un objet sur une photo pour une tâche sur le terrain.

Questions fréquentes sur Qwen2.5 VL 72B Instruct

Puis-je utiliser les résultats de Qwen2.5 VL 72B Instruct à des fins commerciales ?

Vous pouvez utiliser les résultats générés à des fins commerciales. Tous les droits sur le contenu créé vous appartiennent. Seule restriction : vérifiez que la requête ne contient pas de contenus protégés par le droit d'auteur appartenant à des tiers. Le respect des droits sur les données d'entrée relève de votre responsabilité.

Que peut faire qwen2.5-vl-72b-instruct et pour quelles tâches est-il adapté ?

C'est un modèle visuel-langage Qwen : il lit le texte, analyse les images et documents, et répond aux questions sur leur contenu. Adapté à l'analyse de captures d'écran, schémas, tableaux et scans, à l'extraction de données structurées, au travail sur le code et à la connexion d'outils via l'appel de fonctions. Contexte : 32 000 jetons.

Combien de texte qwen2.5-vl-72b-instruct peut-il écrire en une seule réponse ?

Jusqu'à 115 200 jetons par réponse selon nos données, soit le volume d'un long article ou d'une documentation complète. La fenêtre de contexte est de 32 000 jetons ; comptez donc le prompt et les fichiers joints ensemble, et divisez les tâches longues.

qwen2.5-vl-72b-instruct sait-il raisonner avant de répondre ?

Aucun mode de raisonnement spécifique n'est indiqué dans nos données, mais cela ne signifie pas qu'il n'existe pas. En pratique, demander au modèle de décomposer la tâche étape par étape aide : les réponses sur la logique, les calculs et l'analyse de documents sont plus précises. Testez avec votre scénario.

qwen2.5-vl-72b-instruct prend-il en charge l'appel de fonctions et la sortie JSON ?

Oui. L'appel de fonctions et la sortie JSON structurée sont pris en charge : le modèle peut utiliser vos outils et renvoyer une réponse selon un schéma défini. C'est pratique pour extraire des champs de scans et factures, pour les intégrations et les scénarios d'agents. Sur BotHub, tout fonctionne via une API unique compatible OpenAI.

Peut-on charger des images, de l'audio ou de la vidéo dans qwen2.5-vl-72b-instruct ?

Images et documents : oui, vous pouvez les envoyer avec du texte : le modèle décrira l'image, trouvera le fragment souhaité sur une capture d'écran, analysera un tableau ou un contrat. La prise en charge de l'audio et de la vidéo n'est pas indiquée dans nos données. Pour ces tâches, BotHub propose d'autres modèles.

Dans quelle mesure qwen2.5-vl-72b-instruct comprend-il le russe ?

Nous n'avons pas de données sur les langues des prompts et des sorties, nous ne pouvons donc pas garantir une qualité spécifique. Qwen2.5-VL fait partie de la gamme multilingue Qwen, le modèle comprendra donc une requête en russe. Le plus fiable est de tester avec votre tâche et de comparer avec un autre modèle ; vous pouvez basculer dans BotHub dans une seule fenêtre.

Service d'AssistanceOuvert de 10h00 à 18h00 MSK