Llama 3.2 1B Instruct

Réseau Neuronal

Llama 3.2 1B Instruct est un modèle de langage compact de Meta à 1 milliard de paramètres pour le dialogue, le résumé et l'analyse.

Accueil

/

Modèles

/

Llama 3.2 1B Instruct
54 000

Longueur maximale de la réponse

(en tokens)

131 072

Taille du contexte

(en tokens)

0,03 $

Coût du prompt

(par 1M tokens)

0,24 $

Coût de la réponse

(par 1M tokens)

*Les prix indiqués correspondent à l'utilisation de l'API via les fournisseurs ECO.
bothub
BotHub : Essayez les réseaux de neurones gratuitementbot

Caps restants : 0 CAPS
Exemple de code et API pour Llama 3.2 1B InstructNous offrons un accès complet à l'API OpenAI via notre service. Tous nos points de terminaison sont entièrement conformes aux points de terminaison OpenAI et peuvent être utilisés avec des plugins ainsi que lors du développement de votre propre logiciel via le SDK.Créer une clé API
Javascript
Python
Curl
illustaration

Comment ça marche Llama 3.2 1B Instruct?

Llama 3.2 1B Instruct est un modèle de langage compact de Meta à 1 milliard de paramètres. Son objectif n'est pas la profondeur de raisonnement maximale, mais d'effectuer rapidement et économiquement des tâches textuelles courantes : dialoguer, résumer des documents longs, analyser et classer les messages entrants. Sa petite taille offre une vitesse de réponse élevée là où le flux de requêtes est plus important qu'une réponse complexe unique. Sur BotHub, le modèle est accessible sans VPN ni carte étrangère : les jetons sont payés à l'usage, sans abonnement, et n'expirent pas. Une API unique compatible OpenAI permet de connecter le modèle en une seule requête, et vous pouvez passer à l'une des plus de 250 autres IA sans réécrire l'intégration ; les échanges sont chiffrés et tous les modèles sont réunis dans une seule interface. Utile pour le résumé massif d'e-mails, de tickets et de rapports, la mise en place d'un premier niveau de support client, le marquage et la classification de textes avant transmission à un modèle plus large, la préparation de descriptions courtes et de brouillons en volume, ou l'intégration d'un assistant textuel abordable directement dans votre produit.

Questions fréquentes sur Llama 3.2 1B Instruct

Puis-je utiliser les résultats de Llama 3.2 1B Instruct à des fins commerciales ?

Vous pouvez utiliser les résultats générés à des fins commerciales. Tous les droits sur le contenu créé vous appartiennent. Seule restriction : vérifiez que la requête ne contient pas de contenus protégés par le droit d'auteur appartenant à des tiers. Le respect des droits sur les données d'entrée relève de votre responsabilité.

Que peut faire llama-3.2-1b-instruct et pour quelles tâches est-il adapté ?

llama-3.2-1b-instruct est un modèle compact de la famille Llama avec un réglage instructif. Il couvre des tâches simples et de masse : réponses courtes, reformulation, extraction de champs de documents, brouillons de descriptions, tri de tickets. Pour les opérations en flux, où la vitesse et la prévisibilité sont plus importantes que la profondeur d'analyse, c'est une option efficace.

Combien de texte llama-3.2-1b-instruct peut-il écrire en une seule réponse ?

Maximum 54 000 jetons par réponse, soit environ plusieurs dizaines de pages de texte. La fenêtre contextuelle du modèle est de 131 072 jetons, vous pouvez donc charger des documents volumineux tout en gardant de la marge pour une réponse détaillée sans coupure au milieu.

llama-3.2-1b-instruct sait-il raisonner avant de répondre ?

Aucun mode de raisonnement distinct n'est indiqué pour ce modèle dans nos données. Cependant, vous pouvez demander directement dans le prompt de décomposer la tâche étape par étape et de montrer le raisonnement — cela suffit pour des chaînes simples. Pour des calculs complexes, passez à un modèle de raisonnement dans la même fenêtre.

llama-3.2-1b-instruct prend-il en charge l'appel de fonctions et la sortie JSON ?

L'appel de fonctions et le mode JSON strict ne sont pas indiqués pour ce modèle dans nos données. Vous pouvez demander une réponse au format JSON dans le prompt, mais vous devez vérifier la structure de votre côté. Si vous avez besoin de garanties, passez à un modèle avec function calling via l'API BotHub compatible OpenAI.

Peut-on charger des images, de l'audio ou de la vidéo dans llama-3.2-1b-instruct ?

Vous pouvez charger des images et des documents : le modèle les accepte en entrée avec du texte ; les scans, schémas, captures d'écran et fichiers texte conviennent. L'audio et la vidéo ne font pas partie des formats d'entrée pris en charge — il existe des modèles dédiés dans le catalogue BotHub pour cela. La réponse est fournie sous forme de texte.

Dans quelle mesure llama-3.2-1b-instruct comprend-il le russe ?

La famille Llama 3.2 est annoncée par le développeur comme multilingue, et le modèle fonctionne avec le russe. Cependant, il s'agit d'une version compacte de seulement 1B de paramètres, donc la qualité est inférieure à celle des grands modèles sur des textes longs et complexes. Testez-le sur votre tâche — des modèles plus grands sont disponibles à proximité dans la même fenêtre.

Service d'AssistanceOuvert de 10h00 à 18h00 MSK