Whisper 1

Réseau Neuronal

Bip-bup, écriture de texte pour vous...
pc1pc2pc3pc4
Accueil

/

Modèles

/

Whisper 1
4 096

Longueur maximale de la réponse

(en tokens)

4 095

Taille du contexte

(en tokens)

8 800 $

Coût du prompt

(par 1M tokens)

*Les prix indiqués correspondent à l'utilisation de l'API via les fournisseurs ECO.
bothub
BotHub : Essayez les réseaux de neurones gratuitementbot

Caps restants : 0 CAPS
Exemple de code et API pour Whisper 1Nous offrons un accès complet à l'API OpenAI via notre service. Tous nos points de terminaison sont entièrement conformes aux points de terminaison OpenAI et peuvent être utilisés avec des plugins ainsi que lors du développement de votre propre logiciel via le SDK.Créer une clé API
Javascript
Python
Curl

Comment ça marche Whisper 1?

Les bothubs recueillent des informations...empty

Questions fréquentes sur Whisper 1

Puis-je utiliser les résultats de Whisper 1 à des fins commerciales ?

Vous pouvez utiliser les résultats générés à des fins commerciales. Tous les droits sur le contenu créé vous appartiennent. Seule restriction : vérifiez que la requête ne contient pas de contenus protégés par le droit d'auteur appartenant à des tiers. Le respect des droits sur les données d'entrée relève de votre responsabilité.

Que peut faire whisper-1 et pour quelles tâches est-il adapté ?

whisper-1 d'OpenAI transcrit l'audio en texte. Vous téléchargez un enregistrement et obtenez une transcription. Il est adapté aux interviews, podcasts, appels, conférences, messages vocaux et brouillons de sous-titres. C'est pratique pour transformer rapidement des heures de conversation en texte lisible pour la recherche et l'édition.

Combien de texte whisper-1 peut-il écrire en une seule réponse ?

Jusqu'à 4096 jetons par réponse, ce qui correspond à environ quelques pages de transcription ; le contexte du modèle est de 4095 jetons. Il est préférable de découper un long enregistrement en fragments, de les envoyer un par un, puis de recoller le résultat : ainsi, rien ne sera coupé au milieu d'une phrase.

whisper-1 sait-il raisonner avant de répondre ?

Dans nos données, aucun mode de raisonnement distinct n'est indiqué pour whisper-1, et ce n'est pas nécessaire pour cette tâche : le modèle reconnaît la parole et ne construit pas de chaînes de raisonnement. Si vous avez besoin d'une analyse de la transcription, transmettez le texte à un modèle textuel dans la même fenêtre BotHub.

whisper-1 prend-il en charge l'appel de fonctions et la sortie JSON ?

Dans nos données, l'appel de fonctions et la sortie JSON stricte ne sont pas indiqués pour whisper-1. L'accès se fait via l'API BotHub compatible avec OpenAI : vous envoyez un fichier et recevez une transcription, et vous pouvez la structurer de votre côté ou lors de l'étape suivante du pipeline.

Peut-on télécharger des images, de l'audio ou de la vidéo dans whisper-1 ?

L'audio, oui, c'est l'entrée principale du modèle : c'est la piste sonore que whisper-1 transforme en texte. Les images ne sont pas indiquées comme entrée dans nos données. Pour la vidéo, c'est simple : extrayez la piste audio avec n'importe quel convertisseur et envoyez-la pour reconnaissance.

Dans quelle mesure whisper-1 comprend-il le russe ?

whisper-1 est un modèle multilingue de reconnaissance vocale ; il comprend et transcrit la langue russe. La qualité dépend davantage de l'enregistrement lui-même : un son clair, un seul locuteur et un rythme calme donnent un texte nettement plus précis qu'une salle bruyante ou un accent prononcé. Testez avec votre propre fichier.

Service d'AssistanceOuvert de 10h00 à 18h00 MSK