Whisper 1

Rede Neural

Bip-bup, escrevendo texto para você...
pc1pc2pc3pc4
Inicial

/

Modelos

/

Whisper 1
4 096

Comprimento máximo de resposta

(em tokens)

4 095

Tamanho do contexto

(em tokens)

8 800 $

Custo do prompt

(por 1M tokens)

*Os preços indicados são para uso da API via provedores ECO.
bothub
BotHub : Essayez les réseaux de neurones gratuitementbot

Caps restants : 0 CAPS
Exemple de code et API pour Whisper 1Nous offrons un accès complet à l'API OpenAI via notre service. Tous nos points de terminaison sont entièrement conformes aux points de terminaison OpenAI et peuvent être utilisés avec des plugins ainsi que lors du développement de votre propre logiciel via le SDK.Créer une clé API
Javascript
Python
Curl

Como funciona Whisper 1?

Os bothubs coletam informações...empty

Perguntas frequentes sobre Whisper 1

Posso usar os resultados de Whisper 1 para fins comerciais?

Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.

O que o whisper-1 faz e para quais tarefas é adequado?

O whisper-1 da OpenAI transcreve áudio para texto. Você carrega a gravação e recebe a transcrição. É adequado para entrevistas, podcasts, chamadas, palestras, mensagens de voz e rascunhos de legendas. É útil quando você precisa transformar rapidamente horas de conversas em texto legível para pesquisa e edição.

Quanto texto o whisper-1 pode escrever em uma única resposta?

Até 4096 tokens por resposta — isso equivale a algumas páginas de transcrição, o contexto do modelo é de 4095 tokens. É melhor dividir gravações longas em fragmentos e enviá-los um por um, depois juntar o resultado: assim nada é cortado no meio de uma frase.

O whisper-1 consegue raciocinar antes de responder?

Em nossos dados, não há um modo de raciocínio separado para o whisper-1, e isso não é necessário para a tarefa: o modelo reconhece a fala, não constrói cadeias de raciocínio. Se precisar de análise da transcrição, envie o texto para um modelo de texto na mesma janela do BotHub.

O whisper-1 suporta chamada de funções e saída em JSON?

Em nossos dados, a chamada de funções e a saída estrita em JSON não estão marcadas para o whisper-1. O acesso é feito através da API do BotHub compatível com OpenAI: você envia o arquivo e recebe a transcrição, e pode estruturá-la do seu lado ou no próximo passo do pipeline.

É possível carregar imagens, áudio ou vídeo no whisper-1?

Áudio — sim, esta é a entrada principal do modelo: o whisper-1 transforma a trilha sonora em texto. Imagens não estão marcadas como entrada em nossos dados. Com vídeos, funciona de forma simples: extraia a trilha de áudio com qualquer conversor e envie para reconhecimento.

Quão bem o whisper-1 entende o idioma russo?

O whisper-1 é um modelo multilíngue de reconhecimento de fala; ele entende e transcreve o idioma russo. A qualidade depende mais da gravação em si: áudio limpo, um único falante e ritmo calmo produzem um texto visivelmente mais preciso do que uma sala barulhenta ou um sotaque forte. Teste com seu arquivo.

Service d'AssistanceOuvert de 10h00 à 18h00 MSK