TBank VoiceKit STT

Rede Neural

Bip-bup, escrevendo texto para você...
pc1pc2pc3pc4
Inicial

/

Modelos

/

TBank VoiceKit STT
4 096

Comprimento máximo de resposta

(em tokens)

4 095

Tamanho do contexto

(em tokens)

13 200 $

Custo do prompt

(por 1M tokens)

*Os preços indicados são para uso da API via provedores ECO.
bothub
BotHub: Experimente redes neurais gratuitamentebot

Caps restantes: 0 CAPS
Exemplo de código e API para TBank VoiceKit STTOferecemos acesso completo à API OpenAI através do nosso serviço. Todos os nossos endpoints estão totalmente em conformidade com os endpoints OpenAI e podem ser usados tanto com plugins quanto ao desenvolver seu próprio software através do SDK.Criar chave API
Javascript
Python
Curl

Como funciona TBank VoiceKit STT?

Os bothubs coletam informações...empty

Perguntas frequentes sobre TBank VoiceKit STT

Posso usar os resultados de TBank VoiceKit STT para fins comerciais?

Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.

O que o voicekit-stt consegue fazer e para quais tarefas é adequado?

O voicekit-stt é um modelo de reconhecimento de fala da T-Bank VoiceKit: ele traduz áudio para texto, incluindo gravações longas. É adequado para transcrever reuniões, entrevistas, chamadas e podcasts, além de preparar notas e rascunhos de legendas. Acesso a partir da Rússia sem VPN ou cartão estrangeiro, pagamento em rublos.

Quanto texto o voicekit-stt pode escrever em uma única resposta?

Em uma única resposta, o modelo fornece até 4096 tokens de texto, com um contexto de 4095 tokens. Isso é suficiente para transcrever um fragmento de gravação; se o áudio for longo, divida-o em partes e junte os resultados ou processe em lotes via API.

O voicekit-stt sabe raciocinar antes de responder?

Raciocínios passo a passo não estão marcados em nossos dados e não são o foco para esta tarefa: o voicekit-stt é otimizado para a transcrição precisa da fala, não para reflexões. Se precisar de análise, conclusões ou um resumo do texto pronto, envie a transcrição para qualquer modelo de texto no BotHub.

O voicekit-stt suporta chamada de funções e saída em JSON?

Chamada de funções e saída estruturada em JSON não estão marcadas em nossos dados. Na saída, você recebe o texto reconhecido. Se precisar de estrutura — campos, tags, tabela — envie a transcrição para um modelo de texto através da API compatível com OpenAI do BotHub, sem precisar reescrever a integração.

É possível carregar imagens, áudio ou vídeo no voicekit-stt?

Áudio — sim, esta é a entrada principal: o modelo aceita gravações, incluindo arquivos grandes. O recebimento de imagens e vídeos não está marcado em nossos dados, portanto, conte com faixas de áudio. Se precisar trabalhar com imagens ou vídeos, mude para outro modelo na mesma janela.

Quão bem o voicekit-stt entende o idioma russo?

Este é um desenvolvimento do fornecedor russo T-Bank VoiceKit, e o serviço foi criado para tarefas de reconhecimento de fala em russo. Não publicamos métricas de qualidade precisas, portanto, a melhor maneira é testar suas próprias gravações: chamadas, entrevistas, ligações — e comparar a transcrição com outros modelos no BotHub.

Serviço de SuporteAberto das 10:00 às 18:00 (MSK)