Voxtral Small 24B 2507
Rede Neural
Voxtral Small 24B é um modelo Mistral com entrada de áudio para transcrição, tradução de fala e compreensão de gravações de áudio.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Voxtral Small 24B 2507?
Voxtral Small 24B é um desenvolvimento da Mistral: uma evolução do Mistral Small 3, ao qual foi adicionado processamento de áudio na entrada, mantendo as capacidades de texto do modelo base. O modelo aceita áudio e lida com transcrição de fala, tradução e compreensão do conteúdo da gravação, além de continuar sendo um modelo de texto comum para tarefas habituais. No BotHub, você trabalha com ele sem VPN ou cartão estrangeiro: pagamento com cartões russos em rublos e por uso, os tokens não expiram. Ao lado, em uma única janela, há mais de 250 modelos, então você pode comparar o resultado com outro modelo em poucos cliques, e uma API única compatível com OpenAI permite conectar o Voxtral Small ao seu serviço e alternar depois sem reescrever a integração; as solicitações são criptografadas com AES-GCM. Útil se você precisar transformar a gravação de uma chamada ou entrevista em texto, criar um resumo de um podcast ou palestra, processar mensagens de áudio de clientes no suporte, traduzir fala de uma gravação ou incorporar entrada de voz em seu próprio aplicativo.Perguntas frequentes sobre Voxtral Small 24B 2507
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
O Voxtral Small 24B da Mistral AI trabalha com texto e documentos: responde a perguntas, resume e estrutura o conteúdo de arquivos, ajuda com correspondência, código e análise. Suporta chamada de funções, sendo adequado para integração em serviços através da API única compatível com OpenAI do BotHub.
Até 26.214 tokens em uma única resposta — o suficiente para um artigo extenso, uma análise detalhada de documento ou um grande fragmento de código. A janela de contexto total é de 32.000 tokens, incluindo sua solicitação com arquivos e a própria resposta.
Não há um modo separado de raciocínio passo a passo indicado em nossos dados para este modelo. Mas você pode pedir diretamente no prompt para analisar a tarefa passo a passo, listar as condições e verificar o resultado — na prática, isso aumenta visivelmente a precisão da análise.
Sim. O modelo suporta chamada de funções e saída estruturada em JSON: você descreve as ferramentas, ele escolhe a necessária e retorna os argumentos no esquema definido. Útil para agentes, análise de documentos em campos e integrações — as solicitações passam pela API compatível com OpenAI.
De acordo com nossos dados, texto e documentos são aceitos como entrada — o arquivo pode ser carregado na íntegra e o modelo analisará seu conteúdo. O recebimento de imagens, áudio e vídeo separadamente não está indicado, portanto, para essas tarefas, é mais conveniente escolher um modelo especializado no BotHub na mesma janela.
Não temos dados sobre os idiomas de prompts e respostas, portanto não prometemos nada aqui — verifique em seu próprio cenário. Você pode comparar vários modelos na mesma solicitação diretamente no BotHub, sem VPN ou cartão estrangeiro, com pagamento em rublos.