Mistral Small 24B Instruct 2501
Rede Neural
Mistral Small 24B Instruct 2501 é um modelo de linguagem da Mistral AI com 24B de parâmetros, otimizado para baixa latência de resposta
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Mistral Small 24B Instruct 2501?
Mistral Small 24B Instruct 2501 é um modelo de linguagem da Mistral AI com 24 bilhões de parâmetros, criado com um objetivo: responder rapidamente a tarefas cotidianas. O desenvolvedor o lança sob a licença Apache 2.0 em duas variantes — pré-treinado e ajustado por instruções, sendo a versão Instruct projetada para seguir comandos diretos do usuário. Seu tamanho compacto proporciona baixa latência onde a velocidade de reação é crucial, em vez de longos períodos de raciocínio. No BotHub, o modelo está acessível sem necessidade de VPN ou cartão internacional: você paga pelo uso real dos tokens, que não expiram. No mesmo painel, há mais de 250 modelos para alternar facilmente, comparando respostas para o mesmo prompt, e a API unificada do BotHub permite integrar o Mistral Small ao seu produto e trocar de modelo posteriormente sem reescrever a integração. É ideal para assistentes de suporte responsivos, processamento e rotulagem de textos em massa, extração de dados de documentos, rascunhos de e-mails e materiais padrão, além de servir como uma camada auxiliar rápida ao lado de modelos mais pesados.Perguntas frequentes sobre Mistral Small 24B Instruct 2501
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
É um modelo de texto da Mistral com um contexto de 32.000 tokens. Adequado para escrever e editar textos, trabalhar com código, responder a perguntas sobre documentos e imagens carregados, além de cenários com chamadas de função — chatbots, assistentes e serviços internos da empresa.
O limite de saída é de 16.384 tokens por resposta, o que equivale a dezenas de milhares de caracteres: suficiente para um artigo longo, uma análise detalhada ou um fragmento de código volumoso. O contexto total do diálogo é de 32.000 tokens, e a solicitação com a resposta cabem nele juntas.
Não há um modo de raciocínio separado com uma cadeia de pensamento visível em nossos dados. No entanto, você pode pedir ao modelo no prompt para analisar a tarefa passo a passo, verificar o processo de solução e só então fornecer o resultado — isso ajuda significativamente em tarefas complexas.
Sim, o modelo suporta chamada de funções e saída estruturada em JSON. Isso é conveniente para integrações: o modelo decide por si mesmo qual ferramenta chamar e retorna a resposta no esquema definido. No BotHub, tudo funciona através de uma API unificada compatível com OpenAI.
Além de texto, imagens e documentos são aceitos como entrada: você pode mostrar uma captura de tela, um diagrama ou enviar um arquivo e fazer perguntas sobre o conteúdo. Para narração, transcrição ou trabalho com vídeo, mude para um modelo especializado — no BotHub, isso é feito na mesma janela.
A Mistral declara seus modelos instruct como multilíngues, e o português está entre os idiomas suportados, então o modelo lida bem com tarefas de trabalho comuns. O quão satisfeito você ficará com o estilo das respostas é mais fácil verificar com seus próprios prompts — o acesso no BotHub funciona sem VPN e cartão internacional.