Mistral Small 3.1 24B Instruct
Rede Neural
Mistral Small 3.1 24B Instruct: modelo multimodal da Mistral AI para raciocínio, codificação e análise de imagens via API.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Mistral Small 3.1 24B Instruct?
Mistral Small 3.1 24B Instruct é a versão atualizada do Mistral Small 3 (2501) da Mistral AI: 24 bilhões de parâmetros e entrada multimodal, permitindo que o modelo analise não apenas texto, mas também imagens, destacando-se em raciocínio, codificação e chamada de funções. A principal diferença em relação à versão anterior é a compreensão de imagens mantendo o tamanho compacto. No BotHub, você acessa o modelo sem VPN ou cartões internacionais, paga em reais via Pix ou cartão, e os tokens não expiram. Uma API única compatível com OpenAI permite alternar entre mais de 250 modelos sem reescrever a integração. As conversas são criptografadas com AES-GCM, e empresas têm acesso a contratos, faturas e painel administrativo com limites. É ideal para analisar capturas de tela, diagramas e fotos de documentos, escrever e refatorar código em várias linguagens, depurar erros, criar agentes com function calling e processar grandes volumes de solicitações onde o equilíbrio entre qualidade e velocidade é essencial.Perguntas frequentes sobre Mistral Small 3.1 24B Instruct
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
É um modelo de texto da Mistral: adequado para correspondência e edição, análise e resumo, escrita e análise de código, e trabalho com documentos. Ele também aceita imagens e descreve seu conteúdo. O contexto de 128.000 tokens permite carregar um arquivo grande na íntegra e manter um diálogo longo.
Em uma única resposta, o modelo gera até 102.400 tokens — o suficiente para um documento volumoso, um artigo longo ou um grande bloco de código sem precisar dividir em partes. Se a geração for interrompida, basta pedir para continuar e o modelo completará o restante.
Não há um modo de raciocínio separado indicado em nossos dados. No entanto, você pode pedir ao modelo para analisar a tarefa passo a passo diretamente no prompt: ele detalhará o processo de solução e, em seguida, dará o resultado. Para lógica complexa e cálculos, essa técnica geralmente melhora significativamente o resultado.
Sim, o modelo suporta chamada de funções e saída estruturada em JSON, sendo fácil de integrar em agentes, chatbots e serviços de análise de dados. No BotHub, tudo funciona através de uma API única compatível com OpenAI, permitindo trocar de modelo sem reescrever a integração.
Imagens e documentos, sim: envie o arquivo junto com a pergunta e o modelo analisará o diagrama, captura de tela ou contrato e responderá com texto. Áudio e vídeo não estão na lista de formatos de entrada, mas o BotHub possui modelos específicos para isso na mesma janela.
Não há avaliações específicas para o português em nossos dados, por isso é mais seguro testar o modelo com suas próprias tarefas. Escreva algumas solicitações típicas e compare o resultado com outros modelos — no BotHub, eles estão disponíveis na mesma janela e a alternância leva segundos.