Mistral Small 3.2 24B Instruct
Rede Neural
Mistral Small 3.2 24B Instruct: modelo Mistral atualizado para seguir instruções com precisão e chamar funções via API.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Mistral Small 3.2 24B Instruct?
Mistral Small 3.2 24B Instruct é um modelo atualizado do laboratório francês Mistral com 24 bilhões de parâmetros, focado em seguir instruções com precisão. Comparado à versão 3.1, ele executa tarefas com mais cuidado, evita repetições e respostas em loop, e a chamada de funções tornou-se mais confiável, permitindo que o modelo gerencie cadeias de ferramentas com facilidade. No BotHub, você acessa sem VPN e paga em rublos apenas pelos tokens consumidos, sem assinaturas, e os tokens não utilizados não expiram. Com mais de 250 modelos disponíveis na mesma janela, você pode comparar respostas com o mesmo prompt. A API compatível com OpenAI permite conectar o Mistral Small 3.2 ao seu serviço e trocar de modelo futuramente sem reescrever a integração. Para empresas, oferecemos contrato, fatura, EDI e painel administrativo com limites. É ideal para criar agentes com chamadas de funções externas, analisar documentos conforme modelos, formatar respostas, processar fluxos de solicitações e e-mails, redigir textos com base em briefings ou integrar o modelo em produtos para demandas em massa.Perguntas frequentes sobre Mistral Small 3.2 24B Instruct
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
É um modelo instrutivo da Mistral com 24 bilhões de parâmetros. Ele analisa documentos e imagens, escreve e corrige código, responde perguntas, prepara resumos, e-mails e descrições. O contexto de 32.768 tokens permite trabalhar com um arquivo inteiro ou uma longa conversa.
Em uma única resposta, o modelo gera até 16.384 tokens — o suficiente para um artigo longo, uma análise detalhada ou um grande módulo de código. Precisa de mais? Peça para continuar: o contexto de 32.768 tokens comporta tanto sua solicitação quanto a parte já escrita.
Não há um modo de raciocínio separado indicado em nossos dados, então não conte com isso previamente. No entanto, você pode definir o processo de pensamento: peça para analisar a tarefa passo a passo, listar as condições e verificar o resultado — isso ajuda significativamente na lógica e na análise de código.
Sim, chamadas de função e saída estruturada em JSON são suportadas. O modelo é adequado para agentes, parsers e cenários onde a resposta vai direto para um banco de dados ou serviço externo. A conexão é feita via API unificada compatível com OpenAI do BotHub, então você não precisará reescrever a integração para outro modelo.
Imagens e documentos podem ser carregados: o modelo lerá digitalizações, tabelas, diagramas ou capturas de tela e responderá com texto. Áudio e vídeo não estão entre os tipos de entrada suportados — para esses arquivos, o BotHub possui modelos separados, disponíveis na mesma janela e com o mesmo pagamento.
Não fornecemos medições separadas por idioma nos dados do modelo, portanto, o mais confiável é testá-lo em sua tarefa — geralmente, alguns prompts são suficientes. Se o resultado não for satisfatório, há mais de 250 modelos na mesma janela: você pode alternar sem VPN e pagar com cartão russo.