Ministral 3B 2512
Rede Neural
Ministral 3B 2512 é um modelo compacto da Mistral AI com suporte a imagens: API Ministral 3B para tarefas rápidas de texto e visão.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Ministral 3B 2512?
O Ministral 3B 2512 é o modelo mais compacto da família Ministral 3 da Mistral AI: um pequeno modelo de linguagem que, apesar do tamanho modesto, processa não apenas texto, mas também imagens. É escolhido pela sua velocidade de resposta e eficiência — ideal para cenários com alto volume de solicitações que não exigem raciocínios complexos. Através do BotHub, você acessa o modelo sem necessidade de VPN ou cartões internacionais, pagando em rublos apenas pelo que consumir, sem expiração de saldo. Tenha mais de 250 modelos em uma única janela para comparar respostas, e utilize uma API compatível com OpenAI para trocar de modelo sem reescrever integrações. O tráfego é criptografado via AES-GCM, o conteúdo dos diálogos não é armazenado e, para empresas, oferecemos contrato, fatura, EDI e painel administrativo com limites. Útil para processamento em massa de consultas curtas, classificação de textos, assistentes de chat rápidos, rascunhos, reescrita de trechos, análise de imagens e capturas de tela, ou para criar protótipos antes de migrar para modelos maiores.Perguntas frequentes sobre Ministral 3B 2512
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
É um modelo de texto compacto da Mistral com uma janela de contexto de 131.072 tokens. Adequado para trabalho diário com texto e documentos: sumarização, reescrita, respostas baseadas em arquivos carregados, ajuda com código, extração de dados de imagens e integração em aplicativos via API do BotHub.
O limite de saída é de 104.857 tokens por resposta, o suficiente para um documento grande, uma análise detalhada ou um grande trecho de código. O contexto de 131.072 tokens permite manter materiais de origem no diálogo e obter resultados longos sem quebras.
Não há um modo separado de cadeia de pensamento indicado em nossos dados. No entanto, você pode pedir ao modelo para resolver a tarefa passo a passo diretamente no prompt — isso geralmente melhora a qualidade em lógica e cálculos. Se precisar de raciocínio avançado, mude para um modelo de raciocínio na mesma janela.
Sim, o modelo suporta chamada de funções (function calling) e saída estruturada em JSON. Você descreve o esquema e as ferramentas, obtendo uma resposta previsível para análise e conexão com serviços externos. No BotHub, isso funciona via API compatível com OpenAI, então não é necessário reescrever a integração.
Imagens e documentos são aceitos como entrada: você pode pedir para descrever uma imagem, reconhecer um diagrama ou captura de tela, analisar um PDF e responder com base no conteúdo. O processamento de áudio e vídeo não está indicado em nossos dados — para essas tarefas, escolha um modelo especializado no catálogo.
Os modelos Mistral foram criados como multilíngues, portanto, o modelo funciona com consultas em português. A qualidade exata depende da tarefa, então teste com seus próprios dados. No BotHub, você paga apenas pelos tokens usados e pode comparar vários modelos em uma janela para escolher o melhor.