Mistral Large 3 2512
Rede Neural
Mistral Large 3 2512 é um modelo de linguagem Mistral com arquitetura MoE esparsa e licença Apache 2.0, disponível na BotHub via API.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Mistral Large 3 2512?
Mistral Large 3 2512 é um grande modelo de linguagem da Mistral com arquitetura mixture-of-experts esparsa: de 675 bilhões de parâmetros, 41 bilhões ativos são usados por solicitação, exigindo menos computação do que um modelo denso de tamanho comparável. O modelo é licenciado sob Apache 2.0. Na BotHub, o modelo conecta-se sem VPN ou cartão estrangeiro, e você paga em rublos conforme o uso — por tokens consumidos que não expiram. Com mais de 250 redes neurais em uma janela, é fácil comparar respostas para a mesma solicitação. A API compatível com OpenAI permite trocar de modelo alterando apenas um parâmetro, sem reescrever a integração; as conversas são criptografadas via AES-GCM, e empresas têm acesso a contratos, faturas, EDI e painel administrativo com limites. O Mistral Large 3 2512 é geralmente usado para geração e refatoração de código, análise de erros em projetos de terceiros, rascunhos de documentação e notas analíticas, como núcleo de assistentes internos ou chatbots, e resolução passo a passo de problemas de matemática e ciências naturais.Perguntas frequentes sobre Mistral Large 3 2512
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
É um modelo de texto da Mistral: aceita texto, imagens e documentos como entrada e gera texto como saída. Adequado para trabalhar com código, analisar arquivos e materiais longos, análises, além de cenários com chamadas de ferramentas externas. Contexto de 262.144 tokens.
Até 209.715 tokens em uma única resposta — o limite é suficiente para um documento grande, instruções detalhadas ou refatoração volumosa sem dividir a tarefa. Se precisar de um resultado completo, peça diretamente ao modelo para não abreviar; na BotHub, o pagamento é feito conforme o uso por tokens consumidos.
Em nossos dados, um modo de raciocínio separado não está marcado para este modelo, mas isso não significa que não exista. Na prática, ajuda pedir para resolver a tarefa passo a passo no próprio prompt: com um contexto de 262.144 tokens, há espaço suficiente para um raciocínio detalhado.
Sim, tanto a chamada de funções (function calling) quanto a saída estruturada em JSON são confirmadas. O modelo pode chamar suas ferramentas e retornar uma resposta conforme o esquema definido. Na BotHub, isso funciona via uma API única compatível com OpenAI, permitindo trocar de modelo sem reescrever a integração.
Imagens e documentos — sim: envie uma captura de tela, diagrama, PDF ou outro arquivo e receba uma análise em texto. O recebimento de áudio e vídeo não está marcado em nossos dados, assim como a geração de qualquer coisa além de texto. Para essas tarefas, a BotHub possui modelos especializados.
As características por idioma não são registradas em nossos dados, portanto não podemos prometer detalhes — é mais confiável testar o modelo em sua tarefa real diretamente na BotHub, sem VPN ou cartão estrangeiro. Se o resultado não for satisfatório, há mais de 250 modelos disponíveis na mesma janela.