Mistral Large 2512 Batch
Rede Neural
Mistral Large 2512 é o modelo de linguagem principal da Mistral AI com arquitetura MoE esparsa, disponível via API no BotHub.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Mistral Large 2512 Batch?
O Mistral Large 2512 é um desenvolvimento do laboratório francês Mistral AI e seu modelo mais capaz no momento do lançamento. Baseia-se em uma arquitetura de mistura de especialistas (mixture-of-experts) esparsa: de 675 bilhões de parâmetros, 41 bilhões são ativados por solicitação, combinando a qualidade de um modelo grande com o processamento econômico de tokens. O modelo é publicado sob a licença Apache 2.0, e esta variante foi projetada para processamento em lote, onde o volume é mais importante que a reação instantânea. No BotHub, você se conecta sem VPN ou cartão estrangeiro, paga em rublos pelo uso real dos tokens, não por assinatura, e trabalha com privacidade: o tráfego é criptografado e as conversas não são arquivadas. Uma API unificada compatível com OpenAI permite alternar para outro modelo entre mais de 250 disponíveis sem reescrever a integração, e empresas têm acesso a contratos, faturas, EDI e painel administrativo. Útil para processar documentos em massa, analisar logs, escrever código, consolidar análises de grandes textos, criar cenários com chamadas de função ou executar raciocínios longos agendados.Perguntas frequentes sobre Mistral Large 2512 Batch
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
É um modelo de texto Mistral com contexto de 262.144 tokens: ele analisa documentos longos, escreve e refatora código, ajuda com depuração, análise e tarefas STEM. Aceita não apenas texto, mas também imagens e documentos, e pode chamar funções externas.
O limite de uma resposta é de 209.715 tokens, um texto muito volumoso: suficiente para um grande relatório, documentação ou um módulo de código inteiro. Lembre-se de que a janela de 262.144 tokens é dividida entre a solicitação e a resposta, portanto, deixe uma margem para entradas enormes.
Em nossos dados, um modo de raciocínio separado não está marcado, mas isso não significa que o modelo não consiga lidar com lógica de várias etapas. Basta pedir para ele detalhar a solução passo a passo ou formular um plano primeiro — e você receberá uma análise detalhada, não apenas a conclusão final.
Sim, a chamada de funções e a saída estruturada em JSON estão confirmadas. O modelo escolherá a ferramenta necessária, inserirá os argumentos e retornará a resposta estritamente de acordo com seu esquema — isso é conveniente para agentes e integrações. A conexão é feita através da API unificada compatível com OpenAI do BotHub, portanto, você pode trocar de modelo sem reescrever o código.
De acordo com nossos dados, o modelo aceita imagens e documentos, e trabalha nativamente com documentos: você pode enviar uma digitalização, esquema ou relatório e pedir para analisar o conteúdo. Áudio e vídeo não estão listados nos formatos de entrada — para eles, o BotHub possui modelos especializados na mesma janela.
Não há notas sobre idiomas em nossos dados, então não daremos garantias. A maneira mais fácil de verificar é na prática: envie sua solicitação típica — contrato, correspondência ou ticket — e compare com outros modelos. O pagamento no BotHub é feito pelo uso real dos tokens, então esse teste não requer assinatura.