Llama 4 Maverick
Rede Neural
Llama 4 Maverick é um modelo multimodal da Meta com arquitetura mixture-of-experts para trabalhar com texto e imagens
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Llama 4 Maverick?
Llama 4 Maverick é um modelo multimodal da Meta, construído com a arquitetura mixture-of-experts: de 128 especialistas, apenas 17 bilhões de parâmetros são ativados por passagem, combinando a capacidade de uma arquitetura grande com computação econômica. A versão Instruct foi treinada para seguir instruções e dialogar, e a multimodalidade permite inserir não apenas texto, mas também imagens. No BotHub, você trabalha com ela sem VPN ou cartões estrangeiros: pagamento com cartões russos em rublos conforme o uso, e os tokens não expiram. Mais de 250 redes neurais estão disponíveis na mesma janela, facilitando a comparação do Llama 4 Maverick com outros modelos, e uma API única compatível com OpenAI permite alternar entre eles sem reescrever a integração. Solicitações e respostas são criptografadas; para empresas, oferecemos contrato, fatura, EDI e painel administrativo com limites. Útil para analisar o conteúdo de capturas de tela ou diagramas, criar um assistente que processa texto e imagens, decompor descrições técnicas longas em passos claros, ajudar com código e depuração, ou executar a mesma solicitação em vários modelos para escolher a melhor resposta.Perguntas frequentes sobre Llama 4 Maverick
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
O llama-4-maverick trabalha com texto: escreve e edita, analisa código, responde com base em documentos e analisa imagens. O contexto de até 524.288 tokens permite carregar arquivos volumosos e conversas longas na íntegra. Possui chamada de função, facilitando a integração do modelo em serviços e automações.
Em uma única resposta, o modelo gera até 16.384 tokens — o suficiente para um artigo longo, uma análise detalhada ou um grande fragmento de código. Se precisar de mais volume, peça para continuar de onde parou ou divida a tarefa em partes: o contexto de 524.288 tokens manterá todo o texto anterior.
Um modo de raciocínio separado não está indicado em nossos dados, por isso não podemos prometer. Na prática, um truque simples ajuda: peça no prompt para analisar a tarefa passo a passo, listar as condições e só então dar a conclusão — as respostas baseadas em lógica e cálculos tornam-se mais precisas.
Sim, a chamada de função e a saída estruturada em JSON são suportadas, permitindo conectar o modelo a pesquisas, bancos de dados ou serviços internos e receber respostas em um esquema definido. No BotHub, isso funciona através de uma API única compatível com OpenAI — você pode alternar o modelo sem reescrever a integração.
Imagens e documentos, sim: você pode enviar uma captura de tela, diagrama, foto ou arquivo e pedir para analisar o conteúdo. Áudio e vídeo não estão listados nos formatos de entrada suportados; para essas tarefas, o BotHub possui modelos separados disponíveis na mesma janela.
O trabalho com o idioma português não está descrito separadamente em nossos dados, por isso recomendamos testar o modelo com sua tarefa — alguns prompts de teste dirão mais do que qualquer promessa. Por parte do BotHub, tudo está em português: interface, suporte e pagamento com cartões russos, sem necessidade de VPN ou cartões estrangeiros.