Granite 4.0 H Micro
Rede Neural
Granite 4.0 H Micro: modelo de linguagem compacto da IBM com 3 bilhões de parâmetros, disponível via API para integrar em seus produtos.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Granite 4.0 H Micro?
Granite 4.0 H Micro é um modelo compacto da família Granite 4.0 da IBM: 3 bilhões de parâmetros, tornando-o leve e rápido onde um modelo grande é excessivo. É projetado para tarefas diárias de texto: análise de documentos e correspondência, geração e edição de código, rascunhos, estruturação de notas e respostas baseadas em material fornecido. Através do BotHub, o modelo é acessível sem VPN ou cartão estrangeiro; o pagamento é feito com cartão russo em rublos, apenas pelos tokens usados, sem assinatura, e os tokens não expiram. Com mais de 250 modelos em uma única janela, é fácil comparar as respostas do Granite com outros e alternar para o adequado; uma API única compatível com OpenAI permite fazer isso sem reescrever a integração. Os dados são transmitidos com criptografia AES-GCM, e empresas têm acesso a contratos, faturas, EDI e painel administrativo com limites. Desenvolvedores usam este modelo como uma camada rápida para gerar e analisar código, o suporte ao cliente para classificar solicitações e rascunhos de respostas, analistas para resumir documentos longos, e equipes de produto para protótipos de assistentes onde a velocidade de resposta é crucial.Perguntas frequentes sobre Granite 4.0 H Micro
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
O granite-4.0-h-micro é um modelo de texto compacto da linha Granite 4.0. Ele responde a perguntas, escreve e edita textos, analisa documentos, ajuda com código e analisa imagens. Através do BotHub, o modelo está disponível na Rússia sem VPN ou cartão estrangeiro, o pagamento é feito conforme o uso e os tokens não expiram.
Em uma única resposta, o modelo gera até 117.900 tokens, ou seja, um volume muito grande de texto. O contexto chega a 131.000 tokens, portanto, tanto o material original volumoso quanto o resultado final cabem em uma única janela. Isso é suficiente para documentos longos e grandes arquivos de dados.
Não há indicação específica sobre um modo de raciocínio antes da resposta em nossos dados, portanto, não prometeremos reflexões passo a passo. O modelo da linha Granite 4.0 responde diretamente. Se uma longa cadeia lógica for importante para a tarefa, compare-o com outro modelo no BotHub usando seus próprios exemplos.
Não há indicação sobre chamada de funções e saída estruturada em JSON em nossos dados, portanto, não afirmaremos isso com certeza. Verifique a documentação do modelo ou teste com sua solicitação. Se o sistema precisar de JSON estrito, existem modelos com suporte confirmado no BotHub.
O modelo aceita imagens e documentos como entrada, conforme indicado em suas capacidades. Áudio e vídeo não estão declarados na descrição, portanto, não devem ser carregados. Textos, imagens e documentos podem ser enviados convenientemente através do BotHub, acessível da Rússia sem VPN ou cartão estrangeiro.
Não temos dados específicos sobre a qualidade do idioma russo, portanto, não prometeremos um resultado perfeito. O modelo lida com confiança com tarefas de texto de natureza geral, mas as respostas em russo devem ser verificadas com seus próprios exemplos. No BotHub, você pode alternar para outro modelo e comparar o resultado na mesma solicitação.