Gemma 3 12B
Rede Neural
Gemma 3 12B é um modelo multimodal do Google com contexto de 128k tokens para raciocínio, matemática e análise de imagens
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Gemma 3 12B?
Gemma 3 12B é um modelo do Google que funciona não apenas com texto: você pode enviar imagens junto com a solicitação, e a resposta vem em texto. A janela de contexto de até 128 mil tokens permite manter um documento volumoso ou uma longa conversa em um único diálogo, e o suporte a mais de 140 idiomas é útil para trabalhar com materiais internacionais. Em comparação com a geração anterior do Gemma, a matemática, o raciocínio lógico e o diálogo foram aprimorados. Através do BotHub, o modelo é acessado sem VPN ou cartão estrangeiro, e você paga em rublos apenas pelo que usar — pelos tokens consumidos, que não expiram. Ao lado, na mesma janela, há mais de 250 outras redes neurais: é conveniente comparar respostas para uma mesma solicitação, e uma API única compatível com OpenAI permite conectar o Gemma 3 12B ao seu serviço e trocar de modelo mais tarde sem reescrever a integração; o tráfego é criptografado e a conversa não é salva. É geralmente usado para analisar capturas de tela, diagramas e fotos de documentos, resolver problemas acadêmicos e matemáticos com explicações passo a passo, resumir relatórios e artigos longos, suporte de chat-assistente e processamento de textos multilíngues.Perguntas frequentes sobre Gemma 3 12B
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
gemma-3-12b-it é um modelo aberto do Google da família Gemma 3 com ajuste instrucional. Ele escreve e edita textos, explica material, ajuda com código, analisa documentos e responde a perguntas sobre imagens. O contexto de 131.072 tokens permite carregar arquivos longos e conversas inteiras.
Em uma única resposta, o modelo gera até 16.384 tokens — este é o volume de um artigo grande, uma instrução detalhada ou um grande fragmento de código. Se precisar de mais, continue a geração com a próxima solicitação: o contexto de 131.072 tokens permite manter todo o diálogo na memória.
Um modo de raciocínio separado não está indicado em nossos dados, portanto, não prometeremos uma cadeia de pensamento oculta. No entanto, você pode pedir diretamente no prompt para o modelo resolver o problema passo a passo — essa técnica geralmente melhora visivelmente as respostas em lógica, cálculos e análise de condições.
Sim, o modelo suporta chamada de funções e saída estruturada em JSON. Isso é conveniente para agentes, análise de documentos em um esquema definido e integrações onde a resposta vai diretamente para o código. No BotHub, tudo funciona através de uma API única compatível com OpenAI, então a conexão leva o mínimo de tempo.
Imagens e documentos — sim: o modelo analisa capturas de tela, diagramas, fotos e arquivos, respondendo a perguntas sobre seu conteúdo. A recepção de áudio e vídeo não está indicada em nossos dados. Na saída, você recebe texto, e imagens ou narração podem ser solicitadas a modelos especializados na mesma janela.
O Gemma 3 é um modelo multilíngue e funciona bem com o português: entende solicitações, escreve textos coerentes, resume documentos e e-mails. Em tarefas estilísticas complexas, vale a pena verificar a qualidade com seus próprios exemplos: o modelo é compacto, com cerca de 12 bilhões de parâmetros, e nuances sutis são mais difíceis para ele do que para modelos maiores.