Gemma 3 4B IT
Rede Neural
Gemma 3 4B IT — modelo multimodal do Google para texto e imagens; API Gemma 3 com contexto de até 128k tokens.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Gemma 3 4B IT?
Gemma 3 4B IT — modelo multimodal do Google: aceita texto e imagens, responde com texto. O contexto de até 128k tokens permite manter um documento longo ou um grande trecho de código em uma única solicitação. O modelo entende mais de 140 idiomas e, em comparação com a geração anterior do Gemma, apresenta melhorias em matemática, raciocínio e qualidade de diálogo. No BotHub, o modelo está disponível sem VPN ou cartão internacional: você paga com cartão local em moeda nacional, apenas pelo uso real dos tokens, sem assinaturas, e os tokens não expiram. Mais de 250 redes neurais estão disponíveis na mesma janela, facilitando a alternância e a comparação de respostas. Uma API única compatível com OpenAI permite conectar o Gemma 3 ao seu serviço e substituí-lo por outro modelo sem reescrever a integração. As conversas são criptografadas via AES-GCM, e empresas têm acesso a contratos, faturas, EDI e painel administrativo com limites. Desenvolvedores podem usar o modelo para analisar código e explicar erros, analistas para resumir documentos longos e tabelas, equipes de suporte para classificar solicitações e rascunhar respostas, e profissionais visuais para obter descrições de capturas de tela, diagramas ou fotos.Perguntas frequentes sobre Gemma 3 4B IT
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
É um modelo compacto do Google da família Gemma. Aceita texto, documentos e imagens, e responde com texto: ideal para rascunhos e reescrita, resumo e estruturação, responder perguntas sobre arquivos carregados, analisar capturas de tela e tarefas simples de código. Contexto de 131.072 tokens.
Até 16.384 tokens em uma única resposta — o suficiente para um artigo longo ou um grande trecho de código. Se precisar de mais, basta pedir para continuar: o contexto de 131.072 tokens permite manter as partes anteriores do diálogo sem perder o estilo.
Em nossos dados, não há um modo de raciocínio separado para este modelo, então a resposta geralmente vem imediatamente. Você pode pedir para ele resolver a tarefa passo a passo diretamente no prompt. Se precisar de um modelo com raciocínio, alterne para outro na mesma janela.
Em nossos dados, a chamada de funções e a saída estruturada em JSON não estão marcadas para este modelo. Você pode pedir uma resposta em formato JSON via texto, mas o resultado deve ser validado. Para ferramentas confiáveis, use a API única compatível com OpenAI do BotHub e conecte um modelo adequado — não será necessário reescrever a integração.
Imagens e documentos — sim: anexe uma foto, captura de tela ou arquivo e peça para descrever o conteúdo, extrair dados ou explicar um erro na tela. O recebimento de áudio e vídeo não está marcado em nossos dados — para som e vídeos, existem modelos separados no BotHub.
Não temos dados específicos sobre os idiomas suportados, por isso não podemos prometer nada concreto — é mais rápido testar o modelo com suas consultas típicas. O BotHub funciona sem VPN ou cartão internacional: a interface está em russo, e o pagamento é feito com cartões locais.