GLM 5
Rede Neural
GLM 5 é o modelo aberto emblemático da Z.ai, usado para código, design de sistemas e tarefas de agentes.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona GLM 5?
GLM 5 é o modelo aberto emblemático da Z.ai, criado para projetar sistemas complexos e cenários de agentes longos. O foco dos autores são desenvolvedores experientes: o modelo foi projetado para tarefas de programação em larga escala e nível pronto para produção, comparável aos principais modelos do mercado. Através do BotHub, o GLM 5 está disponível sem VPN ou cartão estrangeiro, e você paga em rublos conforme o uso — por tokens consumidos, que não expiram. Em uma única janela, há mais de 250 redes neurais, facilitando a comparação de respostas, e uma API única compatível com OpenAI permite trocar de modelo sem reescrever a integração; os dados são protegidos por criptografia AES-GCM. Para equipes, estão disponíveis contrato, fatura, EDI e painel administrativo com limites. Útil quando você precisa projetar a arquitetura de um serviço, revisar uma grande base de código, montar um agente para tarefas de engenharia de várias etapas, analisar e refatorar código legado ou integrar o modelo ao seu próprio produto via API.Perguntas frequentes sobre GLM 5
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
É um modelo de texto da Z.ai com raciocínio e chamada de ferramentas. Adequado para trabalhar com código, analisar documentos grandes, análise de dados e tarefas STEM. Contexto de 204.800 tokens; você pode enviar imagens e documentos, tornando o modelo conveniente para cenários mistos.
Até 128.000 tokens em uma resposta — isso equivale a dezenas de páginas de texto. Suficiente para um grande documento técnico, refatoração volumosa ou análise detalhada. Se a resposta atingir o limite, peça para continuar: o contexto de 204.800 tokens permite manter o diálogo completo.
Sim, o modo de raciocínio está confirmado: antes de responder, o modelo constrói uma cadeia de passos. Isso é perceptível em tarefas com matemática, lógica, depuração de código e documentos longos, onde é importante não perder detalhes. O raciocínio também consome tokens, mas as respostas ficam mais precisas.
Sim. O glm-5 suporta 'function calling' e saída estruturada em JSON, por isso é fácil integrá-lo em agentes, chatbots e pipelines com serviços externos. No BotHub, o acesso é feito via API única compatível com OpenAI: você pode trocar de modelo sem reescrever a integração.
Imagens e documentos — sim: segundo nossos dados, o modelo os aceita como entrada, então você pode pedir para analisar uma captura de tela, esquema, tabela ou PDF. Não temos informações sobre áudio e vídeo, portanto, para esses arquivos, é melhor escolher um modelo onde essa capacidade esteja indicada.
Não temos dados específicos sobre idiomas, por isso não prometemos nada — é mais fácil testar na sua tarefa. No BotHub, isso é rápido: o modelo abre sem VPN ou cartão estrangeiro, o pagamento é em rublos conforme o uso, e você pode comparar as respostas de outros modelos ao lado.