GLM 5V Turbo
Rede Neural
GLM 5V Turbo é um modelo de agente nativamente multimodal da Z.ai para código, processamento de imagens e vídeo.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona GLM 5V Turbo?
GLM 5V Turbo é o primeiro modelo de agente nativamente multimodal da Z.ai: ele aceita imagens, vídeo e texto em um único fluxo, não através de reconhecedores separados, e é voltado para programação visual e cenários de agentes. O modelo é forte em planejamento de longo prazo, quando uma tarefa precisa ser dividida em etapas e levada até o resultado, e em código complexo. No BotHub, ele está disponível a partir da Rússia sem VPN e sem cartão estrangeiro: você paga com cartão russo em rublos pelo uso real de tokens, não por assinatura, e os tokens não expiram. Ao lado, em uma única janela, há mais de 250 outros modelos entre os quais é fácil alternar, e uma API única compatível com OpenAI permite conectar o GLM 5V Turbo ao seu serviço e trocar de modelo sem reescrever a integração. As conversas são criptografadas via AES-GCM e os dados não são salvos. Útil se você precisar montar uma interface a partir de um layout ou captura de tela, analisar um erro a partir de uma gravação de tela, descrever o conteúdo de um vídeo, atribuir uma tarefa de várias etapas a um agente ou realizar refatoração e depuração de código.Perguntas frequentes sobre GLM 5V Turbo
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
O glm-5v-turbo é um modelo da Z.ai para trabalhar com texto, documentos e imagens. É adequado para analisar materiais extensos: o contexto de até 202.752 tokens comporta documentação grande. Útil para código, análise de diagramas e capturas de tela, análise de dados, bem como para cenários com chamadas de funções externas.
Em uma única resposta, o glm-5v-turbo pode gerar até 131.072 tokens — isso equivale a dezenas de páginas. Essa capacidade é suficiente para uma análise detalhada de documentos, um relatório extenso ou um fragmento de código volumoso que não precisará ser montado em partes a partir de várias mensagens.
Sim, o modo de raciocínio é confirmado pelos nossos dados: antes de responder, o modelo estrutura o processo de solução em vez de fornecer a primeira opção que lhe vem à mente. Isso é perceptível em tarefas de várias etapas — matemática, lógica, análise de código e comparação de dados de documentos longos.
Sim, o glm-5v-turbo suporta chamada de funções e saída estruturada em JSON. Você descreve as ferramentas, o modelo decide por si mesmo quando chamá-las e retorna a resposta no esquema especificado. Através da API única compatível com OpenAI do BotHub, é fácil integrar isso em seus agentes e serviços.
Imagens e documentos — sim, eles podem ser enviados como entrada junto com a solicitação: o modelo descreverá a imagem, analisará um diagrama ou captura de tela, lerá o arquivo. Não há informações sobre áudio e vídeo em nossos dados, portanto, baseie-se nos formatos confirmados ou verifique com sua própria tarefa.
Não há uma avaliação separada da qualidade do russo em nossos dados, por isso não prometemos nada antecipadamente — verifique com suas próprias formulações, leva alguns minutos no chat. O serviço em si está disponível a partir da Rússia sem VPN e sem cartão estrangeiro, com pagamento em rublos pelo uso de tokens.