GLM 5V Turbo
Red Neuronal
GLM 5V Turbo es un modelo de agente nativamente multimodal de Z.ai para código, imágenes y vídeo.
Longitud máxima de respuesta
(en tokens)
Tamaño del contexto
(en tokens)
Costo del prompt
(por 1M tokens)
Costo de la respuesta
(por 1M tokens)
Cómo funciona GLM 5V Turbo?
GLM 5V Turbo es el primer modelo de agente nativamente multimodal de Z.ai: acepta imágenes, vídeo y texto en un solo flujo, no a través de reconocedores separados, y está diseñado para programación visual y escenarios de agentes. El modelo es fuerte en planificación a largo plazo, cuando una tarea debe dividirse en pasos y llevarse a un resultado, y en código complejo. En BotHub, está disponible desde Rusia sin VPN ni tarjeta extranjera: pagas con tarjeta rusa en rublos por los tokens utilizados, no por suscripción, y los tokens no caducan. Junto a él, en una misma ventana, hay más de 250 modelos entre los que es fácil cambiar, y una API única compatible con OpenAI permite conectar GLM 5V Turbo a tu servicio y cambiar de modelo sin reescribir la integración. La correspondencia se cifra mediante AES-GCM y los datos no se guardan. Es útil si necesitas crear una interfaz a partir de un diseño o captura de pantalla, analizar un error a partir de una grabación de pantalla, describir el contenido de un vídeo, asignar una tarea de varios pasos a un agente o realizar refactorización y depuración de código.Preguntas frecuentes sobre GLM 5V Turbo
Puede usar los resultados generados con fines comerciales. Todos los derechos sobre el contenido creado le pertenecen. La única restricción: asegúrese de que la solicitud no incluya material de terceros protegido por derechos de autor. El usuario es responsable de respetar los derechos sobre los datos de entrada.
glm-5v-turbo es un modelo de z-ai para trabajar con texto, documentos e imágenes. Es adecuado para analizar materiales extensos: el contexto de hasta 202 752 tokens permite incluir documentación grande. Es útil para código, análisis de esquemas y capturas de pantalla, analítica, así como para escenarios con llamadas a funciones externas.
En una sola respuesta, glm-5v-turbo puede generar hasta 131 072 tokens, lo que equivale a decenas de páginas. Esta capacidad es suficiente para un análisis detallado de un documento, un informe extenso o un fragmento de código voluminoso que no tendrá que ensamblarse a partir de varios mensajes por partes.
Sí, el modo de razonamiento está confirmado por nuestros datos: antes de responder, el modelo estructura el proceso de solución en lugar de dar la primera opción que se le ocurre. Esto es notable en tareas de varios pasos: matemáticas, lógica, análisis de código y comparación de datos de documentos largos.
Sí, glm-5v-turbo admite la llamada a funciones y la salida estructurada en JSON. Usted describe las herramientas, el modelo decide por sí mismo cuándo llamarlas y devuelve la respuesta en el esquema especificado. A través de la API única compatible con OpenAI de BotHub, es fácil integrarlo en sus agentes y servicios.
Imágenes y documentos, sí, se pueden enviar como entrada junto con la solicitud: el modelo describirá la imagen, analizará un esquema o captura de pantalla, leerá el archivo. No hay notas sobre audio y vídeo en nuestros datos, así que confíe en los formatos confirmados o verifique con su propia tarea.
No hay una evaluación separada de la calidad del ruso en nuestros datos, por lo que no podemos prometer nada de antemano; verifíquelo con sus propias formulaciones, es cuestión de un par de minutos en el chat. El servicio en sí está disponible desde Rusia sin VPN ni tarjeta extranjera, el pago es en rublos según los tokens utilizados.