GLM 5 Turbo
нейросеть
GLM 5 Turbo — модель Z.ai для агентных сценариев и быстрых ответов; glm 5 turbo api подойдёт для автоматизации рабочих процессов.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Как работает GLM 5 Turbo?
GLM 5 Turbo — модель от Z.ai, рассчитанная на быстрый отклик и уверенную работу в агентных средах. Её оптимизировали под реальные рабочие процессы агентов, где нужно не просто ответить, а пройти цепочку шагов и обратиться к внешним инструментам, поэтому она хорошо подходит для сценариев с чувствительной к задержкам автоматизацией. В BotHub доступ к ней открывается без VPN и зарубежной карты: вы платите российской картой в рублях по факту за токены, а они не сгорают. В том же окне рядом более 250 нейросетей, между которыми легко переключаться и сравнивать ответы, а единый OpenAI-совместимый API позволяет сменить модель в мультимодельной системе, не переписывая интеграцию; переписка шифруется по AES-GCM, для компаний есть договор, счёт, ЭДО и админ-панель с лимитами. Берите GLM 5 Turbo для агентов, которые сами ходят по инструментам и доводят задачу до конца, для автоматизации рутины в поддержке и внутренних сервисах, для потоковой обработки запросов, где важна скорость, а также для прототипирования мультиагентных пайплайнов.Частые вопросы о GLM 5 Turbo
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
Это текстовая модель от z-ai с рассуждениями, вызовом функций и приёмом изображений и документов. Подходит для работы с кодом: написания, рефакторинга, отладки, а также для разбора длинных документов, аналитики, STEM-задач и встраивания в мультиагентные сценарии через единый OpenAI-совместимый API BotHub.
Лимит вывода — 131 072 токена за один ответ при контекстном окне 202 752 токена. Этого хватает на большой технический документ, объёмный модуль кода или подробный разбор целиком, без дробления задачи на десятки отдельных запросов и ручной склейки частей.
Да, рассуждения перед ответом подтверждены нашими данными. Модель сначала выстраивает ход решения, а затем выдаёт результат — это заметно на математике, логике, многошаговом анализе и отладке кода. На простых запросах выигрыш меньше, зато на сложных ответ собраннее.
Да, поддерживаются и вызов функций, и структурированный вывод в JSON. Опишите свои инструменты — модель сама выберет нужный, передаст аргументы и вернёт ответ по заданной схеме. Удобно для агентов, парсинга документов и интеграций с вашим бэкендом через единый API.
Изображения и документы модель принимает на вход: разберёт скриншот, схему, таблицу или файл и ответит текстом. Про аудио и видео пометки в наших данных нет, поэтому для озвучки или разбора записей удобнее взять профильную модель в том же окне BotHub.
Отдельной пометки про языки в наших данных нет, поэтому обещать ничего не станем. Проще проверить на своей задаче: отправьте типовой промпт в BotHub, сравните вывод с другой моделью в том же окне и оставьте ту, что справилась лучше. Переключение не требует переписывания интеграции.