GLM 4.7 Flash
нейросеть
GLM 4.7 Flash для кода и агентных сценариев: модель Z.ai класса 30B, которая держит баланс между качеством и скоростью.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Как работает GLM 4.7 Flash?
GLM 4.7 Flash — модель семейства GLM от Z.ai класса 30B, собранная так, чтобы держать баланс между качеством ответов и скоростью работы. Относительно прошлой версии здесь дополнительно усилены навыки программирования и планирование длинных многошаговых задач, поэтому модель рассчитана на агентные сценарии, где действия идут цепочкой, а не единичным ответом. В BotHub вы работаете с ней без VPN и зарубежной карты: оплата проходит российскими картами в рублях и списывается по факту за токены, а неизрасходованный баланс не сгорает. Рядом в одном окне открыты остальные модели агрегатора, а единый OpenAI-совместимый API позволяет сменить модель в коде без переписывания интеграции; запросы передаются с шифрованием AES-GCM. Типичные задачи — писать и рефакторить код в существующем проекте, разбирать ошибки и причины падения тестов, собирать агентов, которые выполняют план из нескольких шагов, обрабатывать поток однотипных запросов, где важна экономия на токенах, и подключать модель к внутренним сервисам через API. Для компаний BotHub оформляет договор, счёт и ЭДО, даёт админ-панель и лимиты.Частые вопросы о GLM 4.7 Flash
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
Модель работает с текстом: отвечает на вопросы, пишет и разбирает код, анализирует документы и изображения, рассуждает над задачей перед ответом и вызывает внешние функции. Контекст в 200 000 токенов позволяет держать в одном диалоге крупный проект или целую пачку файлов.
До 117 964 токенов в одном ответе — это объём небольшой книги. Хватит на длинный технический текст, подробный разбор кода или документацию целиком, без нарезки на части и просьб продолжить. Общее окно диалога при этом составляет 200 000 токенов.
Да, рассуждения перед ответом подтверждены нашими данными: модель сначала раскладывает задачу на шаги и только потом формулирует результат. Это помогает на математике, логике, отладке кода и там, где важна цепочка выводов, а не быстрая реплика наугад.
Да, и то и другое. Модель вызывает функции и отдаёт структурированный JSON, поэтому её удобно ставить в агентные сценарии и связывать с внешними сервисами. Через единый OpenAI-совместимый API BotHub это подключается без переписывания вашей интеграции.
Изображения и документы — да, их можно отправить на вход и получить текстовый разбор: схему, скриншот, таблицу, договор. Аудио и видео в наших данных не отмечены, поэтому для них в BotHub удобнее взять профильную модель, переключившись в том же окне.
Отдельных данных о качестве русского у этой модели мы не фиксируем, так что обещать ничего не будем — проверьте на своей реальной задаче. В BotHub это несложно: оплата по факту за токены без подписки, а рядом в том же окне есть другие модели для сравнения.