GPT OSS 120B Batch
нейросеть
GPT OSS 120B — открытая модель OpenAI с архитектурой Mixture-of-Experts для рассуждений и агентных задач.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Как работает GPT OSS 120B Batch?
GPT OSS 120B — открытая языковая модель OpenAI на 117 миллиардов параметров с архитектурой Mixture-of-Experts: на каждый проход активируется около 5,1 миллиарда параметров, поэтому модель держит уровень рассуждений, оставаясь экономной в вычислениях. Она создавалась под задачи, где важны цепочки рассуждений, агентное поведение и стабильная работа в продакшене, а вариант batch рассчитан на пакетную обработку больших объёмов запросов. Через BotHub вы подключаетесь к ней без VPN и зарубежной карты, платите российской картой в рублях по факту за токены, а сами токены не сгорают. Единый OpenAI-совместимый API позволяет встроить модель в свой сервис и при необходимости переключиться на другую из более чем 250 доступных, не переписывая интеграцию, а данные передаются в зашифрованном виде и не сохраняются. Пригодится, когда нужно разобрать логи и объяснить ошибку в коде, собрать агента с вызовом функций и внешними инструментами, прогнать массовую классификацию документов, разложить STEM-задачу по шагам или обработать очередь однотипных запросов разом.Частые вопросы о GPT OSS 120B Batch
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
gpt-oss-120b:batch — текстовая модель с режимом рассуждений: разбирает длинные документы, пишет и рефакторит код, ищет ошибки, решает задачи по математике и логике, готовит аналитику и выжимки. Контекстное окно 131 072 токена, поэтому в запрос поместятся большие файлы и целые ветки диалога.
До 117 964 токенов в одном ответе — это десятки страниц текста. Модель спокойно выдаёт большой документ, подробный разбор или объёмный модуль кода целиком, без дробления на части. Если ответ всё же обрывается, просто попросите продолжить с места остановки.
Да, рассуждения перед ответом заявлены в возможностях модели: прежде чем сформулировать результат, она разбирает условие по шагам. На задачах с вычислениями, логикой и отладкой кода это заметно помогает. Учтите, что размышления тоже расходуют токены вывода.
Да, модель поддерживает вызов функций и структурированный вывод в JSON — её удобно встраивать в агентов, чат-ботов и пайплайны, где ответ нужно сразу парсить. В BotHub это работает через единый OpenAI-совместимый API, так что другую модель потом подключите без переписывания интеграции.
Помимо текста модель принимает документы — загрузите файл и попросите разбор, сводку или ответы по содержимому. Работа с изображениями, аудио и видео в её возможностях не отмечена, поэтому для таких форматов переключитесь в том же окне BotHub на профильную модель.
Данных о качестве работы с конкретными языками у нас нет, поэтому обещать ничего не будем — проще проверить на своей задаче. Оплата идёт по факту за токены, и тот же промпт можно сразу отправить другой модели в одном окне и сравнить ответы.