Step 3.5 Flash
нейросеть
Step 3.5 Flash API — открытая модель StepFun на архитектуре Mixture of Experts для текстовых задач и интеграции в свои сервисы.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Как работает Step 3.5 Flash?
Step 3.5 Flash — открытая языковая модель StepFun на разреженной архитектуре Mixture of Experts: из 196 млрд параметров на каждый токен активируются лишь 11 млрд, поэтому вычисления расходуются экономно при большом объёме знаний модели. В BotHub она доступна без VPN и зарубежной карты: платите российской картой в рублях и только за фактически израсходованные токены, которые не сгорают. Рядом в одном окне открыты более 250 нейросетей, поэтому сравнить ответы или переключиться на другую модель можно в пару кликов, а единый OpenAI-совместимый API избавляет от переписывания интеграции. Диалоги шифруются по AES-GCM, данные не сохраняются, а для компаний есть договор, счёт, ЭДО, админ-панель и лимиты на сотрудников. Берите Step 3.5 Flash, когда нужно разобрать поток пользовательских обращений, подготовить и переписать черновики текстов, собрать выжимку из длинных документов или протестировать модель как запасной вариант в мультимодельном сервисе.Частые вопросы о Step 3.5 Flash
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
step-3.5-flash от stepfun — текстовая модель с режимом рассуждений, приёмом изображений и документов на вход и вызовом функций. Контекст 256 000 токенов позволяет разбирать объёмные документы, кодовую базу и логи, писать и отлаживать код, готовить аналитические выжимки и выстраивать агентные сценарии.
Максимальный объём одного ответа — 65 536 токенов. Этого хватает на большой технический текст, подробный разбор документа или крупный фрагмент кода целиком, без дробления на части. Если ответ упёрся в лимит, просто попросите продолжить — модель допишет следующим сообщением.
Да, рассуждения перед ответом отмечены в возможностях модели: она прогоняет промежуточные шаги, прежде чем выдать результат. Это заметно на математике, логике, разборе требований и отладке — там, где важно не угадать ответ, а проследить цепочку.
Да, и то и другое. Благодаря function calling модель можно подключать к поиску, базам, калькуляторам и внутренним сервисам, а структурированный вывод JSON удобен, когда результат сразу уходит в код без ручного парсинга. Всё через единый OpenAI-совместимый API BotHub.
По нашим данным на вход принимаются текст, изображения и документы: можно прислать скриншот, схему, таблицу или файл и задавать вопросы по содержимому. Отдельных пометок про аудио и видео у нас нет, поэтому такие форматы стоит проверить на своей задаче.
Отдельных данных о качестве языков у нас нет, поэтому обещать ничего не будем — проверьте на своём промпте, это быстро. Интерфейс BotHub и Telegram-бот русскоязычные, доступ из России без VPN и зарубежной карты, оплата российскими картами.