Gemini 2.5 Flash Lite
нейросеть
Gemini 2.5 Flash Lite — лёгкая модель Google с рассуждением, рассчитанная на минимальную задержку и высокую скорость генерации.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Картинка-промт
(за 1K токенов)
Как работает Gemini 2.5 Flash Lite?
Gemini 2.5 Flash Lite — облегчённая модель с рассуждением из семейства Gemini 2.5 от Google, собранная вокруг скорости: сверхнизкая задержка, выросшая пропускная способность и экономичная работа на больших объёмах запросов. Относительно прошлой версии линейки токены генерируются быстрее, а общая производительность выше. В BotHub она открывается из России без VPN и зарубежной карты, а платите вы российской картой в рублях по факту — за израсходованные токены, без обязательной подписки, и токены не сгорают. Рядом, в одном окне, доступно более 250 нейросетей: ответы легко сравнить и переключиться на другую модель, не меняя инструмент. Единый API BotHub подключает Gemini 2.5 Flash Lite к вашему сервису, а смена модели не потребует переписывать интеграцию; переписка шифруется по AES-GCM и не сохраняется. Компаниям доступны договор, счёт, ЭДО, админ-панель и лимиты на сотрудников. Сценарии простые: чат-боты поддержки с мгновенным ответом, потоковая обработка и классификация больших массивов текста, краткие выжимки и черновики, подсказки внутри интерфейса продукта, быстрые итерации при отладке промптов.Частые вопросы о Gemini 2.5 Flash Lite
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
Модель работает с текстом, документами и изображениями: разбирает длинные файлы и отвечает на вопросы по ним, пишет и правит код, помогает с рассуждениями и STEM-задачами. Контекст — 1 048 576 токенов, поэтому в запрос поместится крупная документация или история переписки целиком.
За один ответ выходит до 65 535 токенов — это десятки страниц. Хватит на подробный разбор документа, объёмный перевод или модуль кода целиком. Если материал не уместился, просто попросите продолжить: контекста в 1 048 576 токенов достаточно, чтобы держать весь диалог.
Да, рассуждения перед ответом поддерживаются: прежде чем выдать результат, модель прогоняет цепочку размышлений. Это заметно на математике, логике, анализе данных и отладке кода, где задачу нужно разложить на шаги. Чем сложнее запрос, тем ощутимее эффект.
Да, есть и вызов функций, и структурированный вывод JSON. Вы описываете инструменты, модель сама решает, когда их применить, а ответ возвращает по заданной схеме — это удобно для агентов, ботов и интеграций. Подключение идёт через единый OpenAI-совместимый API BotHub.
По нашим данным на вход принимаются текст, изображения и документы: скриншоты, схемы, таблицы, сканы и PDF модель читает нативно, без предварительной конвертации. Пометки про аудио и видео у нас нет, поэтому такой сценарий стоит проверить на своём файле прямо в чате.
Отдельной пометки о языках в наших данных нет, поэтому обещаний давать не будем — надёжнее проверить на своём тексте. Сделать это легко: в BotHub модель доступна без VPN и зарубежной карты, оплата в рублях по факту, а рядом в том же окне другие модели для сравнения.