Granite 4.0 H Micro
нейросеть
Granite 4.0 H Micro — компактная языковая модель IBM на 3 млрд параметров, доступная по API для интеграции в ваши продукты.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Как работает Granite 4.0 H Micro?
Granite 4.0 H Micro — компактная модель семейства Granite 4.0 от IBM: 3 миллиарда параметров, что делает её лёгкой и быстрой там, где крупная модель избыточна. Она рассчитана на повседневную текстовую работу: разбор документов и переписки, генерацию и правку кода, черновики, структурирование заметок и ответы по заданному материалу. Через BotHub модель открывается без VPN и зарубежной карты, оплата идёт российской картой в рублях и только за использованные токены, без подписки, а токены не сгорают. В одном окне рядом более 250 моделей, поэтому ответы Granite легко сравнить с другими и переключиться на подходящую; единый OpenAI-совместимый API позволяет сделать это, не переписывая интеграцию. Данные передаются с шифрованием AES-GCM, а компаниям доступны договор, счёт, ЭДО и админ-панель с лимитами. Разработчики используют такую модель как быстрый слой для генерации и разбора кода, служба поддержки — для классификации обращений и черновиков ответов, аналитики — для сжатия длинных документов до сути, продуктовые команды — для прототипов ассистентов, где важна скорость отклика.Частые вопросы о Granite 4.0 H Micro
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
Granite-4.0-h-micro это компактная текстовая модель линейки Granite 4.0. Она отвечает на вопросы, пишет и редактирует тексты, разбирает документы, помогает с кодом и анализирует изображения. Через BotHub модель доступна из России без VPN и зарубежной карты, оплата идёт по факту, а токены не сгорают.
За один ответ модель выдаёт до 117 900 токенов, то есть очень большой объём текста. Контекст при этом доходит до 131 000 токенов, поэтому в одно окно помещается и объёмный исходный материал, и готовый результат. Этого хватает для длинных документов и больших файлов с данными.
Отдельной пометки о режиме рассуждений перед ответом в наших данных нет, поэтому обещать пошаговые размышления не будем. Модель из линейки Granite 4.0 отвечает прямо. Если для задачи важна длинная логическая цепочка, сравните её с другой моделью в BotHub на своих примерах.
Пометки о вызове функций и структурированном выводе JSON в наших данных нет, поэтому утверждать это наверняка мы не станем. Уточните в документации модели или протестируйте на своём запросе. Если для системы нужен строгий JSON, рядом в BotHub есть модели с подтверждённой поддержкой.
Изображения и документы модель принимает на вход, это указано в её возможностях. Аудио и видео в описании не заявлены, поэтому загружать их не стоит. Текст, картинки и документы удобно отправлять через BotHub, доступный из России без VPN и зарубежной карты.
Отдельных данных о качестве русского языка у нас нет, поэтому обещать идеальный результат не станем. Модель уверенно справляется с текстовыми задачами общего вида, но русскоязычные ответы стоит проверить на своих примерах. В BotHub можно переключиться на другую модель и сравнить результат на том же запросе.