Llama 3.2 3B Instruct
нейросеть
Llama 3.2 3B Instruct — компактная языковая модель Meta для диалогов, рассуждений и суммаризации, доступная в BotHub.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Как работает Llama 3.2 3B Instruct?
Llama 3.2 3B Instruct — компактная языковая модель Meta на 3 миллиарда параметров, построенная на современной трансформерной архитектуре и настроенная на диалог, рассуждения и суммаризацию текста. Многоязычность заложена в саму модель, а небольшой размер делает её удобной там, где важны скорость отклика и объём обработки. В BotHub она открывается без VPN и зарубежной карты: платите российской картой в рублях и только за то, что реально израсходовали, а неиспользованные токены не сгорают. Рядом в одном окне доступно больше 250 моделей, между которыми можно переключаться, сравнивая ответы на один и тот же запрос, а единый OpenAI-совместимый API позволяет сменить модель в продукте, не переписывая интеграцию. Переписка шифруется по AES-GCM, данные не сохраняются. Подойдёт для чат-ботов и ассистентов первой линии поддержки, для сжатия длинных переписок, отчётов и статей до короткой выжимки, для черновой обработки больших массивов текста перед передачей более тяжёлой модели и для встраивания в сервисы, где нужен быстрый языковой слой.Частые вопросы о Llama 3.2 3B Instruct
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
Модель работает с текстом и документами: суммаризация, переписывание, ответы по загруженному файлу, извлечение данных, черновики и простой код. Принимает на вход изображения, поддерживает вызов функций — удобно встраивать в сервисы. Контекстное окно 131 072 токена позволяет держать в диалоге длинные материалы целиком.
До 117 964 токенов в одном ответе — это объём небольшой книги. Хватит на подробный разбор документа, большой фрагмент кода или длинную инструкцию. На практике ответ обычно короче: модель пишет столько, сколько требуют задача и ваш промпт.
Отдельный режим пошаговых рассуждений в наших данных у этой модели не отмечен, поэтому ответ приходит сразу. Если нужна цепочка выводов, попросите в промпте разобрать задачу по шагам — тогда ход мысли будет виден прямо в тексте ответа.
Да, и то и другое. Модель поддерживает вызов функций и структурированный вывод JSON, так что её можно подключать к вашим инструментам, базам и внешним API. В BotHub это работает через единый OpenAI-совместимый API — переписывать интеграцию не придётся.
Изображения и документы — да, их можно отправить модели вместе с вопросом. Аудио и видео во входных форматах не отмечены, поэтому для озвучки или разбора записей выберите в том же окне BotHub профильную модель и переключитесь на неё одним движением.
В наших данных язык работы отдельно не отмечен, поэтому обещать мы ничего не будем — проверьте на своей задаче. Сделать это легко: в BotHub оплата идёт по факту за токены, без подписки, а рядом в одном окне доступны другие модели для сравнения.