Llama 4 Scout
нейросеть
Llama 4 Scout API — мультимодальная модель Meta на архитектуре mixture-of-experts для текстовых задач и работы с изображениями.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Как работает Llama 4 Scout?
Llama 4 Scout — языковая модель Meta на архитектуре mixture-of-experts: из 109 миллиардов параметров на каждый запрос активируются 17 миллиардов, распределённых по 16 экспертам, так что нагрузка ниже, чем у плотной модели того же объёма. Вход мультимодальный — модель принимает текст и изображения, а отвечает текстом. В BotHub она открывается из России без VPN и зарубежной карты, оплата проходит российскими картами в рублях и списывается по факту за токены. Рядом в одном окне более 250 нейросетей, между которыми вы переключаетесь прямо в диалоге, а единый OpenAI-совместимый API позволяет сменить модель в своём сервисе, не переписывая интеграцию. Переписка шифруется, данные не сохраняются, компаниям доступны договор, счёт, ЭДО и админ-панель с лимитами. Пригодится, когда нужно разобрать и сжать длинный документ, поднять чат-ассистента на потоке однотипных обращений, вытащить данные со скриншотов, схем и фотографий, набросать черновик письма или описания, собрать мультимодельный продукт, где часть запросов уходит на другие модели.Частые вопросы о Llama 4 Scout
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
Это текстовая модель с контекстом 131072 токена: отвечает на вопросы, пишет и редактирует код, разбирает документы и изображения, помогает с анализом длинных материалов. Подходит для чатов и поддержки, обработки больших файлов, подготовки черновиков и встраивания в сервисы через единый API BotHub.
За один ответ модель выдаёт до 16384 токенов — этого хватает на объёмную статью, подробную инструкцию или крупный фрагмент кода. Если нужен текст длиннее, продолжайте диалог частями: контекст в 131072 токена позволяет держать перед моделью весь материал целиком.
Отдельный режим рассуждений в наших данных не отмечен, поэтому скрытых цепочек размышлений по умолчанию ждать не стоит. При этом вы можете прямо в запросе попросить разобрать задачу по шагам — на логике, расчётах и разборе кода это заметно повышает аккуратность.
Да, вызов функций и структурированный вывод JSON поддерживаются. Модель возвращает ответ по заданной схеме и обращается к вашим инструментам: поиску, базе данных, калькулятору, внутренним сервисам. Для агентов и автоматизации это ключевое, а OpenAI-совместимый API BotHub подключается без переписывания интеграции.
Изображения и документы — да: пришлите скриншот, фото, схему или файл и попросите описать содержимое, извлечь данные, сравнить версии. Приём аудио и видео в наших данных не отмечен, так что для звука и роликов выберите в каталоге BotHub профильную модель.
Пометок о поддержке конкретных языков в наших данных нет, поэтому оценивать это мы не станем. Надёжнее проверить на практике: отправьте свой типичный запрос и сравните ответ с другой моделью в том же окне, переключение занимает секунды, а платите вы только за использованные токены.