Llama Guard 4 12B
нейросеть
Llama Guard 4 12B — мультимодальная модель Meta для классификации контента, llama guard 4 api для проверки запросов и ответов LLM.
Макс. длина ответа
(в токенах)
Размер контекста
(в токенах)
Стоимость промпта
(за 1M токенов)
Стоимость ответа
(за 1M токенов)
Как работает Llama Guard 4 12B?
Llama Guard 4 — это классификатор безопасности от Meta на 12 млрд параметров, построенный на базе Llama 4 Scout. Модель не ведёт диалог, а выносит вердикт: размечает материал по категориям риска и работает фильтром на обеих сторонах разговора — проверяет и запрос пользователя, и ответ основной модели. Мультимодальность даёт возможность разбирать не только текст, но и изображения, поэтому одним контуром закрывается модерация смешанного контента. В BotHub llama guard 4 подключается по единому OpenAI-совместимому API вместе с остальными моделями, так что фильтрующий слой и генеративный живут в одной интеграции, а переключение модели не требует переписывать код. Доступ открыт из России без VPN и зарубежной карты, платите в рублях по факту за токены, переписка шифруется. Для команд есть договор, счёт и админ-панель с лимитами. Пригодится, чтобы прикрыть чат-бота поддержки, отсеивать рискованные промпты в продукте с пользовательским вводом, размечать датасеты, вести аудит логов диалогов и проверять загружаемые изображения.Частые вопросы о Llama Guard 4 12B
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
llama-guard-4-12b — это модель Meta для классификации безопасности контента: она оценивает запросы и ответы и помечает их как допустимые или нарушающие политику. Подходит для модерации пользовательского ввода, фильтрации выдачи других моделей, а также проверки документов и изображений перед публикацией.
За один ответ модель выдаёт до 16 384 токенов, а контекстное окно составляет 163 840 токенов, поэтому вы можете передать на проверку длинный диалог или документ целиком. На практике ответ короткий: модель возвращает компактный вердикт, а не развёрнутый текст.
В наших данных отдельный режим рассуждений у llama-guard-4-12b не отмечен. Это классификатор: он анализирует переданный фрагмент и сразу выдаёт вердикт с указанием категории нарушения, без длинных цепочек размышлений. Если нужны пошаговые рассуждения, в BotHub вы переключитесь на другую модель в том же окне.
В наших данных вызов функций и структурированный JSON-вывод у llama-guard-4-12b не отмечены. При этом ответ модели лаконичен и легко разбирается на стороне вашего сервиса. Подключение идёт через единый OpenAI-совместимый API BotHub, поэтому встроить проверку в существующий пайплайн несложно.
Изображения и документы поддерживаются на вход вместе с текстом, поэтому вы можете отправлять на проверку картинки и файлы в одном запросе. Аудио и видео в наших данных не заявлены. Генерация изображений или звука здесь не предусмотрена: на выходе только текст.
Данных о языках, с которыми работает llama-guard-4-12b, у нас нет, и додумывать их мы не станем. Проверьте модель на своих примерах: в BotHub доступ открыт из России без VPN и зарубежной карты, оплата идёт по факту за использованные токены.