Как работает Nemotron 3.5 Content Safety?
Nemotron 3.5 Content Safety — компактная защитная модель NVIDIA на 4 млрд параметров, дообученная на базе Google Gemma-3-4B. Её задача не генерировать контент, а проверять его: модель классифицирует и входящие запросы пользователей, и ответы языковых и визуально-языковых моделей, работая с текстом и изображениями. Компактный размер позволяет ставить её фильтром и перед основной моделью, и после неё. В BotHub она открывается без VPN и зарубежной карты, оплата идёт российскими картами в рублях и по факту использования, а единый OpenAI-совместимый API даёт подключить проверку контента к своему сервису и в любой момент переключиться на другую из более чем 250 моделей, не переписывая интеграцию. Трафик шифруется AES-GCM, переписка не сохраняется, компаниям доступны договор, счёт и ЭДО. Сценарии понятные: модерация сообщений в чат-боте, проверка ответов вашего ассистента перед выдачей, фильтрация загружаемых изображений, разметка архива обращений и разгрузка команды ручной модерации.Частые вопросы о Nemotron 3.5 Content Safety
Вы можете использовать результаты генерации в коммерческих целях. Все права на созданный контент принадлежат вам. Единственное ограничение: убедитесь, что в запросе не использовались защищённые авторским правом материалы третьих сторон. Ответственность за соблюдение прав на входные данные лежит на пользователе.
Это модель NVIDIA из семейства Nemotron, ориентированная на анализ контента и безопасность. Она принимает текст, документы и изображения, рассуждает перед ответом и подходит для классификации сообщений, проверки пользовательского контента, модерационных сценариев и аналитических задач с большим контекстом до 128 000 токенов.
За один ответ модель выдаёт до 8192 токенов — этого хватает на развёрнутый разбор, подробное заключение по материалу или структурированный отчёт. Если нужен более длинный результат, разбивайте задачу на части: контекст в 128 000 токенов позволяет держать всю переписку целиком.
Да, режим рассуждений у модели подтверждён. Перед выводом она выстраивает цепочку шагов, что помогает точнее разбирать спорные и пограничные случаи, сопоставлять формулировки с критериями и давать обоснованное заключение, а не просто ярлык. На сложных запросах ответ может занимать больше времени.
В наших данных пометки о function calling и строгом структурированном выводе нет, поэтому заранее на это закладываться не стоит. На практике вы можете описать нужный формат прямо в промте и проверить результат. Запросы идут через единый OpenAI-совместимый API BotHub.
Изображения и документы модель принимает на вход — можно отправить картинку или файл и получить текстовый разбор. Про аудио и видео в наших данных пометок нет. Если нужны такие форматы, в BotHub рядом доступны профильные модели, переключение занимает одно действие.
Модели NVIDIA семейства Nemotron обучались на многоязычных корпусах, поэтому с русскими текстами она работает. Точное качество зависит от задачи и формулировок, так что проверьте на своих материалах: в BotHub это делается без VPN и зарубежной карты, с оплатой в рублях.