Nemotron 3.5 Content Safety
Rede Neural
Nemotron 3.5 Content Safety é um modelo de proteção da NVIDIA com 4B de parâmetros para moderar prompts e respostas de modelos de linguagem.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Como funciona Nemotron 3.5 Content Safety?
Nemotron 3.5 Content Safety é um modelo de proteção compacto da NVIDIA com 4B de parâmetros, treinado com base no Google Gemma-3-4B. Sua tarefa não é gerar conteúdo, mas verificá-lo: o modelo classifica tanto os prompts de entrada dos usuários quanto as respostas de modelos de linguagem e visão, trabalhando com texto e imagens. Seu tamanho compacto permite usá-lo como filtro antes ou depois do modelo principal. No BotHub, ele está disponível sem VPN ou cartão internacional, com pagamento em rublos via cartões russos conforme o uso. A API compatível com OpenAI permite integrar a verificação de conteúdo ao seu serviço e alternar para qualquer um dos mais de 250 modelos a qualquer momento, sem reescrever a integração. O tráfego é criptografado via AES-GCM, o histórico não é salvo e empresas têm acesso a contratos, faturas e EDI. Cenários comuns: moderação de mensagens em chatbots, verificação de respostas do seu assistente antes da entrega, filtragem de imagens enviadas, marcação de arquivos de solicitações e redução da carga da equipe de moderação manual.Perguntas frequentes sobre Nemotron 3.5 Content Safety
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
Este é um modelo NVIDIA da família Nemotron, focado em análise de conteúdo e segurança. Ele aceita texto, documentos e imagens, raciocina antes de responder e é adequado para classificação de mensagens, verificação de conteúdo do usuário, cenários de moderação e tarefas analíticas com um contexto amplo de até 128.000 tokens.
Em uma única resposta, o modelo gera até 8192 tokens — o suficiente para uma análise detalhada, uma conclusão minuciosa sobre o material ou um relatório estruturado. Se precisar de um resultado mais longo, divida a tarefa em partes: o contexto de 128.000 tokens permite manter todo o histórico da conversa.
Sim, o modo de raciocínio do modelo está confirmado. Antes de gerar a saída, ele constrói uma cadeia de passos, o que ajuda a analisar com mais precisão casos controversos e limítrofes, comparar formulações com critérios e fornecer uma conclusão fundamentada, em vez de apenas um rótulo. Em consultas complexas, a resposta pode levar mais tempo.
Em nossos dados, não há menção a 'function calling' ou saída estruturada rigorosa, portanto, não conte com isso antecipadamente. Na prática, você pode descrever o formato desejado diretamente no prompt e verificar o resultado. As solicitações são feitas através da API única compatível com OpenAI do BotHub.
O modelo aceita imagens e documentos como entrada — você pode enviar uma imagem ou arquivo e obter uma análise textual. Não há menção sobre áudio e vídeo em nossos dados. Se precisar desses formatos, modelos especializados estão disponíveis no BotHub, e a alternância leva apenas uma ação.
Os modelos NVIDIA da família Nemotron foram treinados em corpora multilíngues, portanto, funcionam com textos em russo. A qualidade exata depende da tarefa e das formulações, então verifique com seus próprios materiais: no BotHub, isso é feito sem VPN ou cartão internacional, com pagamento em rublos.