GPT OSS 120B
Rede Neural
GPT OSS 120B é um modelo de linguagem aberto da OpenAI com arquitetura Mixture-of-Experts para raciocínio e cenários de agentes.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona GPT OSS 120B?
O GPT OSS 120B é um modelo de pesos abertos da OpenAI com arquitetura Mixture-of-Experts: 117 bilhões de parâmetros, dos quais cerca de 5,1 bilhões são ativados por passagem. O modelo é otimizado para produção: alta carga, longas cadeias de raciocínio e cenários de agentes, onde a tarefa precisa ser dividida em etapas e levada ao resultado. No BotHub, este modelo funciona sem restrições geográficas, com pagamento por uso de tokens que não expiram. Mais de 250 modelos estão disponíveis na mesma janela para comparação, e uma API única compatível com OpenAI conecta o modelo ao seu serviço, permitindo trocá-lo sem reescrever a integração; o tráfego é criptografado com AES-GCM. Para desenvolvedores, o modelo é útil para gerar e analisar código, depuração e refatoração; para analistas, para cálculos passo a passo e tarefas STEM; para equipes de produto, para criar agentes e assistentes internos; e empresas têm acesso a contratos, faturas, EDI e painel administrativo com limites.Perguntas frequentes sobre GPT OSS 120B
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
O gpt-oss-120b é um modelo aberto da OpenAI para trabalhar com texto: escrever e editar código, analisar documentos, resolver problemas de raciocínio. Aceita imagens e documentos, e pode chamar funções. Adequado para assistentes, análise e serviços multimodais via API única do BotHub.
O limite de saída é de 117.964 tokens por resposta, com uma janela de contexto total de 131.072 tokens. Isso é suficiente para documentos longos, código volumoso e análises detalhadas. Observe que a solicitação e a resposta compartilham o contexto, portanto, com uma entrada grande, o espaço para a resposta diminui.
Sim, o raciocínio antes da resposta é um recurso do modelo: ele divide a tarefa em etapas e só então fornece o resultado. Isso ajuda significativamente em matemática, lógica, depuração de código e tarefas de várias etapas, onde uma resposta precisa é mais importante do que a velocidade.
Sim, o modelo suporta chamada de funções e saída estruturada em JSON. Você pode conectar ferramentas externas, bancos de dados e serviços, recebendo respostas em um formato previsível. No BotHub, isso funciona via API única compatível com OpenAI, permitindo trocar de modelo sem reescrever a integração.
Imagens e documentos podem ser carregados: o modelo lê o conteúdo e responde com texto. Áudio e vídeo não são suportados como formatos de entrada, assim como a geração de imagens ou som — para isso, o catálogo do BotHub possui modelos especializados disponíveis na mesma interface.
Não temos dados sobre os idiomas dos prompts e respostas, então não prometeremos uma qualidade específica em português — é mais fácil testar com sua própria tarefa diretamente no BotHub. O serviço em si é totalmente acessível: pagamento com cartões locais e acesso sem restrições.