GPT OSS 120B Batch
Rede Neural
GPT OSS 120B — modelo aberto da OpenAI com arquitetura Mixture-of-Experts para raciocínio e tarefas de agente.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona GPT OSS 120B Batch?
O GPT OSS 120B é um modelo de linguagem aberto da OpenAI com 117 bilhões de parâmetros e arquitetura Mixture-of-Experts: cerca de 5,1 bilhões de parâmetros são ativados por passagem, mantendo o nível de raciocínio com eficiência computacional. Foi criado para tarefas que exigem cadeias de raciocínio, comportamento de agente e estabilidade em produção, e a versão batch é voltada para processamento em lote de grandes volumes de solicitações. Através do BotHub, você se conecta sem VPN ou cartão estrangeiro, paga com cartão local em moeda nacional pelo uso real de tokens, e os tokens não expiram. Uma API única compatível com OpenAI permite integrar o modelo ao seu serviço e alternar para outro entre mais de 250 disponíveis sem reescrever a integração, com dados transmitidos criptografados e não armazenados. Útil para analisar logs, explicar erros de código, criar agentes com chamadas de função e ferramentas externas, realizar classificação em massa de documentos, decompor problemas STEM ou processar filas de solicitações similares de uma só vez.Perguntas frequentes sobre GPT OSS 120B Batch
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
O gpt-oss-120b:batch é um modelo de texto com modo de raciocínio: analisa documentos longos, escreve e refatora código, encontra erros, resolve problemas de matemática e lógica, prepara análises e resumos. Janela de contexto de 131.072 tokens, permitindo incluir arquivos grandes e tópicos inteiros de diálogo.
Até 117.964 tokens em uma única resposta — isso equivale a dezenas de páginas de texto. O modelo gera documentos longos, análises detalhadas ou módulos de código completos sem fragmentação. Se a resposta for interrompida, basta pedir para continuar de onde parou.
Sim, o raciocínio antes da resposta é um recurso do modelo: antes de formular o resultado, ele analisa a condição passo a passo. Isso ajuda significativamente em tarefas de cálculo, lógica e depuração de código. Lembre-se de que o raciocínio também consome tokens de saída.
Sim, o modelo suporta chamada de funções e saída estruturada em JSON — é fácil integrá-lo a agentes, chatbots e pipelines onde a resposta precisa ser analisada imediatamente. No BotHub, isso funciona via API compatível com OpenAI, permitindo trocar de modelo sem reescrever a integração.
Além de texto, o modelo aceita documentos — carregue um arquivo e peça uma análise, resumo ou respostas sobre o conteúdo. O trabalho com imagens, áudio e vídeo não é suportado, portanto, para esses formatos, alterne para um modelo especializado na mesma janela do BotHub.
Não temos dados sobre a qualidade do desempenho em idiomas específicos, então não podemos prometer nada — é mais fácil testar com sua própria tarefa. O pagamento é feito por uso de tokens, e você pode enviar o mesmo prompt para outro modelo na mesma janela e comparar as respostas.