GPT OSS 20B
Rede Neural
GPT OSS 20B é um modelo aberto da OpenAI com arquitetura Mixture-of-Experts para tarefas de texto, disponível via API BotHub.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona GPT OSS 20B?
GPT OSS 20B é um modelo aberto da OpenAI: 21 bilhões de parâmetros, arquitetura Mixture-of-Experts, onde cerca de 3,6 bilhões de parâmetros são ativados por passagem, e licença Apache 2.0 que permite o uso livre dos pesos. Este esquema esparso torna o modelo eficiente em termos computacionais, mantendo o volume total de conhecimento nele contido. No BotHub, o GPT OSS 20B funciona sem VPN ou cartão estrangeiro: você paga com cartões locais em moeda nacional conforme o uso, por tokens, que não expiram. Ao lado, na mesma janela, há mais de 250 redes neurais, facilitando a comparação de respostas, e uma API única compatível com OpenAI permite alternar para outro modelo sem reescrever a integração; as conversas são criptografadas e as empresas têm acesso a contratos, faturas, EDI e painel administrativo com limites. Geralmente, o modelo é usado para escrever e editar textos, analisar e comentar código, resumir documentos longos e conversas, criar assistentes dentro de seus produtos via API e avaliar o modelo aberto antes da implantação em servidor próprio.Perguntas frequentes sobre GPT OSS 20B
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
É um modelo de texto da OpenAI com pesos abertos. Adequado para perguntas e respostas, escrita e análise de código, refatoração e depuração, trabalho com documentos e tarefas de raciocínio. Aceita não apenas texto, mas também imagens e documentos, e o contexto de 131.072 tokens permite trabalhar com materiais extensos.
Até 32.768 tokens em uma única resposta — o suficiente para uma análise detalhada de documento, texto volumoso ou um grande módulo de código. Se o material não couber em uma resposta, peça para continuar: as partes anteriores permanecerão no contexto do diálogo.
Sim, o modelo possui um modo de raciocínio: antes da resposta final, ele divide a tarefa em etapas. Isso é perceptível em lógica, matemática e análise de código, onde a sequência de conclusões é importante, e não apenas uma resposta rápida à solicitação.
Sim. O modelo pode chamar funções e fornecer saída estruturada em JSON, sendo fácil de integrar em agentes, pipelines e serviços próprios. No BotHub, isso é feito através de uma API única compatível com OpenAI: você pode alternar o modelo sem reescrever a integração.
Imagens e documentos podem ser carregados — o modelo os aceita como entrada e responde com texto. A recepção de áudio e vídeo não está indicada em nossos dados, portanto, para essas tarefas, é mais conveniente escolher um modelo especializado: no BotHub, todos estão disponíveis na mesma janela.
Não há informações em nossos dados sobre os idiomas de prompts e respostas, portanto, não podemos prometer uma qualidade específica — teste o modelo com sua tarefa. O acesso funciona sem VPN ou cartão estrangeiro, com pagamento em moeda local, e você pode alternar para outro modelo na mesma janela se necessário.