Qwen Plus 0728
Rede Neural
Qwen Plus 0728 é um modelo híbrido de raciocínio da Qwen com contexto de 1M de tokens, API Qwen Plus para código e documentos longos.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Qwen Plus 0728?
O Qwen Plus 0728 é construído sobre o modelo base Qwen3 e opera em modo híbrido: responde rapidamente ou ativa raciocínio passo a passo quando a tarefa exige. A janela de contexto de 1 milhão de tokens permite manter bases de código volumosas, documentação e diálogos longos, sem fragmentação. O equilíbrio entre qualidade, velocidade e custo torna-o ideal para tarefas de fluxo. Através do BotHub, o modelo está disponível sem VPN e sem cartão estrangeiro: pague com cartões russos em rublos conforme o uso, pelos tokens consumidos, que não expiram. Com mais de 250 redes neurais na mesma janela, você pode comparar respostas e alternar entre elas, enquanto uma API única compatível com OpenAI elimina a necessidade de reescrever integrações. As conversas são criptografadas via AES-GCM, e empresas têm acesso a contratos, faturas, EDI e painel administrativo com limites. Cenários simples: analisar um grande repositório, refatorar um módulo e encontrar erros no código; resumir centenas de páginas de documentos e conversas; manter um assistente com longo histórico de diálogo; verificar o raciocínio em problemas STEM.Perguntas frequentes sobre Qwen Plus 0728
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
O qwen-plus-2025-07-28 trabalha com texto, documentos e imagens na entrada: analisa relatórios longos, escreve e refatora código, responde a perguntas sobre arquivos carregados. O contexto de um milhão de tokens permite manter uma base de código inteira ou documentação volumosa em um único diálogo.
O comprimento máximo de uma resposta é de 32.768 tokens. Isso é suficiente para um artigo volumoso, uma análise detalhada de documento ou um arquivo de código grande. Se precisar de mais, basta pedir para continuar: o modelo lembra de todo o diálogo anterior graças ao contexto de um milhão de tokens.
Um modo separado de raciocínio passo a passo não está marcado em nossos dados para esta versão — isso não é uma negação, apenas não há tal marcação. Na prática, o modelo lida bem se você pedir diretamente para analisar a tarefa passo a passo e mostrar o processo de solução antes da conclusão final.
Sim. O modelo suporta chamada de funções e saída estruturada em JSON, por isso é fácil integrá-lo em agentes, chatbots e serviços internos. No BotHub, isso funciona através de uma API única compatível com OpenAI: você descreve o esquema de ferramentas da maneira habitual, e o modelo retorna uma resposta pronta para análise.
Imagens e documentos — sim: você pode enviar uma captura de tela, esquema, tabela ou arquivo e pedir para analisar o conteúdo. A recepção de áudio e vídeo não está marcada em nossos dados. Se precisar trabalhar com som ou vídeos, alterne para um modelo especializado na mesma janela do BotHub.
O Qwen é uma linha de modelos multilíngues, e processa consultas em russo junto com outros idiomas. A melhor forma de verificar é com suas próprias tarefas: envie um prompt típico e compare o resultado com um modelo vizinho na mesma janela do BotHub — a alternância leva um segundo.