Qwen Plus
Rede Neural
Qwen Plus é um modelo de linguagem da Alibaba baseado no Qwen2.5 com contexto de 131K tokens para código e textos longos.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Qwen Plus?
O Qwen Plus é construído sobre o modelo base Qwen2.5 e projetado para um equilíbrio entre qualidade de resposta, velocidade de geração e custo de tokens. A janela de contexto de 131K tokens permite trabalhar com materiais volumosos na íntegra: relatórios de várias páginas, documentação, longas conversas ou um grande módulo de código, sem dividi-los em fragmentos. Através do BotHub, o modelo está disponível sem VPN ou cartão internacional; o pagamento é feito com cartões russos em rublos e com base nos tokens consumidos, não por assinatura. Mais de 250 outras redes neurais estão disponíveis na mesma janela, permitindo comparar respostas ou alternar modelos sem reescrever a integração: a API compatível com OpenAI permanece a mesma. As conversas são criptografadas e as empresas têm acesso a contratos, faturas e um painel administrativo com limites. Desenvolvedores usam o Qwen Plus para gerar e refatorar código, analisar stack traces e revisar grandes módulos. Para analistas, o modelo ajuda a extrair conclusões de documentos longos; para suporte, prepara respostas baseadas na base de conhecimento; e para equipes de produto, ajuda a prototipar cenários com alto fluxo de solicitações, onde o custo por consulta é importante.Perguntas frequentes sobre Qwen Plus
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
O qwen-plus é um modelo de texto da Qwen com contexto de 131.072 tokens. É adequado para trabalhar com documentos longos e código: refatoração, depuração, explicação de lógica de terceiros, análise e resumos de relatórios. Aceita não apenas texto, mas também imagens e documentos, e pode chamar funções externas.
Em uma única resposta, o modelo gera até 32.768 tokens — isso equivale a um artigo extenso, uma grande seção de documentação ou vários arquivos de código inteiros. Se o material não couber, basta pedir para continuar: a pergunta e a resposta permanecem na janela geral de 131.072 tokens.
Não há um modo de raciocínio separado indicado em nossos dados para o qwen-plus, então não podemos prometer isso. Mas uma análise passo a passo é fácil de obter com um prompt: peça para decompor a tarefa em etapas, verificar o processo de solução e só então dar o resultado — o contexto longo permite isso.
Sim, esta é uma capacidade confirmada: o modelo suporta function calling e saída estruturada em JSON. Descreva o esquema das ferramentas e ele escolherá a chamada correta com os argumentos — útil para agentes, bots e parsing. Através da API única compatível com OpenAI do BotHub, a conexão não precisará ser reescrita.
Imagens e documentos, sim: envie um print, esquema, tabela ou arquivo e peça para analisar o conteúdo. Áudio e vídeo não estão entre as entradas suportadas por este modelo — para eles, existem soluções separadas no catálogo do BotHub. Na saída, você recebe texto.
Não há notas sobre idiomas de consulta e resposta em nossos dados, então não faremos promessas precisas — é mais fácil testar com sua tarefa real em algumas solicitações. O próprio BotHub funciona totalmente em russo: interface, pagamento com cartões da Federação Russa em rublos, acesso sem VPN e sem cartão internacional.