Qwen3.5 Plus
Rede Neural
Qwen3.5 Plus é um modelo de visão e linguagem Qwen com mecanismo de atenção híbrido e MoE para texto e imagens.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Qwen3.5 Plus?
Qwen3.5 Plus é um modelo da linha Qwen3.5 da Qwen com suporte nativo a visão: aceita texto e imagens em uma única solicitação. Baseia-se em uma arquitetura híbrida que combina atenção linear com uma mistura esparsa de especialistas (MoE), proporcionando maior eficiência de inferência. Através do BotHub, o modelo está acessível sem VPN ou cartões estrangeiros: pague com cartões russos em rublos e apenas pelo que usar, por tokens consumidos, que não expiram. Em uma única janela, você tem mais de 250 modelos, permitindo comparar respostas e alternar entre eles sem reescrever a integração: a API no BotHub é unificada. O tráfego é criptografado via AES-GCM, o histórico de conversas não é salvo, e as equipes têm acesso a contratos, faturas, EDI e limites no painel administrativo. Cenários simples: analisar capturas de tela, diagramas ou fotos de documentos para obter descrições; extrair dados de imagens para formatos estruturados; criar um assistente multimodal via API; executar uma tarefa em vários modelos para escolher o melhor; manter o fluxo de solicitações onde a velocidade de resposta é crucial.Perguntas frequentes sobre Qwen3.5 Plus
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
Qwen3.5-plus-02-15 é um modelo de texto com raciocínio: adequado para trabalhar com código (escrita, refatoração, depuração), análise de documentos longos, tarefas STEM e lógica. Aceita texto, imagens e documentos, e chama funções externas. Contexto de um milhão de tokens: um repositório grande ou uma coleção de PDFs cabem em uma única solicitação.
Em uma única resposta, até 65.536 tokens, o que equivale a dezenas de páginas de texto. Suficiente para um grande documento técnico, um módulo de código inteiro ou uma análise detalhada com raciocínio. Se a resposta atingir o limite, peça para continuar: a janela de contexto de um milhão de tokens é suficiente para manter toda a conversa.
Sim, o raciocínio antes da resposta é confirmado: o modelo primeiro constrói uma cadeia interna de passos e só então fornece o resultado. Isso é perceptível em matemática, lógica, depuração complexa e instruções de várias etapas. O raciocínio consome tokens de saída, portanto, em solicitações simples, peça respostas curtas.
Sim. Chamada de funções e saída estruturada em JSON são suportadas: descreva o esquema e obtenha uma resposta que seu código analisará sem complicações. Útil para agentes, análise de documentos e integrações; através da API unificada compatível com OpenAI do BotHub, o modelo é conectado sem reescrever o código.
Imagens e documentos, sim: capturas de tela de interface, diagramas, tabelas, PDFs ou contratos são enviados junto com a pergunta, o modelo os lê e responde com texto. Áudio e vídeo não estão marcados em nossos dados, portanto, para narração ou análise de gravações, escolha um modelo especializado no BotHub.
As características linguísticas não estão marcadas em nossos dados sobre o modelo, por isso não prometemos especificidades — verifique com suas próprias tarefas. No BotHub, é simples: uma interface, alternância entre modelos com poucos cliques, pagamento por tokens consumidos com cartões russos sem VPN.