Step 3.5 Flash
Rede Neural
Step 3.5 Flash API — modelo aberto da StepFun com arquitetura Mixture of Experts para tarefas de texto e integração em seus serviços.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Step 3.5 Flash?
Step 3.5 Flash — modelo de linguagem aberto da StepFun com arquitetura esparsa Mixture of Experts: de 196 bilhões de parâmetros por token, apenas 11 bilhões são ativados, economizando processamento com um grande volume de conhecimento. No BotHub, está disponível sem VPN ou cartão internacional: pague com cartão russo em rublos e apenas pelos tokens efetivamente consumidos, que não expiram. Com mais de 250 redes neurais disponíveis na mesma janela, você pode comparar respostas ou alternar modelos com poucos cliques, e a API única compatível com OpenAI evita a necessidade de reescrever integrações. Os diálogos são criptografados via AES-GCM, os dados não são salvos e, para empresas, oferecemos contrato, fatura, EDI, painel administrativo e limites para funcionários. Use o Step 3.5 Flash para analisar fluxos de solicitações de usuários, preparar e reescrever rascunhos de texto, resumir documentos longos ou testar o modelo como uma opção reserva em um serviço multimodelo.Perguntas frequentes sobre Step 3.5 Flash
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
O step-3.5-flash da stepfun é um modelo de texto com modo de raciocínio, aceitação de imagens e documentos, e chamada de funções. O contexto de 256.000 tokens permite analisar documentos extensos, bases de código e logs, escrever e depurar código, preparar resumos analíticos e criar cenários de agentes.
O volume máximo de uma resposta é de 65.536 tokens. Isso é suficiente para um texto técnico longo, uma análise detalhada de documento ou um grande fragmento de código inteiro, sem fragmentação. Se a resposta atingir o limite, basta pedir para continuar — o modelo terminará na próxima mensagem.
Sim, o raciocínio antes da resposta está marcado nas capacidades do modelo: ele executa passos intermediários antes de fornecer o resultado. Isso é perceptível em matemática, lógica, análise de requisitos e depuração — onde é importante não apenas adivinhar a resposta, mas seguir a cadeia de raciocínio.
Sim, ambos. Graças ao function calling, o modelo pode ser conectado a pesquisas, bancos de dados, calculadoras e serviços internos, e a saída estruturada em JSON é conveniente quando o resultado vai direto para o código sem parsing manual. Tudo através da API única compatível com OpenAI do BotHub.
De acordo com nossos dados, texto, imagens e documentos são aceitos como entrada: você pode enviar uma captura de tela, esquema, tabela ou arquivo e fazer perguntas sobre o conteúdo. Não temos notas específicas sobre áudio e vídeo, portanto, esses formatos devem ser testados em sua tarefa.
Não temos dados específicos sobre a qualidade dos idiomas, então não prometemos nada — teste com seu prompt, é rápido. A interface do BotHub e o bot do Telegram são em russo, o acesso a partir da Rússia é feito sem VPN ou cartão internacional, e o pagamento é feito com cartões russos.