Phi 4
Rede Neural
Phi 4 é um modelo compacto da Microsoft Research com 14 bilhões de parâmetros, API Phi 4 para tarefas de raciocínio complexo.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona Phi 4?
Phi 4 é um modelo de linguagem da Microsoft Research com 14 bilhões de parâmetros, criado para raciocínios complexos: ele analisa tarefas de várias etapas, mantém a lógica de inferência e permanece compacto, funcionando bem onde a memória é limitada ou a velocidade é importante. O foco não é o tamanho, mas a qualidade do raciocínio com poucos parâmetros. No BotHub, o modelo está disponível sem VPN ou cartão estrangeiro: você paga com cartão russo em rublos pelo uso, por tokens consumidos, não por assinatura, e o saldo não expira. Mais de 250 modelos estão disponíveis na mesma janela — é fácil comparar a resposta do Phi 4 com outra opção e alternar, e a API unificada compatível com OpenAI permite trocar de modelo sem reescrever a integração. As conversas são criptografadas; para empresas, estão disponíveis contratos, faturas, EDO e painel administrativo com limites. O Phi 4 ajuda a analisar tarefas complexas, auxilia engenheiros a conferir a lógica de algoritmos, professores a detalhar soluções passo a passo e equipes de produto a testar hipóteses rapidamente.Perguntas frequentes sobre Phi 4
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
O phi-4 é um modelo de texto compacto da Microsoft. Aceita não apenas texto, mas também imagens e documentos, sendo adequado para analisar arquivos, extrair dados de esquemas e digitalizações, escrever e editar textos, trabalhar com código, além de tarefas lógicas e matemáticas. Disponível na Rússia sem VPN ou cartão estrangeiro.
O máximo por resposta é de 14.745 tokens, o suficiente para um artigo extenso, documentação ou análise detalhada. Considere a janela de contexto total de 16.384 tokens: isso inclui sua solicitação com anexos e a própria resposta. É melhor dividir tarefas grandes em partes.
Não há um modo separado de raciocínio passo a passo em nossos dados, mas isso não significa que o modelo não lide bem com lógica. Uma análise detalhada geralmente é fácil de obter diretamente no prompt: peça para decompor a solução em etapas e mostrar conclusões intermediárias, não apenas o resultado final.
Não há indicações de suporte para chamada de funções e saída JSON estruturada em nossos dados, portanto, não podemos garantir. Você pode solicitar uma resposta em formato JSON diretamente no prompt. Se precisar de um esquema rígido e ferramentas, alterne para outro modelo na API unificada do BotHub sem reescrever a integração.
Imagens e documentos podem ser carregados: o modelo analisará digitalizações, esquemas, tabelas ou PDFs e responderá com texto. Áudio e vídeo não estão na lista de entradas suportadas, mas existem modelos separados para eles no BotHub — você pode alternar para eles na mesma janela.
Não temos dados específicos sobre a qualidade do russo, por isso não prometemos nada antecipadamente. A maneira mais confiável é enviar sua solicitação típica e ver o resultado. Se as formulações parecerem mais fracas do que o esperado, compare a resposta com outro modelo na mesma janela do BotHub, sem alterar a integração.