GPT 3.5 Turbo 0613
Rede Neural
GPT 3.5 Turbo 0613 — modelo rápido da OpenAI para chat e código, disponível via API no BotHub.
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Como funciona GPT 3.5 Turbo 0613?
GPT 3.5 Turbo 0613 — um modelo rápido da OpenAI que entende e gera linguagem natural e código, otimizado para diálogos e tarefas clássicas de preenchimento de texto. O índice 0613 significa uma versão fixa: o comportamento do modelo não muda com o tempo, o que é útil quando você precisa de previsibilidade. Os dados de treinamento são limitados a setembro de 2021 — vale a pena considerar isso. No BotHub, o modelo está disponível sem VPN ou cartão estrangeiro: você paga com cartão local em moeda nacional e apenas pelos tokens consumidos, que não expiram. Uma API única compatível com OpenAI permite alternar para qualquer outro dos mais de 250 modelos sem reescrever a integração; as conversas são criptografadas via AES-GCM e não são salvas, e para empresas há contrato, fatura, EDI e painel administrativo com limites. Use o GPT 3.5 Turbo para chatbots e suporte onde a velocidade de resposta é importante, para analisar e completar código, para rascunhos de e-mails e descrições de produtos, para processamento em fluxo de textos semelhantes — classificação, resumos, reformulações — e como um passo econômico em cenários multimodelo.Perguntas frequentes sobre GPT 3.5 Turbo 0613
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
O gpt-3.5-turbo-0613 é um modelo de texto da OpenAI para diálogos, sumarização, reescrita de textos, rascunhos de e-mails, código simples e extração de dados. Aceita não apenas texto, mas também documentos com imagens. O contexto de 4095 tokens é adequado para consultas curtas e tarefas em massa repetitivas via API.
Até 3685 tokens por resposta. Lembre-se de que a janela total é de 4095 tokens, o que inclui sua consulta e a resposta: quanto mais longo o prompt, menos espaço resta. Materiais grandes são mais fáceis de gerar em partes, enviando apenas o fragmento necessário.
Não há um modo de raciocínio separado antes da resposta em nossos dados — o modelo responde imediatamente. Se precisar de lógica passo a passo, peça para ele detalhar a solução passo a passo diretamente na consulta. Para tarefas complexas de várias etapas, no BotHub você pode alternar para um modelo com raciocínio.
Sim, a chamada de funções (function calling) e a saída estruturada em JSON são suportadas. Isso é útil para integrações onde a resposta precisa ser enviada diretamente para código, planilha ou banco de dados. A conexão é feita através da API única compatível com OpenAI do BotHub, portanto, você pode trocar de modelo sem reescrever a integração.
De acordo com nossos dados, além de texto, imagens e documentos são aceitos como entrada, então você pode anexar um arquivo ou imagem. Áudio e vídeo não estão listados nos dados. O modelo responde com texto: para gerar imagens, vídeos ou sons, alterne para um modelo especializado na mesma janela.
O idioma dos prompts e respostas não está especificado em nossos dados, por isso não prometeremos uma qualidade específica — teste o modelo com sua consulta típica, leva um minuto. A interface do BotHub está em português, o pagamento é local, com acesso sem VPN e sem necessidade de cartão estrangeiro.