gemini-3.8-live-extended-thinking
Rede Neural
Comprimento máximo de resposta
(em tokens)
Tamanho do contexto
(em tokens)
Custo do prompt
(por 1M tokens)
Custo da resposta
(por 1M tokens)
Prompt de imagem
(por 1K tokens)
Como funciona gemini-3.8-live-extended-thinking?
Perguntas frequentes sobre gemini-3.8-live-extended-thinking
Você pode usar os resultados da geração para fins comerciais. Todos os direitos sobre o conteúdo criado pertencem a você. A única restrição: certifique-se de que a solicitação não inclua materiais de terceiros protegidos por direitos autorais. A responsabilidade pelo cumprimento dos direitos sobre os dados de entrada é do usuário.
É um modelo do Google que transforma descrições de texto em áudio. É adequado para narração de vídeos, podcasts, materiais educativos, comandos de voz em aplicativos e rascunhos rápidos de áudio. A janela de contexto é de 65.536 tokens, portanto, um roteiro longo pode ser enviado na íntegra, sem precisar dividi-lo em partes menores.
De acordo com nossos dados, o modelo gera áudio, mas o contêiner exato e o bitrate não estão especificados nas características — baseie-se no que a API retornar. O limite de saída é de 32.000 tokens por solicitação: isso é suficiente para um fragmento longo, e um projeto grande pode ser facilmente montado a partir de várias partes.
Não há uma nota específica sobre raciocínio antes da resposta em nossos dados, portanto, não podemos confirmar esse modo, mas também não o negaremos. A maneira mais fácil é verificar na prática: execute o modelo no BotHub e compare o resultado com outros modelos na mesma janela.
Não há notas sobre chamada de funções e saída JSON estruturada em nossos dados, então não afirmaremos isso. Se a funcionalidade for crítica para a integração, conecte-se através da API unificada compatível com OpenAI do BotHub: o modelo é alterado com um único parâmetro na solicitação, sem necessidade de reescrever código ou chaves.
O recebimento de qualquer coisa além de texto não está indicado em nossos dados, portanto, conte com descrição de texto na entrada e áudio na saída. Se precisar trabalhar com imagens ou vídeos, outros modelos estão disponíveis no BotHub — a alternância leva alguns segundos na mesma interface.
O idioma dos prompts e da narração não está descrito em nossos dados, portanto, não prometemos nada aqui — é mais seguro verificar com seu próprio texto. Por parte do serviço, garantimos outra coisa: acesso a partir da Rússia sem VPN ou cartão estrangeiro, pagamento com cartões russos em rublos e cobrança por uso de tokens.