gemini-3.8-live-extended-thinking
Red Neuronal
Longitud máxima de respuesta
(en tokens)
Tamaño del contexto
(en tokens)
Costo del prompt
(por 1M tokens)
Costo de la respuesta
(por 1M tokens)
Prompt de imagen
(por 1K tokens)
Cómo funciona gemini-3.8-live-extended-thinking?
Preguntas frecuentes sobre gemini-3.8-live-extended-thinking
Puede usar los resultados generados con fines comerciales. Todos los derechos sobre el contenido creado le pertenecen. La única restricción: asegúrese de que la solicitud no incluya material de terceros protegido por derechos de autor. El usuario es responsable de respetar los derechos sobre los datos de entrada.
Es un modelo de Google que convierte descripciones de texto en audio. Es adecuado para doblar vídeos, podcasts, materiales educativos, indicaciones de voz en aplicaciones y borradores rápidos de audio. La ventana de contexto es de 65 536 tokens, por lo que puede enviar un guion largo completo en lugar de dividirlo en trozos pequeños.
Según nuestros datos, el modelo genera audio, pero el contenedor exacto y la tasa de bits no se especifican en las características; guíese por lo que devuelva la API. El límite de salida es de 32 000 tokens por solicitud: esto es suficiente para un fragmento largo, y un proyecto grande se puede ensamblar cómodamente a partir de varias partes.
No hay una nota específica sobre el razonamiento antes de responder en nuestros datos, por lo que no podemos confirmar este modo, pero tampoco lo negaremos. Lo más fácil es comprobarlo en la práctica: ejecute el modelo en BotHub y compare el resultado con otros modelos en la misma ventana.
No hay notas sobre la llamada a funciones y la salida JSON estructurada en nuestros datos, por lo que no lo afirmaremos. Si la capacidad es crítica para la integración, conéctese a través de la API de BotHub compatible con OpenAI: el modelo se cambia con un solo parámetro en la solicitud, no es necesario reescribir el código ni las claves.
No se indica la recepción de nada más que texto en nuestros datos, así que espere una descripción de texto en la entrada y audio en la salida. Si necesita trabajar con imágenes o vídeos, hay otros modelos disponibles en BotHub; el cambio toma un par de segundos en la misma interfaz.
El idioma de los prompts y la voz no está descrito en nuestros datos, por lo que no prometeremos nada aquí; es más fiable comprobarlo con su propio texto. Por parte del servicio, garantizamos otra cosa: acceso desde Rusia sin VPN ni tarjeta extranjera, pago con tarjetas rusas en rublos y pago por uso de tokens.