Gemma 3 4B IT
Red Neuronal
Gemma 3 4B IT: modelo multimodal de Google para texto e imágenes; API de Gemma 3 con contexto de hasta 128k tokens.
Longitud máxima de respuesta
(en tokens)
Tamaño del contexto
(en tokens)
Costo del prompt
(por 1M tokens)
Costo de la respuesta
(por 1M tokens)
Cómo funciona Gemma 3 4B IT?
Gemma 3 4B IT es un modelo multimodal de Google: acepta texto e imágenes y responde con texto. Su contexto de hasta 128k tokens permite procesar documentos largos o fragmentos de código extensos. El modelo entiende más de 140 idiomas y, en comparación con la generación anterior de Gemma, ha mejorado en matemáticas, razonamiento y calidad de diálogo. En BotHub, el modelo está disponible sin VPN ni tarjetas extranjeras: pagas con tarjeta rusa en rublos, solo por los tokens utilizados, sin suscripciones, y los tokens no caducan. Tienes más de 250 redes neuronales en una sola ventana para comparar respuestas fácilmente. La API unificada compatible con OpenAI permite conectar Gemma 3 a tu servicio y cambiar de modelo sin reescribir la integración. La correspondencia está cifrada con AES-GCM, y las empresas disponen de contratos, facturas, intercambio electrónico de documentos (EDO) y un panel de administración con límites. Es útil para desarrolladores (análisis de código y errores), analistas (resúmenes de documentos y tablas), soporte (clasificación de tickets y borradores) y usuarios visuales (descripción de capturas de pantalla, esquemas o fotos).Preguntas frecuentes sobre Gemma 3 4B IT
Puede usar los resultados generados con fines comerciales. Todos los derechos sobre el contenido creado le pertenecen. La única restricción: asegúrese de que la solicitud no incluya material de terceros protegido por derechos de autor. El usuario es responsable de respetar los derechos sobre los datos de entrada.
Es un modelo compacto de Google de la familia Gemma. Acepta texto, documentos e imágenes y responde con texto: ideal para borradores, reescritura, resumen y estructuración, responder preguntas sobre archivos cargados, analizar capturas de pantalla y tareas de código sencillas. Contexto: 131 072 tokens.
Hasta 16 384 tokens por respuesta, suficiente para un artículo largo o un fragmento de código grande. Si necesitas más, simplemente pide continuar: el contexto de 131 072 tokens permite mantener las partes anteriores del diálogo sin perder el estilo.
En nuestros datos, no se indica un modo de razonamiento separado para este modelo, por lo que la respuesta suele llegar de inmediato. Puedes pedirle que descomponga la tarea paso a paso directamente en el prompt. Si necesitas un modelo con razonamiento, cambia a otro en la misma ventana.
En nuestros datos, no se indica soporte para llamadas a funciones o salida JSON estructurada. Puedes pedir una respuesta en formato JSON, pero el resultado debe validarse. Para herramientas fiables, usa la API unificada compatible con OpenAI de BotHub y conecta un modelo adecuado; no tendrás que reescribir la integración.
Imágenes y documentos, sí: adjunta una foto, captura de pantalla o archivo y pide describir el contenido, extraer datos o explicar un error. La recepción de audio y video no está indicada en nuestros datos; para sonido y clips, BotHub tiene modelos específicos.
No tenemos datos específicos sobre los idiomas admitidos, por lo que no podemos prometer nada concreto; es mejor probar el modelo con tus consultas típicas. BotHub funciona desde Rusia sin VPN ni tarjetas extranjeras: interfaz en ruso, pago con tarjetas rusas en rublos.