Gemma 3 12B
Red Neuronal
Gemma 3 12B es un modelo multimodal de Google con 128k tokens de contexto para razonamiento, matemáticas y análisis de imágenes.
Longitud máxima de respuesta
(en tokens)
Tamaño del contexto
(en tokens)
Costo del prompt
(por 1M tokens)
Costo de la respuesta
(por 1M tokens)
Cómo funciona Gemma 3 12B?
Gemma 3 12B es un modelo de Google que no solo trabaja con texto: puedes enviar imágenes junto con tu consulta y recibir respuestas en texto. Su ventana de contexto de hasta 128 mil tokens permite mantener documentos extensos o conversaciones largas en un solo diálogo, y su soporte para más de 140 idiomas es útil para materiales internacionales. Comparado con la generación anterior de Gemma, se han mejorado las matemáticas, el razonamiento lógico y el diálogo. A través de BotHub, el modelo está disponible sin VPN ni tarjetas extranjeras, pagando solo por los tokens consumidos, que no caducan. En la misma ventana, tienes acceso a más de 250 redes neuronales para comparar respuestas fácilmente. La API compatible con OpenAI permite conectar Gemma 3 12B a tu servicio y cambiar de modelo más tarde sin reescribir la integración; el tráfico está cifrado y las conversaciones no se guardan. Se utiliza habitualmente para analizar capturas de pantalla, esquemas y fotos de documentos, resolver problemas académicos y matemáticos con explicaciones paso a paso, resumir informes y artículos extensos, soporte de chat y procesamiento de textos multilingües.Preguntas frecuentes sobre Gemma 3 12B
Puede usar los resultados generados con fines comerciales. Todos los derechos sobre el contenido creado le pertenecen. La única restricción: asegúrese de que la solicitud no incluya material de terceros protegido por derechos de autor. El usuario es responsable de respetar los derechos sobre los datos de entrada.
gemma-3-12b-it es un modelo abierto de Google de la familia Gemma 3 con ajuste instructivo. Escribe y edita textos, explica material, ayuda con código, analiza documentos y responde preguntas sobre imágenes. Su contexto de 131 072 tokens permite cargar archivos largos y conversaciones completas.
En una sola respuesta, el modelo genera hasta 16 384 tokens, lo que equivale a un artículo largo, una instrucción detallada o un fragmento de código grande. Si necesitas más, continúa la generación con la siguiente consulta: el contexto de 131 072 tokens permite mantener todo el diálogo en memoria.
No se indica un modo de razonamiento separado en nuestros datos, por lo que no podemos prometer una cadena de pensamiento oculta. Sin embargo, puedes pedirle directamente al modelo en el prompt que resuelva la tarea paso a paso; este método suele mejorar notablemente las respuestas en lógica, cálculos y análisis de condiciones.
Sí, el modelo admite la llamada a funciones y la salida estructurada en JSON. Esto es útil para agentes, análisis de documentos según un esquema definido e integraciones donde la respuesta va directamente al código. En BotHub, todo funciona a través de una API compatible con OpenAI, por lo que la conexión toma muy poco tiempo.
Imágenes y documentos, sí: el modelo analiza capturas de pantalla, esquemas, fotos y archivos, respondiendo preguntas sobre su contenido. La recepción de audio y video no está indicada en nuestros datos. Obtienes texto como salida, y puedes solicitar imágenes o voz a modelos especializados en la misma ventana.
Gemma 3 es un modelo multilingüe y funciona bien con el ruso: entiende consultas, escribe textos coherentes, resume documentos y correos. En tareas estilísticas complejas, vale la pena verificar la calidad con tus propios ejemplos: el modelo es compacto, con unos 12 mil millones de parámetros, y los matices sutiles le resultan más difíciles que a los modelos más grandes.