GPT OSS 120B Batch
Red Neuronal
GPT OSS 120B es un modelo abierto de OpenAI con arquitectura Mixture-of-Experts para razonamiento y tareas de agentes.
Longitud máxima de respuesta
(en tokens)
Tamaño del contexto
(en tokens)
Costo del prompt
(por 1M tokens)
Costo de la respuesta
(por 1M tokens)
Cómo funciona GPT OSS 120B Batch?
GPT OSS 120B es un modelo de lenguaje abierto de OpenAI de 117 mil millones de parámetros con arquitectura Mixture-of-Experts: se activan unos 5.1 mil millones de parámetros por paso, manteniendo un alto nivel de razonamiento con eficiencia computacional. Creado para tareas que requieren cadenas de razonamiento, comportamiento de agentes y estabilidad en producción; la versión batch está diseñada para el procesamiento por lotes de grandes volúmenes. A través de BotHub, te conectas sin VPN ni tarjetas extranjeras, pagas en rublos con tarjeta rusa por uso real de tokens, y los tokens no caducan. Una API única compatible con OpenAI permite integrar el modelo en tu servicio y cambiar a otro de los más de 250 disponibles sin reescribir la integración. Los datos se transmiten cifrados y no se guardan. Útil para analizar registros, explicar errores de código, crear agentes con llamadas a funciones y herramientas externas, realizar clasificación masiva de documentos, desglosar problemas STEM paso a paso o procesar colas de solicitudes similares.Preguntas frecuentes sobre GPT OSS 120B Batch
Puede usar los resultados generados con fines comerciales. Todos los derechos sobre el contenido creado le pertenecen. La única restricción: asegúrese de que la solicitud no incluya material de terceros protegido por derechos de autor. El usuario es responsable de respetar los derechos sobre los datos de entrada.
gpt-oss-120b:batch es un modelo de texto con modo de razonamiento: analiza documentos largos, escribe y refactoriza código, busca errores, resuelve problemas de matemáticas y lógica, y prepara análisis y resúmenes. Con una ventana de contexto de 131 072 tokens, caben archivos grandes y ramas completas de diálogo.
Hasta 117 964 tokens en una respuesta: decenas de páginas de texto. El modelo genera documentos largos, análisis detallados o módulos de código completos sin fragmentar. Si la respuesta se corta, simplemente pide que continúe desde donde se detuvo.
Sí, el razonamiento antes de responder es una capacidad del modelo: antes de formular el resultado, desglosa la condición paso a paso. Esto ayuda notablemente en tareas de cálculo, lógica y depuración de código. Ten en cuenta que el razonamiento también consume tokens de salida.
Sí, el modelo admite llamadas a funciones y salida estructurada en JSON; es fácil de integrar en agentes, chatbots y pipelines donde la respuesta debe analizarse inmediatamente. En BotHub, esto funciona a través de una API única compatible con OpenAI, por lo que podrás conectar otro modelo después sin reescribir la integración.
Además de texto, el modelo acepta documentos: carga un archivo y pide un análisis, resumen o respuestas sobre el contenido. El trabajo con imágenes, audio y video no está marcado entre sus capacidades, por lo que para esos formatos, cambia a un modelo especializado en la misma ventana de BotHub.
No tenemos datos sobre la calidad del trabajo con idiomas específicos, así que no prometemos nada; es mejor probarlo con tu propia tarea. El pago es por uso real de tokens, y puedes enviar el mismo prompt a otro modelo en la misma ventana para comparar las respuestas.