Llama 4 Scout
Red Neuronal
Llama 4 Scout API: modelo multimodal de Meta con arquitectura mixture-of-experts para tareas de texto y procesamiento de imágenes.
Longitud máxima de respuesta
(en tokens)
Tamaño del contexto
(en tokens)
Costo del prompt
(por 1M tokens)
Costo de la respuesta
(por 1M tokens)
Cómo funciona Llama 4 Scout?
Llama 4 Scout es un modelo de lenguaje de Meta basado en la arquitectura mixture-of-experts: de 109 mil millones de parámetros, se activan 17 mil millones por solicitud, distribuidos en 16 expertos, lo que reduce la carga en comparación con un modelo denso del mismo tamaño. La entrada es multimodal: el modelo acepta texto e imágenes y responde con texto. En BotHub, está disponible desde Rusia sin VPN ni tarjetas extranjeras; el pago se realiza con tarjetas rusas en rublos y se cobra según el uso de tokens. Hay más de 250 redes neuronales disponibles en una sola ventana, entre las cuales puedes cambiar directamente en el chat, y una API compatible con OpenAI permite cambiar de modelo en tu servicio sin reescribir la integración. La correspondencia está cifrada, los datos no se guardan, y las empresas tienen acceso a contratos, facturas, intercambio electrónico de documentos y un panel de administración con límites. Es útil para analizar y resumir documentos largos, configurar un asistente de chat para consultas repetitivas, extraer datos de capturas de pantalla, diagramas y fotos, redactar borradores de correos o descripciones, y crear un producto multimodal donde parte de las solicitudes se dirigen a otros modelos.Preguntas frecuentes sobre Llama 4 Scout
Puede usar los resultados generados con fines comerciales. Todos los derechos sobre el contenido creado le pertenecen. La única restricción: asegúrese de que la solicitud no incluya material de terceros protegido por derechos de autor. El usuario es responsable de respetar los derechos sobre los datos de entrada.
Es un modelo de texto con un contexto de 131072 tokens: responde preguntas, escribe y edita código, analiza documentos e imágenes, y ayuda con el análisis de materiales extensos. Es adecuado para chats y soporte, procesamiento de archivos grandes, preparación de borradores e integración en servicios a través de la API unificada de BotHub.
En una sola respuesta, el modelo genera hasta 16384 tokens, suficiente para un artículo extenso, una instrucción detallada o un fragmento de código grande. Si necesitas un texto más largo, continúa el diálogo por partes: el contexto de 131072 tokens permite mantener todo el material ante el modelo.
No se indica un modo de razonamiento separado en nuestros datos, por lo que no se deben esperar cadenas de pensamiento ocultas por defecto. Sin embargo, puedes pedir directamente en la solicitud que descomponga la tarea paso a paso; esto mejora notablemente la precisión en lógica, cálculos y análisis de código.
Sí, se admiten llamadas a funciones y salida JSON estructurada. El modelo devuelve una respuesta según el esquema dado y accede a tus herramientas: búsqueda, base de datos, calculadora, servicios internos. Esto es clave para agentes y automatización, y la API compatible con OpenAI de BotHub se conecta sin reescribir la integración.
Imágenes y documentos, sí: envía una captura de pantalla, foto, esquema o archivo y pide describir el contenido, extraer datos o comparar versiones. La recepción de audio y video no está indicada en nuestros datos, así que para sonido y clips, elige un modelo especializado en el catálogo de BotHub.
No hay notas sobre la compatibilidad con idiomas específicos en nuestros datos, por lo que no lo evaluaremos. Es más fiable comprobarlo en la práctica: envía tu consulta típica y compara la respuesta con otro modelo en la misma ventana; el cambio toma segundos y solo pagas por los tokens utilizados.