- Ox Alpha multimodal acepta texto, imágenes y video, y devuelve respuestas de texto.
- Los principales casos de uso incluyen programación, ingeniería de largo alcance, razonamiento y flujos de trabajo agénticos.
- El acceso a la API utiliza el slug de modelo
stealth/ox-alphamediante el endpoint compatible de OpenRouter. - El estado de los precios aparece como gratuito, pero siguen aplicándose las condiciones de vista previa y las políticas de retención del proveedor.
- El perfil de rendimiento muestra 23 tokens por segundo, una latencia P50 de 5.30 segundos y un contexto de 1M.
Descripción general de Ox Alpha multimodal
Ox Alpha multimodal es un modelo de IA centrado en el razonamiento, diseñado para la ingeniería de software, el trabajo agéntico prolongado, las cargas de trabajo de producción y las tareas que combinan texto con contexto visual. OpenRouter incluye el modelo bajo el slug stealth/ox-alpha, con una ventana de contexto de 1M de tokens y compatibilidad con entradas de texto, imágenes y video.
Durante su periodo de vista previa, el modelo es operado por un proveedor externo anónimo. OpenRouter enruta las solicitudes a ese proveedor, pero no se identifica como desarrollador, propietario ni proveedor de origen del modelo. Esta distinción es importante al evaluar el soporte, la disponibilidad, el tratamiento de datos y la estabilidad del modelo a largo plazo.
A fecha de 22 de agosto de 2026, la ficha pública identifica Ox Alpha como gratuito a través del proveedor mostrado. Los precios y la disponibilidad pueden cambiar, por lo que los equipos deberían consultar la página activa de precios y proveedores de la API de Ox Alpha antes de implementar una carga de trabajo.
| Detalle del modelo | Estado de Ox Alpha |
|---|---|
| Slug del modelo | stealth/ox-alpha |
| Tipo de modelo | Modelo de razonamiento y programación |
| Modalidades de entrada | Texto, imágenes, video |
| Modalidad de salida | Texto |
| Ventana de contexto | 1M de tokens |
| Fecha de lanzamiento indicada | 20 de agosto de 2026 |
| Precio mostrado | Gratuito |
| Número de proveedores | Un proveedor |
| Identidad del proveedor | Operador externo anónimo |
Enfoque en programación
Ox Alpha está orientado a la ingeniería de software, el trabajo con bases de código, las tareas de producción y las sesiones de desarrollo prolongadas.
Contexto visual
El formato de entrada documentado admite texto junto con URL de imágenes y videos para realizar análisis multimodales.
Trabajo agéntico
Sus flujos de trabajo objetivo incluyen agentes de larga duración, uso de herramientas, tareas iterativas y razonamiento complejo en varios pasos.
Considera Ox Alpha como un modelo de vista previa con un gran potencial para flujos de trabajo, no como un producto generalista completamente documentado. Pruébalo con tus propios prompts antes de asignarle tráfico de producción.
Capacidades multimodales y mejores usos
La característica definitoria de Ox Alpha multimodal es su capacidad para procesar varios tipos de entrada en una sola solicitud. El ejemplo público de inicio rápido combina una instrucción de texto con una URL de imagen y una URL de video, y pide al modelo que describa el contenido visual. El formato de respuesta documentado devuelve texto.
Esto hace que el modelo sea adecuado para flujos de trabajo en los que es necesario considerar conjuntamente código, capturas de pantalla, diagramas, sesiones grabadas o referencias visuales. El material disponible no establece benchmarks especializados para reconocimiento óptico de caracteres, comprensión de video o generación de imágenes, por lo que estas capacidades deben validarse mediante pruebas prácticas en lugar de darse por supuestas.
Los casos de uso documentados más destacados son:
- Revisar código mientras se inspeccionan capturas de pantalla de una aplicación.
- Analizar el contexto visual durante un flujo de trabajo de software agéntico.
- Trabajar con instrucciones extensas de proyectos o grandes fragmentos de una base de código.
- Combinar requisitos escritos con referencias de imágenes o videos.
- Respaldar tareas de producción iterativas mediante una API compatible con OpenAI.
| Tipo de entrada | Función compatible | Ejemplo de flujo de trabajo |
|---|---|---|
| Texto | Instrucciones, requisitos, código, preguntas | Solicitar un plan de refactorización o una explicación de depuración |
| Imagen | Contexto visual proporcionado mediante URL | Revisar una captura de pantalla de una interfaz junto con las notas de implementación |
| Video | Contexto visual temporal proporcionado mediante URL | Preguntar qué aparece en una sesión de pantalla grabada |
| Entrada mixta | Texto combinado con imagen o video | Comparar una referencia de diseño con una especificación escrita |
| Salida | Respuesta de texto | Devolver análisis, recomendaciones, código o explicaciones |
Revisión de código
Proporciona detalles de implementación junto con una referencia visual para ayudar a relacionar el comportamiento del código con los resultados de la interfaz.
Depuración
Utiliza capturas de pantalla, registros y síntomas descritos por escrito cuando un problema no pueda explicarse únicamente mediante texto.
Planificación
Proporciona al modelo requisitos amplios o contexto del repositorio para elaborar planes de ingeniería de largo alcance.
Asistencia agéntica
Integra Ox Alpha en herramientas que necesiten razonamiento, contexto visual y ejecución iterativa de tareas.
La ficha confirma que se aceptan entradas de imagen y video, pero no publica límites detallados sobre el tamaño de los archivos, la duración, la resolución o las fuentes de URL compatibles. Valida estas restricciones mediante una prueba controlada antes de basar tu implementación en ellas.
Configuración de la API de Ox Alpha multimodal
OpenRouter presenta Ox Alpha mediante un estilo de API compatible con OpenAI. El cambio de configuración principal es el identificador del modelo: las aplicaciones deben enviar solicitudes utilizando stealth/ox-alpha. La mayoría de los SDK compatibles pueden adaptarse cambiando la URL base y el slug del modelo, aunque el comportamiento exacto de la integración depende del SDK y del formato de la solicitud.
La configuración básica comienza con una clave de API almacenada como variable de entorno. Después, se puede activar la transmisión mediante "stream": true cuando la aplicación necesite eventos enviados por el servidor y una salida incremental.
Crear una clave de API
Genera una clave de API desde el panel de OpenRouter y guárdala en una variable de entorno como OPENROUTER_API_KEY. Evita colocar la clave directamente en el código del navegador o en repositorios públicos.
Seleccionar el modelo
Establece el valor del modelo en stealth/ox-alpha. Este slug identifica a Ox Alpha en la ruta de OpenRouter y debe sustituir el nombre del modelo utilizado por tu cliente compatible actual.
Crear la solicitud
Envía una solicitud de chat con un mensaje de texto o proporciona contenido estructurado que incluya texto, una URL de imagen y una URL de video. Mantén limitada la prueba inicial para facilitar el diagnóstico de errores.
Activar la transmisión cuando sea necesario
Añade "stream": true cuando tu interfaz deba mostrar una salida incremental. La transmisión resulta útil para respuestas extensas, actualizaciones de agentes y herramientas de desarrollo interactivas.
Verificar el uso y los errores
Inspecciona el mensaje devuelto, la información de uso, la latencia y el comportamiento de las llamadas a herramientas. Registra los resultados de varios prompts antes de pasar de las pruebas a producción.
| Parámetro | Tipo | Valor predeterminado | Finalidad práctica |
|---|---|---|---|
max_tokens | Integer | No especificado | Establece un límite superior para los tokens de la respuesta generada |
temperature | Float | 1 | Controla la variedad de las respuestas |
top_p | Float | 0.95 | Limita la selección a una masa de probabilidad de tokens probables |
tools | Array | No especificado | Proporciona definiciones de herramientas utilizando la estructura de solicitud compatible |
tool_choice | String or object | No especificado | Controla si se selecciona una herramienta y cómo se selecciona |
top_k | Integer | 0 | Restringe las opciones de tokens en cada paso de generación |
response_format | Map | No especificado | Solicita un formato de salida específico |
Lista de comprobación de preparación de la API:
- Crear y almacenar de forma segura una clave de API de OpenRouter
- Confirmar que el slug del modelo es stealth/ox-alpha
- Probar solicitudes de solo texto antes de añadir entradas visuales
- Probar por separado el procesamiento de URL de imágenes y videos
- Registrar la latencia, la calidad de salida y los errores de llamadas a herramientas
Comienza con una solicitud de solo texto, después añade una imagen y, por último, incorpora video o herramientas. Este enfoque gradual permite aislar los problemas de formato de entrada e integración con mayor eficacia que probar todas las funciones a la vez.
Rendimiento, precios y fiabilidad
La ficha pública del proveedor informa de un único proveedor de origen para Ox Alpha. En la fila del proveedor mostrado aparecen precios gratuitos para las entradas y salidas, una latencia P50 de 5.30 segundos, un rendimiento de 23 tokens por segundo y un 100.00% de disponibilidad.
El panel de rendimiento general informa de valores percentiles agregados diferentes en la vista de monitorización disponible. Por ejemplo, muestra un rendimiento P50 medio de 36 tokens por segundo y una latencia P50 media de 3.38 segundos, mientras que la latencia P50 de extremo a extremo aparece como 16.65 segundos. Estas cifras no deben tratarse como intercambiables: el rendimiento del proveedor, la latencia de ida y vuelta y la latencia de extremo a extremo miden partes diferentes del ciclo de vida de una solicitud.
| Métrica | Valor mostrado | Cómo interpretarlo |
|---|---|---|
| Rendimiento del proveedor | 23 tok/s | Rendimiento P50 informado para el proveedor indicado |
| Latencia del proveedor | 5.30 s | Latencia P50 de ida y vuelta informada |
| Disponibilidad del proveedor | 100.00% | Disponibilidad del proveedor mostrada durante el periodo monitorizado |
| Disponibilidad general | 99.99% | Vista de monitorización de OpenRouter correspondiente al periodo reciente de tres días |
| Disponibilidad total | 99.51% | Porcentaje de solicitudes atendidas correctamente en la misma vista |
| Tasa de errores de llamadas a herramientas | 2.27% | Tasa media de errores mostrada para el proveedor |
| Tasa de aciertos de caché | 81.72% | Tasa media de aciertos de caché mostrada en el panel de rendimiento |
Actualmente, los precios aparecen como cero dólares por cada millón de tokens de entrada y salida, y los precios medios ponderados de entrada y salida también se muestran como $0. Sin embargo, “gratuito” debe interpretarse como el estado actual de la ficha, no como una garantía permanente. El acceso de vista previa, los cambios de proveedor, las restricciones de uso y las condiciones pueden afectar a la disponibilidad futura.
El tratamiento de los datos también merece atención. La ficha indica que el proveedor externo conserva los prompts y las respuestas completadas, y que no los utiliza para entrenar modelos. Otros usos se rigen por las Condiciones aplicables de Stealth Model. Revisa dichas condiciones antes de enviar código fuente confidencial, datos de clientes, credenciales o información regulada.
Un indicador sólido de disponibilidad reciente no elimina la necesidad de implementar reintentos, tiempos de espera, registros y un plan de respaldo. Una ruta con un solo proveedor ofrece un perfil operativo diferente al de un modelo con varios proveedores independientes.
Orientación para producción y preguntas frecuentes
Ox Alpha puede ser una opción útil para experimentos de programación multimodal y agentes, especialmente cuando resultan valiosos una ventana de contexto amplia y las entradas visuales. La adopción en producción debe basarse en la calidad medida de las tareas, no únicamente en el precio público o en la compatibilidad multimodal anunciada.
Utiliza un conjunto de evaluación pequeño que refleje tu carga de trabajo real:
- Cambios de código en varios archivos.
- Diagnóstico de interfaces basado en capturas de pantalla.
- Interpretación de videos o sesiones de pantalla.
- Tareas de uso de herramientas con fallos recuperables.
- Prompts extensos que pongan a prueba la retención del contexto.
- Salidas estructuradas que puedan validarse automáticamente.
En sistemas sensibles, coloca una capa de aplicación entre los usuarios y el modelo. Oculta las credenciales, restringe los permisos de las herramientas, valida el código generado y conserva los metadatos de las solicitudes para facilitar la depuración. Dado que el proveedor de origen es anónimo en la ficha de vista previa, documenta las suposiciones sobre el tratamiento de datos del modelo y revísalas cada vez que cambien las condiciones del proveedor.
Q: ¿Qué es Ox Alpha multimodal?
Ox Alpha multimodal es un modelo de razonamiento diseñado para la programación, el trabajo agéntico prolongado, las cargas de trabajo de producción y los flujos que combinan texto con contexto visual. Acepta texto, imágenes y video como entradas, y devuelve texto.
Q: ¿Cómo puedo llamar a Ox Alpha mediante una API?
Utiliza una clave de API de OpenRouter y establece el modelo como stealth/ox-alpha. La integración indicada sigue un estilo de solicitud compatible con OpenAI, y la transmisión puede activarse estableciendo stream en true.
Q: ¿Ox Alpha se puede utilizar gratis?
A fecha de 22 de agosto de 2026, la ficha de OpenRouter muestra precios de cero dólares para las entradas y salidas. Se trata de una ficha de vista previa actual y no debe considerarse permanente.
Q: ¿Ox Alpha admite imágenes y video?
Sí. El formato documentado de inicio rápido incluye texto, una URL de imagen y una URL de video en la misma solicitud. El modelo devuelve una respuesta de texto que describe o analiza el contenido proporcionado.
Utiliza Ox Alpha primero para evaluaciones multimodales controladas. Mantén las medidas de protección de producción, supervisa el comportamiento del proveedor y confirma los precios y las condiciones actuales en la ficha oficial antes de ampliar el uso.