VJOURNAL

IA • Mesa global • 01 de octubre de 2026

La retirada de la API de Sora cambia la elección de modelos de imagen y vídeo

La comparación visual IA empieza por la disponibilidad. OpenAI fija la retirada de la API de Sora el 24 de septiembre; imagen y vídeo con sonido necesitan pruebas y decisiones distintas.

Portada de VJOURNAL para «La retirada de la API de Sora cambia la elección de modelos de imagen y vídeo»

Respuesta breve

La comparación visual IA empieza por la disponibilidad. OpenAI fija la retirada de la API de Sora el 24 de septiembre; imagen y vídeo con sonido necesitan pruebas y decisiones distintas.

Corte de verificación: 12 fuentes
OpenAI enumera la retirada de la API y los modelos Sora para el 24 de septiembre de 2026.
La tabla de vídeo emplea AA-Video-T2V v2.0 con audio y conserva las variantes exactas.
Elo de imagen pertenece a otra escala; los intervalos de Sunburst y Flare se solapan.

La retirada de septiembre cambia los candidatos

Para un equipo de producción, la comparación visual IA empieza por comprobar que el servicio existe. El calendario oficial de OpenAI enumera la eliminación de Videos API y las variantes Sora 2 el 24 de septiembre de 2026. Al cierre del 1 de octubre, una guía que ofrece Sora como API habitual necesita revisar disponibilidad antes de hablar de calidad.

El cambio importa para una campaña en curso. Una demostración memorable no promete acceso operativo, flujo compatible ni revisiones repetibles. Conviene formar la lista con documentación vigente y vincular las pruebas a cada variante exacta. Esta redacción no generó clips de evaluación ni ejecutó un ensayo de imágenes para el artículo.

La prueba de vídeo debe indicar el sonido

La tabla utiliza AA-Video-T2V v2.0 de Artificial Analysis con audio, observada el 1 de octubre. Registra preferencias humanas en esa tarea y conserva intervalos de confianza. La metodología del productor indica ajustes y un tablero silencioso separado. La consulta no reveló fechas exactas de generación o voto, que permanecen desconocidas.

El sonido cambia un encargo: diálogo, ambiente y sincronización pueden determinar si sirve una toma. Una puntuación sin audio no contesta esa pregunta. El 1000 de Kling es el ancla de referencia, no un porcentaje medido. Ninguna cifra demuestra exactitud factual ni garantiza continuidad en una secuencia completa.

Artificial Analysis AA-Video-T2V v2.0, audio activado y preferencias generales; consulta 01-10-2026. Objetivo: 1080p, 24 fotogramas/s, 10 segundos, 16:9 o alternativa admitida; ajustes y mejora de instrucciones recomendados. Fechas exactas de generación/voto: desconocidas. Retirada API Sora: 24-09-2026.
Modelo de vídeo / varianteEloIntervalo 95%MuestrasDisponibilidad del proveedor
Gemini Omni Flash 1.111171107–11276,974Gemini API, nivel de pago
Kling 3.0 1080p (Pro)1000Ancla fija de referencia4,453Modo de audio nativo documentado
Veo 3.1966955–9772,851Gemini API; generación con audio
Sora 2 / Sora 2 ProDesconocido en este tablero actualDesconocidoDesconocidoFecha de retirada: 24-09-2026

Las funciones documentadas pueden decidir

La documentación actual de Google recomienda Gemini Omni Flash por defecto e identifica Veo 3.1 para controles como extensión de escenas y dirección mediante fotogramas. La guía oficial de Kling documenta audio nativo y varias tomas. Son capacidades descritas por proveedores; la tabla aporta evidencia independiente sobre una tarea de generación más estrecha.

Un estudio podría necesitar una operación de edición más que el modelo preferido en comparaciones anónimas. La ficha de Veo se actualizó el 13 de enero de 2026 y los paneles comparativos de su página llevan fechas de octubre de 2025. Esas comparaciones históricas deben conservar la fecha, sin convertirse en superioridad actual sobre todo el mercado.

Las imágenes requieren otra comparación

La ficha Images 2.5 de OpenAI del 8 de septiembre documenta Sunburst y Flare; Google describe las variantes Nano Banana en su API. La segunda tabla emplea texto a imagen con ajustes de calidad identificados. Los intervalos de Sunburst y Flare se solapan, por lo que su orden visible no debe presentarse como una diferencia segura.

Generar desde texto y editar una referencia aprobada producen entregables distintos. Una puntuación mayor no demuestra que se conserve la geometría de un producto durante una revisión localizada. Elo de imagen y Elo de vídeo también tienen anclas diferentes. Inventar un ganador conjunto borraría la tarea que cada medición representa.

Artificial Analysis AA-Image-T2I v2.0, preferencias generales de texto a imagen; consulta 01-10-2026. Fechas exactas desconocidas; variantes de calidad conservadas. Referencias: ficha OpenAI Images 2.5 del 08-09 y documentación Google. Elo de imagen y vídeo no son comparables.
Modelo de imagen / calidadEloIntervalo 95%Muestras
GPT Image 2.5 Sunburst (max)11971188–120614,023
GPT Image 2.5 Flare (max)11901181–119913,393
Nano Banana 2 / Gemini 3.1 Flash Image11251117–113318,454

Presupuestar el material aceptado

Un ensayo creativo útil definiría referencia aprobada, idioma, duración, dirección de cámara y límites de revisión. Evaluaría continuidad, edición y sonido frente a esos requisitos. Registraría generaciones rechazadas además del material aceptado. Es una propuesta de proceso de decisión, no un ensayo realizado por nosotros con los modelos enumerados.

El cambio de disponibilidad de septiembre hace oportuna esa disciplina. Mantenga unidos aviso del proveedor, variante, modalidad y fecha de consulta. Así obtiene candidatos utilizables y un presupuesto por imágenes o tomas aceptadas, en lugar de una promesa deducida de una demostración antigua de lanzamiento.

Preguntas frecuentes

¿Sora sigue siendo una API directa disponible?

El calendario oficial de OpenAI enumera la retirada de Videos API, Sora 2 y Sora 2 Pro para el 24 de septiembre de 2026. Una comparación antigua no sustituye ese aviso.

¿Un Elo mayor garantiza una toma utilizable?

No. Elo mide preferencias relativas en una prueba definida. No garantiza continuidad, idioma hablado exacto ni coste de repeticiones para una producción concreta.

¿Se pueden unir los Elo de imagen y vídeo?

No. Los tableros tienen tareas, muestras y anclas diferentes. Generación de imágenes, edición y vídeo con audio deben conservar sus propios métodos de evaluación.