
En resumen: el cierre que OpenAI anunció cuando publicamos este artículo en marzo ya se ha completado. OpenAI anunció el 24 de marzo de 2026 que dejaba de ofrecer Sora. La app y el sitio web de Sora cerraron el 26 de abril de 2026, y los modelos de Sora 2 y la Videos API de OpenAI se apagaron el 24 de septiembre de 2026. La documentación para desarrolladores de OpenAI indica ahora que no hay una API que la sustituya de forma equivalente. Si hacías videos con Sora, necesitas una herramienta nueva, y para la mayoría de los flujos de trabajo de Sora, Veo 3.1 de Google es lo más parecido: también genera imagen y sonido a la vez a partir de un prompt o de una imagen, y añade controles de fotogramas y de referencias que Sora nunca tuvo.
Este artículo repasa la cronología, lo que pierdes, en qué casos Veo 3.1 es un reemplazo directo y en cuáles no, y cómo adaptar tus prompts.
Qué pasó con Sora 2
OpenAI lanzó Sora 2 el 30 de septiembre de 2025, junto con una app social de Sora. OpenAI lo presentó destacando el realismo físico (un tiro de baloncesto fallado rebota en el aro en lugar de teletransportarse dentro de la canasta) y el diálogo y los efectos de sonido sincronizados. La función Cameo de la app permitía grabarse una sola vez y aparecer, con la propia voz, en escenas generadas. En octubre de 2025, OpenAI amplió la duración de los clips a 15 segundos para todos los usuarios y a 25 segundos para los usuarios Pro en la web, y añadió Storyboards para los usuarios Pro.
El cierre se hizo por etapas:
| Fecha | Qué cambió |
|---|---|
| 24 de marzo de 2026 | OpenAI anuncia que deja de ofrecer Sora en la app y en la API, y avisa a los desarrolladores de la API |
| 26 de abril de 2026 | Terminan las experiencias web y de app de Sora |
| 24 de septiembre de 2026 | Se apagan sora-2, sora-2-pro y la Videos API |
Fuentes: la página de modelos retirados de la API de OpenAI y las páginas de los modelos Sora 2, además del artículo del Centro de ayuda de OpenAI sobre el fin de Sora (revisado el 28 de septiembre de 2026).
Qué pierden los usuarios de Sora
Conviene ser preciso sobre qué hacía útil a Sora, porque eso determina qué buscar a continuación:
- Texto e imagen a video con sonido. Sora 2 generaba diálogo, efectos de sonido y ambiente junto con la imagen.
- Clips individuales más largos. Hasta 15 segundos en la app para todos y 25 segundos para los usuarios Pro en la web.
- Storyboards para planificar un clip toma a toma (Pro).
- Cameos: poner tu propia cara y tu voz en una escena.
- El realismo físico que OpenAI convirtió en función estrella.
- Acceso por API con
sora-2(720p) ysora-2-pro(hasta 1080p), en vertical u horizontal.
Ningún sustituto cubre todo esto por sí solo. En particular, la inserción de uno mismo al estilo Cameo no tiene un equivalente directo en Veo 3.1, y los filtros de seguridad de Google restringen la generación de personas reales a partir de fotos.
Por qué Veo 3.1 es el sustituto más cercano
Google DeepMind lanzó Veo 3.1 el 15 de octubre de 2025 y lo actualizó en enero de 2026. Así se compara con lo que ofrecía Sora 2, según la documentación de la API de Gemini de Google y las páginas de modelos de OpenAI:
| Veo 3.1 (Google) | Sora 2 (antes del cierre) | |
|---|---|---|
| Estado | Disponible en la app Gemini, Flow, la API de Gemini y Vertex AI | App cerrada el 26 de abril de 2026; API cerrada el 24 de septiembre de 2026 |
| Audio nativo | Sí, siempre activo | Sí |
| Duración del clip | 4, 6 u 8 segundos | Hasta 15 s (25 s para Pro en la web) |
| Secuencias más largas | Extensión: +7 s por paso, hasta unos 148 s en total a 720p | — (Storyboards servía para planificar tomas) |
| Resolución | 720p, 1080p, 4K | 720p (sora-2), hasta 1080p (sora-2-pro) |
| Relaciones de aspecto | 16:9, 9:16 | Horizontal, vertical |
| Empezar desde una imagen | Sí | Sí |
| Primer y último fotograma | Sí | No |
| Imágenes de referencia | Hasta 3 (Veo 3.1 y Veo 3.1 Fast) | Cameos (una apariencia grabada) |
Dónde Veo 3.1 iguala o va más allá: sonido generado junto con la imagen, una resolución máxima más alta (Google describe su salida a 1080p y 4K como reescalada), formatos vertical y horizontal, y más formas de fijar una toma: una imagen inicial, una imagen final opcional o hasta tres imágenes de referencia para mantener coherente un personaje o un producto.
Dónde tendrás que adaptarte: los clips individuales son más cortos. Sora te permitía generar de 15 a 25 segundos de una vez; Veo 3.1 te da hasta 8 segundos por clip. Para ir más allá, amplías un clip en las herramientas de Google o montas varios clips juntos. Si la mayoría de tus videos de Sora eran tomas largas únicas, plantéalos como una secuencia de tomas cortas.
Cómo pasar tus prompts de Sora a Veo 3.1
Si tus prompts de Sora eran vagos y se apoyaban en la atmósfera, prepárate para concretarlos: Veo 3.1 recompensa las indicaciones específicas, y Google destaca una mayor fidelidad al prompt como una de las principales mejoras de la versión 3.1. Cuando traslades un prompt de Sora:
- Divide las ideas largas en tomas. Un concepto de 20 segundos en Sora se convierte en dos o tres tomas de 8 segundos, cada una con una acción principal.
- Nombra la cámara. «Acercamiento lento», «cámara en mano», «travelling en contrapicado»: dilo en lugar de esperar que ocurra.
- Escribe el sonido. Enumera el ambiente, el efecto clave y cualquier frase hablada entre comillas. En un clip de 8 segundos cabe una línea de diálogo o dos, no un discurso.
- Fija el aspecto con una imagen cuando importe. Si un personaje o un producto debe mantenerse igual entre tomas, empieza cada toma desde la misma imagen fija o usa imágenes de referencia.
- Escribe en inglés para obtener resultados más previsibles; Google indica que otros idiomas no se han evaluado por completo.
Para desarrolladores: la API de Sora ya no existe, así que los flujos automatizados necesitan un proveedor nuevo. Veo 3.1 está disponible en la API de Gemini y en Vertex AI como versión preliminar de pago, con los niveles Veo 3.1, Veo 3.1 Fast y Veo 3.1 Lite. Veo 3 (el modelo 3.0 original) figura como obsoleto en la API de Google, así que construye sobre la 3.1.
Con qué nivel de Veo 3.1 empezar
Google ofrece tres niveles de Veo 3.1, y el adecuado depende de lo definitivo que deba ser el clip:
- Veo 3.1: el nivel de mayor fidelidad, para las tomas que entran en el montaje final.
- Veo 3.1 Fast: un nivel de menor costo para el día a día; en este sitio es además el que admite hasta tres imágenes de referencia.
- Veo 3.1 Lite: el nivel más económico de Google, útil para redactar prompts y probar ideas antes de gastar más.
Una rutina práctica para quienes venían de Sora: prepara el prompt con Lite y luego vuelve a generar la versión que te guste con Veo 3.1 a la resolución que necesites.
Usar Veo 3.1 en Veo Video
Veo Video ofrece los tres niveles de Veo 3.1. Cada generación es un clip de 8 segundos con sonido, en 16:9 o 9:16, a 720p, 1080p o 4K, creado a partir de texto o de una imagen con un fotograma final opcional. La extensión de clips y las duraciones de 4 o 6 segundos no están disponibles aquí. Las cuentas nuevas reciben 30 créditos, suficientes para un clip de Veo 3.1 Lite a 720p: una buena forma de probar uno de tus antiguos prompts de Sora antes de comprometerte. Si dependías de las tomas largas de Sora, el generador de video con IA también funciona con MiniMax H3 Max para clips más largos de una sola pasada.
Para comparar ambos modelos función por función, lee Veo 3.1 vs Sora 2. Si estás valorando otros sustitutos, consulta Veo 3.1 vs Kling AI y Veo 3.1 vs Grok Imagine.
