
Resumo: o encerramento que a OpenAI anunciou quando este artigo foi publicado, em março, já foi concluído. Em 24 de março de 2026, a OpenAI anunciou que ia descontinuar o Sora. O app e o site do Sora fecharam em 26 de abril de 2026, e os modelos Sora 2 e a Videos API da OpenAI foram desligados em 24 de setembro de 2026. A documentação para desenvolvedores da OpenAI agora diz que não há uma API substituta equivalente. Se você fazia vídeos com o Sora, precisa de uma nova ferramenta, e para a maioria dos fluxos de trabalho do Sora o Veo 3.1 do Google é o substituto mais próximo: ele também gera vídeo e som juntos a partir de um prompt ou de uma imagem, e acrescenta controles de quadro e de referência que o Sora nunca teve.
Este artigo explica a linha do tempo, o que você perde, onde o Veo 3.1 substitui o Sora sem adaptação e onde não, e como ajustar os seus prompts.
O que aconteceu com o Sora 2
A OpenAI lançou o Sora 2 em 30 de setembro de 2025, junto com um app social do Sora. A empresa o apresentou pelo realismo físico (arremessos de basquete errados que batem no aro e voltam, em vez de se teletransportarem para dentro da cesta) e pelo diálogo e efeitos sonoros sincronizados. O recurso Cameo do app permitia que a pessoa se gravasse uma vez e aparecesse, com a própria voz, em cenas geradas. Em outubro de 2025, a OpenAI aumentou a duração dos clipes para 15 segundos para todos os usuários e para 25 segundos para usuários Pro na web, e adicionou os Storyboards para usuários Pro.
O encerramento aconteceu em etapas:
| Data | O que mudou |
|---|---|
| 24 de março de 2026 | A OpenAI anuncia que vai descontinuar o Sora no app e na API e avisa os desenvolvedores da API |
| 26 de abril de 2026 | As experiências web e de app do Sora são encerradas |
| 24 de setembro de 2026 | sora-2, sora-2-pro e a Videos API são desligados |
Fontes: página de descontinuações da API da OpenAI e páginas dos modelos Sora 2, além do artigo da Central de Ajuda da OpenAI sobre a descontinuação do Sora (conferidos em 28 de setembro de 2026).
O que os usuários do Sora perdem
Vale ser preciso sobre o que tornava o Sora útil, porque isso define o que procurar a seguir:
- Texto e imagem para vídeo com som. O Sora 2 gerava diálogo, efeitos sonoros e ambiente junto com a imagem.
- Clipes únicos mais longos. Até 15 segundos no app para todos e 25 segundos para usuários Pro na web.
- Storyboards para planejar um clipe tomada por tomada (Pro).
- Cameos: colocar o próprio rosto e a própria voz numa cena.
- Realismo físico, que a OpenAI transformou em recurso de destaque.
- Acesso por API com
sora-2(720p) esora-2-pro(até 1080p), na vertical ou na horizontal.
Nenhum substituto sozinho cobre tudo isso. A inserção de si mesmo no estilo Cameo, em especial, não tem equivalente direto no Veo 3.1, e os filtros de segurança do Google restringem a geração de pessoas reais a partir de fotos.
Por que o Veo 3.1 é o substituto mais próximo
O Veo 3.1 foi lançado pelo Google DeepMind em 15 de outubro de 2025 e atualizado em janeiro de 2026. Veja como ele se compara ao que o Sora 2 oferecia, com base na documentação da Gemini API do Google e nas páginas de modelo da OpenAI:
| Veo 3.1 (Google) | Sora 2 (antes do encerramento) | |
|---|---|---|
| Situação | Disponível no app Gemini, no Flow, na Gemini API e na Vertex AI | App fechado em 26 de abril de 2026; API fechada em 24 de setembro de 2026 |
| Áudio nativo | Sim, sempre ativo | Sim |
| Duração do clipe | 4, 6 ou 8 segundos | Até 15 s (25 s para Pro na web) |
| Sequências mais longas | Extensão: +7 s por etapa, até cerca de 148 s no total em 720p | — (os Storyboards serviam para planejar tomadas) |
| Resolução | 720p, 1080p, 4K | 720p (sora-2), até 1080p (sora-2-pro) |
| Proporções | 16:9, 9:16 | Horizontal, vertical |
| Começar de uma imagem | Sim | Sim |
| Primeiro e último quadro | Sim | Não |
| Imagens de referência | Até 3 (Veo 3.1 e Veo 3.1 Fast) | Cameos (uma imagem gravada da pessoa) |
Onde o Veo 3.1 se equipara ou vai além: som gerado junto com a imagem, teto de resolução mais alto (o Google descreve a saída em 1080p e 4K como resultado de upscaling), formatos vertical e horizontal e mais maneiras de fixar uma tomada: uma imagem inicial, uma imagem final opcional ou até três imagens de referência para manter um personagem ou produto consistente.
Onde você vai precisar se adaptar: os clipes únicos são mais curtos. O Sora permitia gerar de 15 a 25 segundos de uma vez; o Veo 3.1 entrega até 8 segundos por clipe. Para ir além, você estende um clipe nas ferramentas do próprio Google ou edita vários clipes juntos. Se a maioria dos seus vídeos no Sora eram tomadas únicas e longas, planeje-os como uma sequência de tomadas curtas.
Como levar seus prompts do Sora para o Veo 3.1
Se os seus prompts no Sora eram soltos e guiados por clima, prepare-se para deixá-los mais precisos: o Veo 3.1 recompensa instruções específicas, e o Google destaca a maior aderência ao prompt como uma das principais melhorias da versão 3.1. Ao adaptar um prompt do Sora:
- Divida ideias longas em tomadas. Um conceito de 20 segundos no Sora vira duas ou três tomadas de 8 segundos, cada uma com uma ação principal.
- Diga qual é a câmera. "Aproximação lenta", "câmera na mão", "travelling em contra-plongée": escreva isso em vez de torcer para acontecer.
- Escreva o som. Liste o ambiente, o efeito principal e qualquer fala entre aspas. Um clipe de 8 segundos comporta uma ou duas falas, não um discurso.
- Fixe o visual com uma imagem quando isso importar. Se um personagem ou produto precisa ser o mesmo em várias tomadas, comece cada tomada da mesma imagem ou use imagens de referência.
- Escreva em inglês para ter os resultados mais previsíveis; o Google diz que outros idiomas ainda não foram totalmente avaliados.
Para desenvolvedores: a API do Sora não existe mais, então os pipelines precisam de um novo fornecedor. O Veo 3.1 está disponível pela Gemini API e pela Vertex AI como prévia paga, nos níveis Veo 3.1, Veo 3.1 Fast e Veo 3.1 Lite. O Veo 3 (o modelo 3.0 original) está marcado como descontinuado na API do Google, então construa sobre o 3.1.
Com qual nível do Veo 3.1 começar
O Google oferece três níveis do Veo 3.1, e o certo depende de quão final o clipe precisa ser:
- Veo 3.1: o nível de maior fidelidade, para tomadas que entram no corte final.
- Veo 3.1 Fast: um nível mais barato para o dia a dia; neste site, é também o que aceita até três imagens de referência.
- Veo 3.1 Lite: o nível com melhor custo-benefício do Google, bom para rascunhar prompts e testar ideias antes de gastar mais.
Uma rotina prática para quem vem do Sora: rascunhe o prompt no Lite e depois gere de novo a versão de que gostou no Veo 3.1, na resolução de que precisa.
Como usar o Veo 3.1 no Veo Video
O Veo Video roda os três níveis do Veo 3.1. Cada geração é um clipe de 8 segundos com som, em 16:9 ou 9:16, em 720p, 1080p ou 4K, a partir de texto ou de uma imagem com quadro final opcional. Extensão de clipe e durações de 4 ou 6 segundos não estão disponíveis aqui. Contas novas recebem 30 créditos, o suficiente para um clipe do Veo 3.1 Lite em 720p: uma boa forma de testar um dos seus prompts antigos do Sora antes de se comprometer. Se você dependia das tomadas únicas mais longas do Sora, o gerador de vídeo com IA também roda o MiniMax H3 Max, para clipes mais longos de uma só vez.
Para uma comparação recurso por recurso entre os dois modelos, leia Veo 3.1 vs Sora 2. Se você está avaliando outros substitutos, veja Veo 3.1 vs Kling AI e Veo 3.1 vs Grok Imagine.
