
In breve: la chiusura che OpenAI aveva annunciato quando questo articolo è uscito, a marzo, ora è completa. Il 24 marzo 2026 OpenAI ha comunicato la dismissione di Sora. L'app e il sito di Sora hanno chiuso il 26 aprile 2026, mentre i modelli Sora 2 e la Videos API di OpenAI sono stati spenti il 24 settembre 2026. La documentazione per sviluppatori di OpenAI oggi precisa che non esiste un'API sostitutiva equivalente. Se creavi video con Sora ti serve un nuovo strumento, e per la maggior parte dei flussi di lavoro di Sora il più vicino è Veo 3.1 di Google: anche lui genera video e audio insieme a partire da un prompt o da un'immagine, e in più aggiunge controlli su fotogrammi e riferimenti che Sora non ha mai avuto.
Questo articolo ripercorre la cronologia, spiega cosa si perde, dove Veo 3.1 è un sostituto diretto e dove no, e come adattare i prompt.
Che cosa è successo a Sora 2
OpenAI ha rilasciato Sora 2 il 30 settembre 2025, insieme a un'app social chiamata Sora. Lo ha presentato puntando sul realismo fisico (tiri a canestro sbagliati che rimbalzano sul ferro invece di finire magicamente nella retina) e su dialoghi ed effetti sonori sincronizzati. La funzione Cameo dell'app permetteva di registrarsi una volta sola e poi comparire, con la propria voce, nelle scene generate. A ottobre 2025 OpenAI ha portato la durata delle clip a 15 secondi per tutti e a 25 secondi per gli utenti Pro sul web, e ha aggiunto gli Storyboard per gli utenti Pro.
La chiusura è avvenuta in più fasi:
| Data | Che cosa è cambiato |
|---|---|
| 24 marzo 2026 | OpenAI annuncia la dismissione di Sora nell'app e nell'API e avvisa gli sviluppatori che usano l'API |
| 26 aprile 2026 | Chiudono le esperienze Sora su web e app |
| 24 settembre 2026 | Vengono spenti sora-2, sora-2-pro e la Videos API |
Fonti: la pagina delle deprecazioni dell'API di OpenAI, le pagine dei modelli Sora 2 e l'articolo del Centro assistenza di OpenAI sulla dismissione di Sora (verificati il 28 settembre 2026).
Che cosa perdono gli utenti di Sora
Conviene essere precisi su cosa rendeva utile Sora, perché è proprio questo a stabilire cosa cercare in un sostituto:
- Da testo e da immagine a video, con audio. Sora 2 generava dialoghi, effetti sonori e suono ambientale insieme alle immagini.
- Clip singole più lunghe. Fino a 15 secondi nell'app per tutti, 25 secondi per gli utenti Pro sul web.
- Storyboard per pianificare una clip inquadratura per inquadratura (Pro).
- Cameo, cioè la possibilità di inserire il proprio volto e la propria voce in una scena.
- Realismo fisico, che OpenAI aveva messo in primo piano.
- Accesso via API tramite
sora-2(720p) esora-2-pro(fino a 1080p), in verticale o in orizzontale.
Nessun sostituto da solo copre tutto. In particolare, l'inserimento di sé stessi in stile Cameo non ha un equivalente diretto in Veo 3.1, e i filtri di sicurezza di Google limitano la generazione di persone reali a partire da foto.
Perché Veo 3.1 è il sostituto più vicino
Veo 3.1 è stato rilasciato da Google DeepMind il 15 ottobre 2025 e aggiornato a gennaio 2026. Ecco come si confronta con ciò che offriva Sora 2, in base alla documentazione della Gemini API di Google e alle pagine dei modelli di OpenAI:
| Veo 3.1 (Google) | Sora 2 (prima della chiusura) | |
|---|---|---|
| Stato | Disponibile nell'app Gemini, in Flow, nella Gemini API e in Vertex AI | App chiusa il 26 aprile 2026; API chiusa il 24 settembre 2026 |
| Audio nativo | Sì, sempre attivo | Sì |
| Durata della clip | 4, 6 o 8 secondi | Fino a 15 s (25 s per i Pro sul web) |
| Sequenze più lunghe | Estensione: +7 s per passaggio, fino a circa 148 s in totale a 720p | — (gli Storyboard servivano a pianificare le inquadrature) |
| Risoluzione | 720p, 1080p, 4K | 720p (sora-2), fino a 1080p (sora-2-pro) |
| Formati | 16:9, 9:16 | Orizzontale, verticale |
| Partenza da un'immagine | Sì | Sì |
| Primo e ultimo fotogramma | Sì | No |
| Immagini di riferimento | Fino a 3 (Veo 3.1 e Veo 3.1 Fast) | Cameo (un sembiante registrato) |
Dove Veo 3.1 è alla pari o va oltre: audio generato insieme alle immagini, una risoluzione massima più alta (Google descrive il suo output 1080p e 4K come ottenuto per upscaling), formati verticali e orizzontali, e più modi per fissare un'inquadratura: un'immagine di partenza, un'immagine finale facoltativa oppure fino a tre immagini di riferimento per mantenere coerente un personaggio o un prodotto.
Dove dovrai adattarti: le clip singole sono più corte. Sora permetteva di generare da 15 a 25 secondi in un colpo solo; Veo 3.1 arriva a 8 secondi per clip, e per andare oltre devi estendere una clip negli strumenti di Google oppure montare più clip insieme. Se la maggior parte dei tuoi video su Sora erano lunghe riprese uniche, pianificali invece come una sequenza di inquadrature brevi.
Portare i prompt di Sora su Veo 3.1
Se i tuoi prompt per Sora erano liberi e basati sull'atmosfera, preparati a renderli più stringenti: Veo 3.1 premia le indicazioni precise, e Google cita una maggiore aderenza al prompt tra i principali miglioramenti della versione 3.1. Quando trasferisci un prompt di Sora:
- Dividi le idee lunghe in inquadrature. Un'idea da 20 secondi su Sora diventa due o tre inquadrature da 8 secondi, ciascuna con un'azione principale.
- Indica la camera. "Slow push-in", "handheld", "low-angle tracking shot": scrivilo invece di sperare che succeda.
- Scrivi il sonoro. Elenca il suono ambientale, l'effetto principale ed eventuali battute tra virgolette. In una clip di 8 secondi ci stanno una o due battute di dialogo, non un discorso.
- Fissa l'aspetto con un'immagine quando conta. Se un personaggio o un prodotto deve restare uguale tra un'inquadratura e l'altra, fai partire ogni inquadratura dalla stessa immagine fissa, oppure usa le immagini di riferimento.
- Scrivi in inglese per avere risultati più prevedibili: Google afferma che le altre lingue non sono state valutate a fondo.
Per gli sviluppatori: l'API di Sora non c'è più, quindi le pipeline hanno bisogno di un nuovo fornitore. Veo 3.1 è disponibile tramite la Gemini API e Vertex AI come anteprima a pagamento, nei livelli Veo 3.1, Veo 3.1 Fast e Veo 3.1 Lite. Veo 3 (il modello 3.0 originale) risulta deprecato nell'API di Google, quindi conviene costruire su 3.1.
Da quale livello di Veo 3.1 partire
Google offre tre livelli di Veo 3.1, e quello giusto dipende da quanto la clip deve essere definitiva:
- Veo 3.1: il livello con la fedeltà più alta, per le inquadrature che entrano nel montaggio finale.
- Veo 3.1 Fast: un livello più economico per l'uso quotidiano; su questo sito è anche quello che accetta fino a tre immagini di riferimento.
- Veo 3.1 Lite: il livello più conveniente di Google, adatto a mettere a punto i prompt e a provare le idee prima di spendere di più.
Una routine pratica per chi arriva da Sora: prepara la bozza del prompt su Lite, poi rigenera la versione che ti piace su Veo 3.1 alla risoluzione che ti serve.
Usare Veo 3.1 su Veo Video
Veo Video offre tutti e tre i livelli di Veo 3.1. Ogni generazione è una clip di 8 secondi con audio, in 16:9 o 9:16, a 720p, 1080p o 4K, a partire da un testo o da un'immagine con un fotogramma finale facoltativo. L'estensione delle clip e le durate di 4 o 6 secondi qui non sono disponibili. I nuovi account ricevono 30 crediti, sufficienti per una clip Veo 3.1 Lite a 720p: un buon modo per provare uno dei tuoi vecchi prompt di Sora prima di impegnarti. Se facevi affidamento sulle riprese lunghe di Sora, il generatore video IA offre anche MiniMax H3 Max per clip più lunghe in un unico passaggio.
Per un confronto funzione per funzione tra i due modelli, leggi Veo 3.1 vs Sora 2. Se stai valutando altri sostituti, guarda Veo 3.1 vs Kling AI e Veo 3.1 vs Grok Imagine.
