
要点: この記事を3月に最初に公開した時点でOpenAIが予告していた終了は、すでに完了しています。OpenAIは2026年3月24日にSoraの提供終了を発表しました。SoraのアプリとWebサイトは2026年4月26日に閉鎖され、Sora 2のモデルとOpenAIのVideos APIは2026年9月24日に停止されています。OpenAIの開発者向けドキュメントには現在、1対1で置き換えられるAPIはないと記載されています。Soraで動画を作っていた人は新しいツールが必要です。そしてSoraでの作業の大半について、最も近い選択肢はGoogleのVeo 3.1です。Veo 3.1もプロンプトや画像から映像と音声を同時に生成でき、さらにSoraにはなかったフレーム指定や参照画像による制御が加わっています。
この記事では、終了までの経緯、失われるもの、Veo 3.1がそのまま置き換えられる部分とそうでない部分、そしてプロンプトをどう書き換えるかを説明します。
Sora 2に何が起きたのか
OpenAIは2025年9月30日、SoraのソーシャルアプリとともにSora 2をリリースしました。OpenAIが売りにしたのは物理的なリアリティ(外れたバスケットのシュートが、瞬間移動するようにゴールへ吸い込まれるのではなく、リングに当たって跳ね返る)と、映像に同期したセリフや効果音です。アプリのCameo機能を使えば、一度自分を撮影しておくだけで、自分の声ごと生成シーンに登場できました。2025年10月には、全ユーザーの動画の長さが15秒に、Web版のProユーザーは25秒に引き上げられ、Proユーザー向けにStoryboardsも追加されました。
終了は段階的に進みました。
| 日付 | 変更内容 |
|---|---|
| 2026年3月24日 | OpenAIがアプリとAPIでのSora提供終了を発表し、API開発者に通知 |
| 2026年4月26日 | SoraのWeb版とアプリが終了 |
| 2026年9月24日 | sora-2、sora-2-pro、Videos APIが停止 |
出典:OpenAIのAPI非推奨ページとSora 2のモデルページ、およびSora提供終了に関するOpenAIヘルプセンターの記事(2026年9月28日確認)。
Soraユーザーが失うもの
Soraの何が便利だったのかを正確に把握しておくと、次に何を探すべきかがはっきりします。
- 音声付きのテキストから動画・画像から動画。 Sora 2はセリフ、効果音、環境音を映像と一緒に生成していました。
- 1本あたりの動画が長い。 アプリでは全員が最大15秒、Web版のProユーザーは25秒まで生成できました。
- Storyboards。 1本の動画をショットごとに設計する機能です(Pro向け)。
- Cameo。 自分の顔と声をシーンに入れる機能です。
- 物理的なリアリティ。 OpenAIが看板機能として打ち出していました。
- APIでの利用。
sora-2(720p)とsora-2-pro(最大1080p)で、縦向き・横向きに対応していました。
これらすべてを1つで代替できるツールはありません。特にCameoのように自分自身をシーンに入れる機能には、Veo 3.1に直接の相当機能がありません。また、Googleの安全フィルターは、写真から実在の人物を生成することを制限しています。
Veo 3.1が最も近い代替である理由
Veo 3.1はGoogle DeepMindが2025年10月15日にリリースし、2026年1月に更新したモデルです。GoogleのGemini APIドキュメントとOpenAIのモデルページをもとに、Sora 2が提供していた機能と並べてみます。
| Veo 3.1(Google) | Sora 2(終了前) | |
|---|---|---|
| 提供状況 | Geminiアプリ、Flow、Gemini API、Vertex AIで利用可能 | アプリは2026年4月26日、APIは2026年9月24日に終了 |
| ネイティブ音声 | あり、常時オン | あり |
| 動画の長さ | 4秒・6秒・8秒 | 最大15秒(Web版のProは25秒) |
| 長い連続映像 | 延長:1回あたり7秒追加、720pで合計約148秒まで | なし(Storyboardsはショット設計用) |
| 解像度 | 720p、1080p、4K | 720p(sora-2)、最大1080p(sora-2-pro) |
| アスペクト比 | 16:9、9:16 | 横向き、縦向き |
| 画像から開始 | 可能 | 可能 |
| 最初と最後のフレーム指定 | 可能 | 不可 |
| 参照画像 | 最大3枚(Veo 3.1とVeo 3.1 Fast) | Cameo(撮影した本人の姿) |
Veo 3.1が同等か、それ以上の部分: 映像と一緒に生成される音声、より高い解像度の上限(Googleは1080pと4Kの出力をアップスケールによるものと説明しています)、縦型と横型の両フォーマット、そしてショットを固定する手段の多さです。開始画像、任意の終了画像、あるいはキャラクターや商品を一貫させるための最大3枚の参照画像を使えます。
調整が必要な部分: 1本あたりの動画が短くなります。Soraでは一度に15〜25秒を生成できましたが、Veo 3.1は1本につき最大8秒です。それより長くしたい場合は、Google自身のツールで動画を延長するか、複数の動画をつなげて編集します。Soraで作っていた動画の多くが長いワンテイクだったなら、短いショットの連続として組み立て直す計画を立てましょう。
SoraのプロンプトをVeo 3.1へ移す
Soraでのプロンプトが大まかで雰囲気重視だったなら、書き方を引き締める必要があります。Veo 3.1は具体的な指示によく応えるモデルで、Googleもプロンプトへの忠実さの向上を3.1の主な改善点の1つに挙げています。Soraのプロンプトを移すときは、次の点を意識してください。
- 長いアイデアをショットに分ける。 Soraで20秒だった構想は、それぞれ主な動きを1つだけ持つ8秒のショット2〜3本になります。
- カメラワークを明記する。 「ゆっくり寄る(slow push-in)」「手持ち(handheld)」「ローアングルの追従ショット(low-angle tracking shot)」など、期待するだけでなく言葉で指定しましょう。
- 音を書く。 環境音、要となる効果音、そしてセリフがあれば引用符で囲んで列挙します。8秒の動画に収まるのはセリフ1〜2行で、スピーチは入りません。
- 見た目が重要なときは画像で固定する。 キャラクターや商品をショット間で同じに保つ必要があるなら、各ショットを同じ静止画から始めるか、参照画像を使います。
- 英語で書く。 結果が最も安定します。Googleは、英語以外の言語は十分に評価されていないとしています。
開発者の方へ: Sora APIはなくなったため、パイプラインには新しいプロバイダーが必要です。Veo 3.1はGemini APIとVertex AIで有料プレビューとして提供されており、Veo 3.1、Veo 3.1 Fast、Veo 3.1 Liteの3つのティアがあります。Veo 3(初代の3.0モデル)はGoogleのAPIで非推奨扱いになっているので、3.1をベースに構築してください。
どのVeo 3.1ティアから始めるか
GoogleはVeo 3.1を3つのティアで提供しています。どれが適しているかは、その動画をどこまで完成版に近づける必要があるかで決まります。
- Veo 3.1:最も忠実度の高いティア。最終的な編集に使うショット向けです。
- Veo 3.1 Fast:コストを抑えた日常使いのティア。このサイトでは、最大3枚の参照画像を使えるのもこのティアです。
- Veo 3.1 Lite:Googleのティアの中で最もコスト効率が高く、より多くの費用をかける前にプロンプトの下書きやアイデアの検証をするのに向いています。
元Soraユーザーにとって実用的な進め方は、Liteでプロンプトを下書きし、気に入ったものを必要な解像度でVeo 3.1で生成し直す、という流れです。
Veo VideoでVeo 3.1を使う
Veo Videoでは、Veo 3.1の3つのティアすべてを利用できます。生成される動画はすべて8秒・音声付きで、16:9または9:16、720p・1080p・4Kから選べます。入力はテキスト、または画像(任意で終了フレームも指定可)です。このサイトでは動画の延長と、4秒・6秒の長さには対応していません。新規アカウントには30クレジットが付与され、720pのVeo 3.1 Lite動画を1本作れます。本格的に移行する前に、以前のSoraのプロンプトを1つ試してみるのにちょうどよい量です。Soraの長いワンテイクに頼っていた方には、1回の生成でより長い動画を作れるMiniMax H3 Maxも使えるAI動画生成ツールがあります。
2つのモデルを機能ごとに比べたい方はVeo 3.1 vs Sora 2をご覧ください。ほかの代替候補を検討している方は、Veo 3.1 vs Kling AIとVeo 3.1 vs Grok Imagineも参考になります。
