
简要版本: 本文 3 月首次发布时提到的 OpenAI 停服计划,现在已经全部完成。OpenAI 于 2026 年 3 月 24 日宣布停止 Sora 服务。Sora App 和网站在 2026 年 4 月 26 日关闭,Sora 2 模型和 OpenAI 的 Videos API 在 2026 年 9 月 24 日下线。OpenAI 的开发者文档目前写明:没有一对一的替代 API。如果你之前用 Sora 做视频,现在需要换一个工具;而对大多数 Sora 工作流来说,Google 的 Veo 3.1 是最接近的选择:它同样能根据提示词或图片同时生成画面和声音,还增加了 Sora 从未提供过的帧控制和参考图控制。
本文会讲清停服时间线、你会失去什么、Veo 3.1 在哪些地方可以直接替代、在哪些地方不行,以及如何调整你的提示词。
Sora 2 发生了什么
OpenAI 于 2025 年 9 月 30 日发布 Sora 2,同时推出了 Sora 社交 App。OpenAI 主打的是物理真实感(比如投篮没进,球会从篮筐弹开,而不是“瞬移”进篮筐),以及同步生成的对白和音效。App 里的 Cameo(客串) 功能让用户只需录制一次自己,就能带着自己的声音出现在生成的场景里。2025 年 10 月,OpenAI 把所有用户的单段时长上限提高到 15 秒,网页端 Pro 用户提高到 25 秒,并为 Pro 用户加入了 Storyboards(故事板)。
停服是分阶段进行的:
| 日期 | 变化 |
|---|---|
| 2026 年 3 月 24 日 | OpenAI 宣布在 App 和 API 中停止 Sora 服务,并通知 API 开发者 |
| 2026 年 4 月 26 日 | Sora 网页端和 App 停止服务 |
| 2026 年 9 月 24 日 | sora-2、sora-2-pro 和 Videos API 下线 |
来源:OpenAI 的 API 弃用页面和 Sora 2 模型页面,以及 OpenAI 帮助中心关于 Sora 停服的文章(核对日期:2026 年 9 月 28 日)。
Sora 用户会失去什么
先弄清楚 Sora 到底好用在哪里,才能知道下一步该找什么:
- 带声音的文生视频和图生视频。 Sora 2 会和画面一起生成对白、音效和环境声。
- 更长的单段视频。 App 内所有人最长 15 秒,网页端 Pro 用户最长 25 秒。
- Storyboards(故事板),可以逐个镜头规划一段视频(Pro)。
- Cameo(客串),把你自己的脸和声音放进场景。
- 物理真实感,这是 OpenAI 重点宣传的特性。
- API 访问,通过
sora-2(720p)和sora-2-pro(最高 1080p),支持竖屏或横屏。
没有哪一个替代品能全部覆盖。尤其是 Cameo 这种把自己放进画面的功能,Veo 3.1 没有直接对应的能力,而且 Google 的安全过滤器会限制根据照片生成真实人物。
为什么 Veo 3.1 是最接近的替代品
Veo 3.1 由 Google DeepMind 于 2025 年 10 月 15 日发布,2026 年 1 月更新。根据 Google 的 Gemini API 文档 和 OpenAI 的模型页面,下表对比它与 Sora 2 提供的能力:
| Veo 3.1(Google) | Sora 2(停服前) | |
|---|---|---|
| 状态 | 可在 Gemini App、Flow、Gemini API 和 Vertex AI 中使用 | App 于 2026 年 4 月 26 日关闭;API 于 2026 年 9 月 24 日关闭 |
| 原生音频 | 有,始终开启 | 有 |
| 单段时长 | 4、6 或 8 秒 | 最长 15 秒(网页端 Pro 为 25 秒) |
| 更长的序列 | 延长:每次 +7 秒,720p 下总长最多约 148 秒 | —(Storyboards 用于镜头规划) |
| 分辨率 | 720p、1080p、4K | 720p(sora-2),最高 1080p(sora-2-pro) |
| 画面比例 | 16:9、9:16 | 横屏、竖屏 |
| 从图片开始 | 支持 | 支持 |
| 首尾帧 | 支持 | 不支持 |
| 参考图 | 最多 3 张(Veo 3.1 和 Veo 3.1 Fast) | Cameo(录制的本人形象) |
Veo 3.1 持平或更进一步的地方: 声音与画面一起生成;分辨率上限更高(Google 说明其 1080p 和 4K 输出是放大得到的);支持竖屏和横屏;还有更多方式固定镜头:一张起始图、一张可选的结束图,或最多三张参考图,用来保持角色或产品一致。
需要调整的地方: 单段视频更短。Sora 可以一次生成 15 到 25 秒;Veo 3.1 每段最长 8 秒。想要更长,可以在 Google 自家工具里延长视频,或者把几段视频剪在一起。如果你的 Sora 视频大多是单个长镜头,那就改为按一组短镜头来规划。
把 Sora 提示词迁移到 Veo 3.1
如果你的 Sora 提示词比较松散、以氛围为主,迁移时要写得更紧凑:指令越具体,Veo 3.1 的效果越好,Google 也把更强的提示词遵循列为 3.1 的主要改进之一。迁移一条 Sora 提示词时:
- 把长创意拆成镜头。 一个 20 秒的 Sora 构思,变成两到三个 8 秒镜头,每个镜头只有一个主要动作。
- 写明镜头。 “缓慢推近”“手持”“低角度跟拍”,直接写出来,而不是指望模型自己猜到。
- 写出声音。 列出环境声、关键音效,并把台词放在引号里。8 秒的视频只装得下一两句对白,装不下一段演讲。
- 外观重要时,用图片固定。 如果某个角色或产品必须在多个镜头里保持一致,就让每个镜头都从同一张静帧开始,或者使用参考图。
- 用英文写提示词,结果最可预期;Google 表示其他语言尚未经过完整评估。
给开发者: Sora API 已经下线,流水线需要换一个服务商。Veo 3.1 以付费预览的形式通过 Gemini API 和 Vertex AI 提供,分 Veo 3.1、Veo 3.1 Fast 和 Veo 3.1 Lite 三档。Veo 3(最初的 3.0 模型)在 Google API 中已被标记为弃用,所以请基于 3.1 构建。
先从哪一档 Veo 3.1 开始
Google 提供三档 Veo 3.1,选哪一档取决于这段视频需要多接近成片:
- Veo 3.1:保真度最高的一档,用于要放进最终剪辑的镜头。
- Veo 3.1 Fast:成本更低的日常档位;在本站,它也是唯一支持最多三张参考图的档位。
- Veo 3.1 Lite:Google 性价比最高的一档,适合在花更多钱之前打磨提示词、测试想法。
给前 Sora 用户的一个实用流程:先用 Lite 打磨提示词,再把满意的版本用 Veo 3.1 按你需要的分辨率重新生成。
在 Veo Video 上使用 Veo 3.1
Veo Video 提供全部三档 Veo 3.1。每次生成一段带声音的 8 秒视频,可选 16:9 或 9:16,分辨率 720p、1080p 或 4K,输入可以是文字,也可以是图片(可另加结束帧)。本站不提供视频延长,也不提供 4 秒或 6 秒时长。新账户可获得 30 积分,足够生成一段 720p 的 Veo 3.1 Lite 视频,正好可以在正式投入前,拿一条你以前的 Sora 提示词试一试。如果你以前依赖 Sora 的长镜头,AI 视频生成器 还提供 MiniMax H3 Max,可以一次生成更长的视频。
想逐项对比这两个模型,请阅读 Veo 3.1 对比 Sora 2。如果你还在考虑其他替代品,可以看看 Veo 3.1 对比 Kling AI 和 Veo 3.1 对比 Grok Imagine。
