Sora

★★★★★ 4.7 分

OpenAI 的视频生成旗舰,复杂物理与镜头叙事能力强,定义了 2024 年文生视频的标杆。

文生视频闭源OpenAI旗舰
参数量Sora(闭源 API / 网页)
模型类型文生视频大模型(闭源)
许可证闭源订阅制
开发者OpenAI
★★★★★ 4.7

OpenAI 世界模拟旗舰,Sora 2 开启视频物理一致性新阶段

视频生成闭源世界模型音画同步

模型介绍

Sora 是 OpenAI 的视频生成旗舰:2024 年 2 月首秀以长镜头稳定性惊艳业界,同年 12 月上线 Sora Turbo。2025 年 9 月 30 日发布 Sora 2,支持同步对白与音效、多镜头世界状态保持与精准物理建模,被称为「GPT-3.5 视频时刻」,并推出多风格与 Cameo 角色植入。注意:2026 年 4 月 26 日起 Sora 独立产品与 App 下线,能力并入 ChatGPT,API 亦计划于 2026 年 9 月停用。

模型基本信息

开发机构OpenAI
模型版本Sora(2024 首秀)/ Sora Turbo / Sora 2 / Sora 2 Pro
参数规模未公开(闭源)
模型类型文生视频 / 图生视频 + 音画一体生成
许可证闭源(OpenAI 平台订阅服务)
上下文长度N/A(视频)
发布日期2024-02(首秀);2025-09-30(Sora 2)
模型架构未公开(DiT 级扩散世界模型,官方未披露细节)

模型能力

中文能力强
英文能力很强
代码能力N/A
推理能力N/A
长文本能力N/A(视频多镜头世界保持能力见 vision)
视觉能力文生视频 + 图生视频 + 音画同步 + 角色横跳
工具调用N/A

模型版本

Sora / Sora Turbo闭源Sora 2闭源(旗舰)Sora 2 Pro闭源(实验性高质版)

模型获取

部署方式

ChatGPT 平台(Sora 独立产品已下线)OpenAI API(将停止)

推荐配置

入门ChatGPT 内免费/轻量额度试用 Sora 2
进阶ChatGPT Plus/Pro 会员加大生成额度
专业API 批量接入(留意服务下架时间)

为什么选择这个模型

  • 物理一致性与世界状态保持业界最强
  • 原生音画同步,对白/音效/环境声一体生成
  • 多镜头、跨场景保持同一世界与角色
  • 多风格(真实电影感、动漫等)覆盖广

模型优点

  • 物理建模准(含失败结果建模)
  • 音画同步为行业首发级能力
  • Cameo 角色植入体验新颖
  • 指令遵循度高,可分镜叙事

模型缺点

  • 独立产品 2026-04 已下线,入口受限
  • API 计划于 2026-09 停用,长期壁垒
  • 生成额度由平台控制,免费额度有限
  • 闭源,无法本地部署或微调

适合场景

  • 追求顶级物理真实感的世界模拟
  • 带声音的电影级短片与分镜预演
  • 需要角色一致性与多镜头叙事的创作
  • 接入 ChatGPT 工作流的内容创作者

不适合场景

  • 依赖 sora.com 独立产品的历史工作流
  • 本地/离网与私有数据场景
  • 预算有限的批量生成需求

部署教程

vLLM
Sora 为闭源云端服务,无本地部署。使用方式:通过 ChatGPT 对话或 OpenAI 平台调用 Sora 2 生成视频与音频;注意独立 Sora App/Web 已于 2026 年 4 月下线,请以 OpenAI 官方说明为准

智算工坊实验室

实测速度云端生成,视额度与负载而定
显存占用不适用(云端)
功耗不适用(云端)
不同 GPU 对比不适用,无需本地显卡

常见问题 FAQ

现在还能用 Sora 吗?

独立 Sora 产品/App 已于 2026-04-26 下线,视频与图像生成能力并入 ChatGPT;API 计划于 2026-09-24 停用。请以 OpenAI 官方页面为准。

Sora 2 强在哪?

物理建模(失败结果也符合力学)、多镜头世界状态保持与音画同步,配合多风格与角色植入,综合能力领先,OpenAI 称之为「GPT-3.5 视频时刻」。

Sora 2 和可灵怎么选?

追求尖端物理与音画偏好 Sora 2;中文创作、图生视频与落地成本综合看可灵更实用。

相关模型

数据来源

  • https://openai.com/index/sora-2/
  • https://help.openai.com/en/articles/20001152-what-to-know-about-the-sora-discontinuation