主打速度的开源视频模型,2B 在 RTX 4090 近实时出片
模型介绍
LTX-Video 是 Lightricks 2024 年 11 月开源的高速视频生成模型,以「快」为核心卖点。通过视频自蒸馏技术,2B 版仅需少量采样步数即可生成 24fps、可长达数十秒的运动视频,在 RTX 4090 上接近实时出片。基于 DiT + VAE 架构同时支持文生视频与图生视频,提供 2B(0.9.x)与 13B(0.9.7/0.9.8)两个规模:2B 追求速度,13B 追求画质。权重以开放许可发布,已集成进 ComfyUI 与 Diffusers。
模型基本信息
开发机构Lightricks
模型版本LTX-Video 0.9.x 系列(2B / 13B / 蒸馏版)
参数规模2B(0.9.x)/ 13B(0.9.7+)
模型类型文生视频 / 图生视频扩散模型
许可证LTX-Video Open Weights License(开放权重)
上下文长度N/A(视频)
发布日期2024-11(v0.9)
模型架构DiT + 视频 VAE(自蒸馏,24fps)
模型能力
中文能力一般(以英文提示为主)
英文能力强
代码能力N/A
推理能力N/A
长文本能力N/A
视觉能力文生视频 + 图生视频
工具调用N/A
模型版本
LTXV-2B 0.9.x2B(含蒸馏版)LTXV-13B 0.9.7/0.9.813B(dev / distorted)Spatial / Temporal Upscaler配套超分模型
模型获取
部署方式
DiffusersComfyUI(官方原生支持)官方推理脚本
显存需求
2B BF16约5GB
13B BF16约26GB
13B FP8约14GB(RTX 4090 可跑)
硬件推荐
RTX 3060可跑 2B,几乎实时
RTX 3090可跑 2B 流畅 / 13B 量化
RTX 409013B FP8 主力选择
RTX 509013B 原生流畅
MacM 系列可跑 2B,速度一般
推荐配置
入门RTX 3060 + 2B 蒸馏版
进阶RTX 4090 + 13B FP8
专业多卡渲染长视频 + 超分模型后处理
为什么选择这个模型
- 速度极快,2B 在 4090 上接近实时
- 蒸馏版少步数出片,迭代成本低
- 同时覆盖文生视频与图生视频
- 2B 到 13B 两种规格可选
模型优点
- 出片速度快,适合批量试验
- 支持长时生成(多秒至更长)
- ComfyUI 官方集成,开箱即用
- 低显存(2B)也可流畅运行
- 开源权重可本地二次创作
模型缺点
- 画质/物理真实性与第一梯队有差距
- 中文提示支持一般
- 13B 版消费级需量化
- 生态与教程相对小众
适合场景
- 追求快速出片的短视频、表情包制作
- 图生视频动画化
- 低显存(8GB)用户的本地视频体验
- 批量生成与迭代测试
不适合场景
- 对物理真实与电影质感要求苛刻的商用
- 重度中文提示词工作流
- 需要成熟 LoRA 大生态的项目
部署教程
vLLM
视频模型一般不走 vLLM。推荐 ComfyUI:LTX-Video 已被官方 ComfyUI 支持,下载 2B/13B 的 safetensors 放入 ComfyUI/models,套用官方 LTX-Video 工作流(选蒸馏版可大量减少采样步数)即可快速出片
智算工坊实验室
实测速度5秒片段约30-90秒(RTX 4090,2B 蒸馏)
显存占用约5GB(2B)/ 约14GB(13B FP8)
功耗整机约300-400W
不同 GPU 对比3060 即可玩 2B;越新显卡速度越接近实时
常见问题 FAQ
2B 和 13B 怎么选?
2B 主打速度与低显存(RTX 3060 即可跑),出片快但精度一般;13B 画质、运动与提示遵循度明显更好,推荐 24GB 显存 + FP8 量化。
怎么做到那么快?
通过视频自蒸馏减少采样步数,蒸馏版几步即可出片;配合高效的 VAE 与 DiT 实现接近实时的生成,这是 LTX-Video 的核心竞争力。
可以商用吗?
遵循 LTX-Video Open Weights License,允许在满足协议条款(如合规使用、保留声明)的前提下使用与应用,商用前请阅读随附 LICENSE。
相关模型
相关工具
相关硬件
相关文章
数据来源
- https://huggingface.co/Lightricks/LTX-Video
- https://github.com/Lightricks/LTX-Video
- https://www.lightricks.com/ltxv