LTX-2.5 是 LTX 领先研究团队推出的最新开放世界视频生成模型,为媒体与娱乐、机器人、实时生成等领域的使用场景奠定基础。该模型可生成更高质量的视频,更准确地遵循提示词,并在多次生成中保持角色、场景和声音的一致性。
全新多镜头支持让创作者可生成跨越多个剪辑镜头的连续片段,且保持内容连贯性;升级后的扩散视频解码器可提升画质保真度并减少伪影。创作者还可通过生成式编辑优化现有素材,无需从头开始制作,便可更轻松地修正细节并保持精致统一的视觉效果。
全新提示词增强器采用 Gemma4 E2B 和定制的 Gemma4 12B 文本编码器,可显著提升提示词遵循能力,让创作者更精准地控制导出结果。
全新扩散视频解码器与变分自动编码器视频解码器相辅相成,通过提供第二条解码路径提升最终渲染视频的质量。
LTX-2.5 针对 NVIDIA RTX GPU、DGX Spark 进行优化,性能提升 2 倍,内存占用降低 40%。创作者可通过开箱即用的 ComfyUI 工作流,在本地使用 NVFP4、FastVideo 和 ComfyUI 优化,进行文生视频、图生视频和视频到视频生成。
查看页面了解有关 LTX-2.5 的更多详情,查看如何在 NVIDIA 硬件上进行高质量本地视频生成。
关于NVIDIA
NVIDIA是加速计算领域的全球领导者。
