(朝闻通头条)LTX-2.5是LTX领先研究团队推出的最新开放世界视频生成模型,为媒体与娱乐、机器人、实时生成等领域的使用场景奠定基础。
该模型可生成更高质量的视频,更准确地遵循提示词,并在多次生成中保持角色、场景和声音的一致性。全新多镜头支持让创作者可生成跨越多个剪辑镜头的连续片段,且保持内容连贯性;升级后的扩散视频解码器可提升画质保真度并减少伪影。全新提示词增强器采用Gemma4 E2B和定制的Gemma4 12B文本编码器,可显著提升提示词遵循能力。全新扩散视频解码器与变分自动编码器视频解码器相辅相成,提升最终渲染视频的质量。