![图片[1]-LTX-2.3开源视频模型来了!ComfyUI工作流详解,文生视频+图生视频全支持,挑战Seedance 2.0的AI视频神器](https://www.mohe-sc.com/wp-content/uploads/2026/08/LTX-2.3开源视频模型来了!ComfyUI工作流详解,文生视频图生视频全支持,挑战Seedance-2.0的AI视频神器-1024x576.jpg)
这几年AI视频生成的发展速度非常快。从最初只能生成简单几秒钟的动态画面,到现在能够处理人物动作、镜头运动、环境变化以及声音,AI视频已经逐渐从“玩具”走向真正的内容生产工具。尤其是Seedance、Veo等商业模型不断提升以后,创作者对于画质、动作稳定性和音画同步的要求也越来越高。
但商业模型好用的同时,也存在积分消耗、平台限制以及工作流自由度不足等问题。对于需要大量生成视频的用户来说,每次生成都依赖在线平台并不是最理想的方案。因此,能够本地运行、可以进入ComfyUI、同时又具备较高视频质量的开源模型,一直是AI创作者关注的重点。
Lightricks推出的LTX-2.3正是在这样的背景下受到关注。它并不是简单增加几个参数,而是针对视频细节、人物竖屏表现、音频质量、图生视频稳定性以及Prompt理解进行了多方面优化。目前LTX-2.3已经原生进入ComfyUI,用户可以直接通过模板库加载官方工作流,完成文生视频和图生视频创作。
因此,社区里出现“开源青春版Seedance 2.0”这样的说法并不难理解。严格来说,它并不是Seedance 2.0的官方替代品,而是一个值得关注的开源视频生成选择。对于喜欢ComfyUI、希望自己掌控模型和工作流的用户来说,这一点尤其重要。
LTX-2.3是什么?为什么这次升级值得关注?
LTX-2.3是Lightricks推出的新一代开源音视频生成模型。官方将它定位为音视频基础模型,并通过新的潜空间和更新后的VAE改善画面细节,同时增强提示词理解、图生视频和音频生成能力。ComfyUI官方也在LTX-2.3发布后提供了原生支持。
这一代模型比较明显的变化,是它不再只是追求“能生成视频”,而是开始针对实际内容创作中的细节问题进行优化。例如人物视频中的细节表现、竖屏视频质量、运动连续性以及音频质量,都成为这次升级的重要方向。
从实际使用角度来看,LTX-2.3最大的优势并不是某一个单独功能,而是它把视频生成、音频生成和ComfyUI工作流结合得更加完整。对于已经习惯ComfyUI节点式工作流的用户来说,可以直接在熟悉的环境中调整模型、Prompt以及生成参数,而不需要完全切换到另一套软件。
LTX-2.3到底升级了什么?这几个变化最值得关注
LTX-2.3此次升级覆盖了多个影响最终成片质量的环节。官方资料显示,新版本采用了新的潜空间和更新后的VAE,在纹理细节、边缘表现以及整体画面精度方面进行了优化;同时还针对9:16竖屏视频进行了重点改进。
对于短视频创作者来说,9:16竖屏支持尤其有价值。过去很多视频模型更容易在横屏构图中发挥,而竖屏人物视频经常出现主体比例、细节和构图不稳定的问题。LTX-2.3针对Portrait Video进行了专门优化,因此在手机端视频和社交媒体内容制作方面更加实用。
| 升级方向 | LTX-2.3表现 |
|---|---|
| 视频细节 | 新潜空间与更新后的VAE,提升纹理和边缘表现 |
| 9:16竖屏 | 针对Portrait Video进行优化 |
| 音频 | 改善噪声、对白、音乐和环境声音表现 |
| 图生视频 | 运动一致性增强,减少冻结帧等问题 |
| Prompt理解 | 更准确理解复杂视频描述 |
| 文字渲染 | 视频中的文字和字母表现更加清晰 |
这些升级对于实际创作的意义在于,用户不再只是追求“生成出来”,而是开始追求“生成结果能不能直接用”。这也是开源视频模型从实验阶段逐渐走向内容生产的重要变化。
ComfyUI原生支持LTX-2.3,文生视频和图生视频都能直接使用
LTX-2.3进入ComfyUI之后,最大的变化就是工作流门槛进一步降低。ComfyUI官方已经提供LTX-2.3相关模板,用户更新ComfyUI后,可以进入Template Library,在Video分类中搜索LTX-2.3,然后根据提示下载对应模型并直接运行。
对于第一次使用LTX-2.3的用户,建议优先从官方提供的Text to Video或者Image to Video工作流开始。这样可以先确认模型、节点和显存环境都能够正常运行,再逐步加入放大、LoRA或者其他控制模块。
文生视频适合从一个创意直接开始。例如你想制作一段未来城市中的人物行走镜头,只需要把人物、环境、动作、镜头和光线描述清楚,模型就可以根据Prompt生成对应的视频。
图生视频则更适合设计师和内容创作者。你可以先通过AI绘图得到一张人物、产品或者室内效果图,再让LTX-2.3为静态画面添加动作和镜头变化。这样可以先控制第一帧的视觉效果,再利用视频模型完成动态化。
LTX-2.3 ComfyUI工作流怎么使用?
如果已经安装ComfyUI,第一步并不是马上下载大量模型,而是先将ComfyUI更新到支持LTX-2.3的版本。ComfyUI官方教程给出的基本流程是更新ComfyUI,然后进入Template Library中的Video分类,找到LTX-2.3工作流,根据提示下载所需模型,最后输入Prompt和素材开始生成。
模型方面,LTX-2.3提供完整版和蒸馏版等不同选择。官方模型仓库目前提供相应模型文件,而ComfyUI生态也支持通过Manager和工作流提示完成模型配置。不同模型版本对显存、速度和画质的要求并不相同,因此不要简单认为“显存越低就一定能跑完整版”。实际运行能力还取决于分辨率、帧数、模型格式以及工作流设置。
对于希望追求更高画质的用户,可以考虑完整模型;如果更关注速度和硬件压力,则可以考虑蒸馏模型或者FP8、GGUF等方案。社区工作流已经出现针对不同模型格式的配置,例如相关教程中就展示了BF16、FP8、GGUF以及Distilled模型的不同使用方式。
LTX-2.3提示词怎么写?不要只写“生成一个视频”
视频模型对Prompt的要求通常比静态图片更高,因为它不仅需要理解“画面是什么”,还需要理解“画面接下来怎么运动”。
一个比较实用的LTX-2.3提示词,可以围绕主体、动作、环境、镜头和声音进行描述。例如不要只输入“一个女孩走在街上”,而是进一步说明人物外观、行走方式、环境时间、灯光变化以及摄影机运动。这样模型能够获得更加明确的视觉和动态信息。
例如可以写成:
A cinematic shot of a young woman walking slowly through a futuristic city at night. Neon signs illuminate the wet street, subtle reflections appear on the pavement, her coat moves naturally with the wind. The camera follows her from behind with a slow tracking movement, realistic lighting, detailed environment, natural motion and cinematic composition.
这种写法的重点并不是堆砌大量所谓“高清、8K、顶级画质”等关键词,而是把视频真正发生的事情描述清楚。对于LTX-2.3来说,主体、动作、镜头和环境之间的关系越明确,越有利于模型理解你想要的动态过程。
提示词扩写:让简单创意变成完整的视频Prompt
如果用户不熟悉视频提示词,也可以使用提示词扩写思路。
例如最初只有一句:
一个女孩在雨夜的城市街道行走。
扩写以后,可以增加人物外观、天气、环境、动作、摄影机运动、光线以及声音,让它变成更加完整的视频描述。
这种方法特别适合ComfyUI工作流,因为提示词扩写可以作为独立模块加入生成流程。社区工作流中也出现了结合其他语言模型进行Prompt扩写的方案,让用户只输入简单创意,再自动生成更加完整的视频提示词。
需要注意的是,扩写并不意味着Prompt越长越好。真正重要的是信息之间具有逻辑关系。人物做什么、摄像机怎么看、环境如何变化、声音来自哪里,都应该围绕同一个场景展开。
低显存用户怎么玩LTX-2.3?先别急着追求最高画质
LTX-2.3虽然属于开源模型,但并不能简单理解成“所有8GB、12GB显卡都可以轻松运行完整版”。实际显存需求与模型版本、分辨率、视频长度以及工作流结构都有关系,因此低显存用户应该根据自己的硬件选择合适的模型和参数。
社区目前已经出现BF16、FP8和GGUF等不同模型格式,同时也有Distilled蒸馏模型方案。相关ComfyUI教程展示了不同模型格式和两阶段工作流的使用方式。
如果显存比较有限,更合理的思路是先降低生成分辨率和视频长度,同时选择更加节省显存的模型格式进行测试。等基础工作流稳定运行之后,再逐步增加分辨率、帧数以及后期放大模块,而不是一开始就把所有高质量选项全部打开。
另外,LTX-2.3官方说明要求宽度和高度能够被32整除,帧数则需要符合相应的8+1规则。实际使用工作流时,最好直接采用官方模板中的默认尺寸进行第一次测试,再根据需求调整。
两阶段工作流:为什么值得尝试?
如果你对视频质量要求更高,可以进一步尝试两阶段工作流。
简单来说,第一阶段负责生成基础视频内容,重点解决人物、场景和动作;第二阶段再对生成结果进行进一步处理,提高画面细节和最终输出质量。
这种思路在社区LTX-2.3工作流中已经比较常见,相关教程也展示了Single Stage、Two Stage以及结合音频和控制模块的不同工作流。
对于设计师而言,这种工作方式尤其适合室内效果图、建筑概念图和产品视觉内容。先利用图片或文字确定整体视觉方向,再通过视频阶段生成镜头运动,最后进行放大和后期处理,可以比单纯一次生成更容易控制最终效果。
LTX-2.3适合哪些AI视频创作场景?
LTX-2.3最大的优势之一,就是它能够进入不同类型的ComfyUI工作流。因此,它不仅适合普通的文生视频和图生视频,也可以继续向更复杂的内容制作流程扩展。
对于短视频创作者,可以使用9:16竖屏能力制作人物、剧情和产品内容;对于设计师,则可以将室内效果图、建筑效果图或者产品图转换成动态展示视频;对于影视和游戏创作者,还可以利用文本描述快速制作概念镜头和视觉预演。
| 创作方向 | LTX-2.3适用方式 |
|---|---|
| AI短视频 | 文生视频、图生视频、竖屏内容 |
| AI短剧 | 人物动作、场景动态和剧情镜头 |
| 电商内容 | 产品图片动态化、广告视频 |
| 室内设计 | 效果图转空间动态展示 |
| 建筑可视化 | 建筑效果图转镜头动画 |
| 游戏影视 | 概念镜头和视觉预演 |
| 音乐视频 | 音视频生成与后期工作流结合 |
对于室内设计行业来说,这类能力尤其值得关注。以前设计师完成一张效果图后,客户看到的通常只是静态画面,而通过AI视频模型,可以进一步制作空间漫游、镜头推进、材质展示等动态内容,让设计方案的展示方式从“看一张图”进一步变成“观看一个空间”。
LTX-2.3和Seedance 2.0是什么关系?
“开源青春版Seedance 2.0”更多是社区为了方便理解而使用的称呼,并不意味着LTX-2.3与Seedance 2.0属于同一个模型或者具备完全相同的能力。
Seedance属于商业视频生成路线,而LTX-2.3最大的特点是开放模型、ComfyUI生态以及本地工作流能力。两者在产品定位和使用方式上存在明显区别。
因此,如果你追求的是在线平台直接生成和极低操作门槛,那么商业视频模型仍然具有优势;如果你更关注模型开放程度、工作流控制、参数调整以及本地创作,那么LTX-2.3就非常值得尝试。
总结:LTX-2.3真正值得关注的是“开源+工作流”
LTX-2.3这次升级并不是单纯把视频画质提高一点,而是从细节表现、9:16竖屏、音频质量、图生视频稳定性以及Prompt理解等多个方面进行优化。再加上ComfyUI原生支持,用户可以直接通过官方模板开始文生视频和图生视频创作,这让开源AI视频的使用门槛进一步降低。
对于普通创作者来说,LTX-2.3最大的价值在于提供了一条更加开放的视频创作路线。你可以使用文字生成视频,也可以先生成一张效果图再进行图生视频,还可以继续叠加LoRA、控制模块、放大以及其他ComfyUI节点,把模型逐渐变成符合自己需求的定制工作流。
如果你一直在寻找一个能够本地运行、支持ComfyUI、同时具备文生视频和图生视频能力的开源方案,那么LTX-2.3确实值得加入你的工作流库。它未必能够简单替代所有商业视频模型,但随着模型、工作流和社区生态继续完善,开源AI视频正在越来越接近真正的生产工具。






![年底收官巨献,AIGC行业全平台设计工具网站正式上线,助力创作者突破创作瓶颈,开启高效创作之旅[已下线]-MOHE素材库-设计行业的乐园,各类素材的矿山!](https://www.mohe-sc.com/wp-content/uploads/2024/12/Ai.turnfish.top_-800x450.jpg)
![百度网盘直链解析彻底解除百度云限速限制[利用IDM工具在线解析网页版]-MOHE素材库-设计行业的乐园,各类素材的矿山!](http://mohe-sc.com/wp-content/uploads/2021/07/baiduwangpan-400x273.png)
![关于本站启用[注册邀请码]的说明-MOHE素材库-设计行业的乐园,各类素材的矿山!](https://www.mohe-sc.com/wp-content/uploads/2022/10/2023_09xI0Dxg_-800x448.png)







暂无评论内容