模型发布

LTX-2.5 接入 ComfyUI:10 秒 720P 视频为何能压缩到 6.8 秒?

LTX-2.5 原生接入 ComfyUI,报道显示其在两张英伟达 GB200 上生成 10 秒 720P 视频用时 6.8 秒;LTX-2.5 Fast 还提供音频生成与按秒计费方案。本文分析其对创作者、开发者和中文用户的工作流影响。

本文基于官方公告、公开资料和行业讨论整理,重要事实建议以原文和官方更新为准。
LTX-2.5 接入 ComfyUI:10 秒 720P 视频为何能压缩到 6.8 秒?

据 AI快讯转引的 IT之家 RSS 消息,LTX 推出 LTX-2.5,并将其原生接入 ComfyUI。报道给出的特定配置是两张英伟达 GB200:生成 10 秒、720P 视频只需 6.8 秒。这不是一次普通版本号更新,而是把实时预览、快速迭代和生成式工作流拉到同一张桌面上。

模型之外,LTX 还把音频能力放进产品叙事。LTX-2.5 Fast 按每秒 0.09 美元计算,10 秒 720P 片段为 0.90 美元;年度经常性收入低于 1,000 万美元的组织可免费使用。价格表很直接,但硬件门槛和资格条件同样不能忽略。

速度数字意味着什么

  1. 8 秒的数字最吸引人,但必须按上下文理解:它对应 10 秒、720P 和两张 GB200,并不等于所有电脑都能达到这个速度。速度优势真正有用的地方,是减少试错等待,而不是替代最终制作。

过去做视频原型,创作者往往要等待成片才能判断镜头、节奏和提示词是否有效。若生成时间低于成片时长,工作流就能从“提交—等待”变成“修改—再看—再改”,这对脚本验证、分镜讨论和广告概念测试都很实际。

ComfyUI 对开发者和创作者的价值

对开发者而言,ComfyUI 的原生集成比单纯提供一个网页入口更值得看。前者更方便把模型放入节点化流程,继续连接素材管理、提示词复用、批量生成和后期处理等环节。能否形成稳定、可复现的节点工作流,将决定它究竟是演示工具,还是能进入团队流程的生产组件。

创作者还要关注画面质量、角色一致性、动作连续性和音画同步,而不仅是单次生成耗时。10 秒短片适合先验证想法,但若要扩展到更长的叙事、商业交付或多镜头项目,镜头之间的连续性、失败重试率以及后期修改空间都会影响总成本。

中文用户应该先算清什么

中文用户首先要算清三件事:自己是否真的需要本地部署,团队能否获得两张 GB200 级别的算力,以及免费资格是否适用于自己的组织。对于个人用户,0.09 美元每秒看起来不贵;若反复迭代几十次,累积费用仍应先做小规模测试,而不是只看单条视频标价。

如果团队已经在使用 ComfyUI,可以优先观察 LTX-2.5 的节点兼容性、显存占用、批量任务表现和音频导出方式。暂时没有专业显卡的人,则更适合先确认云端方案、排队时间和数据处理位置,再决定是否把日常创作迁入这一流程。

后续观察点不应停留在报道中的 6.8 秒。模型在普通消费级显卡上的表现、长片段的稳定性、ComfyUI 工作流是否容易维护,以及免费使用的具体限制,都会决定 LTX-2.5 能否从性能新闻变成持续使用的工具。

从产品路线看,LTX-2.5 抓住的是生成视频最现实的矛盾:质量需要时间,创作者又需要尽快试错。它未必适合所有生产任务,却为快速原型和团队协作提供了一个明确的比较基准。下一次看 LTX,不只要问“生成多快”,还要问“改起来有多稳、交付还剩多少工作”。

同主题阅读路径

查看「模型发布」栏目
继续比较相关工具

读完文章后,如果你想继续筛选 AI 工具,可以从真实使用场景开始做横向比较。

查看 AI 工具