LTX-2.5 模型登场:AI 生成 10 秒 720P 视频仅需 6.8 秒,原生集成 ComfyUI

发布时间: 2026-08-12 文章分类: AI前沿技术
阅读量: 0
AI智能体
企业级AI智能体开发与部署
LumeValley提供全栈式企业级AI智能体开发与部署服务,涵盖战略规划、场景化开发、企业级应用构建、行业解决方案及算力支撑。从需求分析到持续优化,确保智能体高效稳定运行,助力企业实现智能化转型,提升运营效率与竞争力。

10秒720P视频,带音频,生成耗时6.8秒——不是渲染,是AI逐帧“画”出来的。LTX 这家公司刚刚把视频生成拖进了实时时代。LTX-2.5 模型直接原生集成 ComfyUI,两块 NVIDIA GB200 就能跑出这个速度,而它的 Fast 版本把成本打到了每秒0.09美元,一条10秒成片只要0.90美元。更狠的是,年收入低于1000万美元的组织,免费用。

6.8秒出片,两卡跑赢一整个渲染农场

这可不是论文里的“理论极值”

很多视频生成模型宣传时爱说“最快仅需几分钟”,实际排队加推理能拖到一杯咖啡放凉。LTX-2.5的6.8秒是端到端实测数据,从点击生成到拿到带音频的720P文件,两块 GB200 就搞定了。没什么玄学,秘诀在于 LTX 把整个推理管线极度压榨,去掉了花哨后处理,并且直接针对英伟达最新硬件做了底层算子融合。这速度意味着,你完全可以在 ComfyUI 里把 LTX-2.5 当成一个实时预览节点来用。

GB200 配 L4 推理,为什么刚好够用?

很多人以为只有 A100、H100 才配跑视频模型。LTX 展示的方案却用两张 GB200——这种 Grace Blackwell 超级芯片本身集成高性能 CPU 和高带宽内存,配合 L4 推理卡在吞吐和延迟之间找到了甜点。两块卡并非笨重的 8 卡集群,而是单节点就能部署的轻量配置。这直接把自建视频生成服务的硬件门槛拉低到中小团队也能承受的水平。你不需要申请云厂商的稀缺 GPU 实例,自己搭一台工作站,成本大约是一张高端消费显卡的价格。

实时生成,到底踩到了什么心理阈值?

视频制作有个忍耐极限:如果需要等几分钟才能看到一版草稿,创造力会被打断。降到 7 秒以下,基本等同于实时反馈。LTX-2.5 把这个时间锤进了创作者的“心流窗口”。在 ComfyUI 里连上它,你可以像调整图片提示词一样快速迭代视频:改几个字,点一下,六七秒后预览就出来了。视频内容的生产循环第一次和图片生成同样紧凑。这是从“生成视频”到“设计视频”的本质跳跃。

每秒0.09美元,带音频的视频比一杯咖啡还便宜

一条10秒成片0.90美元,这还是零售价

LTX 同步放出了 LTX-2.5 Fast 版本,专门为极致性价比调校。0.09美元每秒的标价已经包含音频生成,意味着你出一条全包短视频,花的钱还不够在星巴克买一杯大杯拿铁。对比闭源 API,Runway 等工具按点数计费,实际单秒成本经常在数美元甚至更高。更关键的是,这是公开定价,不是“试用额度”或“邀请制折扣”。任何开发者今天就能拿这个数字去做成本核算。

Fast 不是“缩水版”,而是成本控制的艺术

业界习惯把“快”与“质量差”画等号,但 LTX-2.5 Fast 没这么做。它保留了主体一致性和运动平滑度,只是降低了采样步数和分辨率上限。如果你需要的正是720P短视频——广告闪屏、社媒卡片、产品动效——Fast 模型几乎感知不到差距。LTX 用推理效率换经济性,而不是粗暴压缩质量。这给自建管线的人留了一条清晰的决策路径:预览与草稿用 Fast,终稿用标准版,成本依然低到几乎可以忽略不计。

年收入一千万美元的免费红线,瞄准了谁?

LTX 明确把免费许可划在“年度经常性收入低于1000万美元的组织”这条线上。这个数字设计得非常狡猾。初创公司、独立工作室、中小型代理商全部落入免费区间。只有真正的大厂和头部内容公司需要付费。这不仅是一次开源权的释放,更是一种市场扩张策略:先把所有潜在创作者圈进生态,等他们长到1000万美元收入时,早已深度绑定 LTX 的工作流。从这个角度看,LTX-2.5 的免费条款就是一份对闭源视频生成 API 的宣战书。

开源权重不是噱头,与 ComfyUI 原生集成才是杀招

告别云端排队,自己主机自己跑

大多数视频生成模型把权重捂在 API 后面,你永远不知道服务器在做什么。LTX-2.5 开放权重,还直接做成 ComfyUI 原生节点。你把模型文件拖进 ComfyUI 的模型目录,重启一下,就能在节点面板里看到它。没有第三方插件,没有奇怪的包装代码,就是原生的 LTX Video 节点。这意味着所有 ComfyUI 社区积累的工作流、放大、插帧、合成脚本,现在可以直接挂接到 LTX-2.5 上。开箱即用,这六个字在视频生成领域已经说了太多年,LTX 这次是真的做到了。

微调与自定义风格,黑盒 API 给不了的安全感

用 Runway 或 Pika,你的风格调校上限止步于提示词工程。想把自己的 IP 资产、特定角色、固定视觉语言融入模型?没门。LTX-2.5 把权重完整交出来,团队就可以拿自己的素材去微调。哪怕只是 LoRA 级别的轻量适配,也已经足够构建壁垒极强的品牌化视频管道。电商公司可以让模型记住自家的产品质地和光影,动画工作室能让它持续输出统一风格的角色运动。API 黑盒永远做不到这一点,而开源模型可以。

节点即用,工作流生态即将爆发

ComfyUI 的强大不在单一节点,而在节点之间的无限组合。LTX-2.5 以原生节点形式入场,意味着 ControlNet、IPAdapter、AnimateDiff 这类成熟模块很快会围绕它生长出新的适配层。想象一下:用一张静帧驱动视频,用骨骼姿态控制人物动作,用线稿引导场景变换——所有这些过去需要复杂环境才能实现的功能,现在可能只需要拖拽几条连线。ComfyUI 的社区爆发力已经多次被验证,LTX-2.5 就是这个火药桶最新的一根引信。

开源速度革命,视频生成的格局要变天

速度与成本叠加,碾压的是整个闭源管线

闭源视频生成工具过去两年建立了庞大的用户基础,靠的是先发优势和易用界面。但底层的商业逻辑正在崩塌。当开源的 LTX-2.5 在速度上快数倍,成本上低一个数量级,且免费条款覆盖绝大多数使用者,留存在收费墙背后的理由就变成了“懒得换”。任何技术栈切换都有摩擦成本,但当成本差拉到 10 倍甚至更多时,市场不可能无动于衷。广告代理商、短视频 MCN、独立游戏工作室会率先倒戈。

但商业级应用还缺什么?

要说 LTX-2.5 已经完美无缺还太早。720P 对电影级交付不够,极端复杂场景下的物体持久性也没完全解决,角色面部一致性仍需要额外加持。不过这些“硬骨头”是整个行业的共同挑战,不是 LTX 一家的短板。它的策略很务实:先把生产力端打穿,再逐步提升分辨率上限。一个模型今天能跑通广告分镜、社交素材、电商短视频,就已经吃掉了市场最大的一块蛋糕。后面的 1080P、4K,完全可以交给放大模型和后续版本。

“Stable Diffusion 时刻”真的来了吗?

2022 年 Stable Diffusion 用开放权重点燃了图像生成革命。两年后,视频生成一直没等到自己的开源引爆点。LTX-2.5 可能是最接近的一次。它集齐了三个必要条件:速度够快、成本够低、生态原生。历史不会简单重复,但经常押韵。当任何一个人用两块卡就能在几秒钟内拿到一条不赖的视频,视频内容的定义权就不再属于少数几个公司。这一次,扳机已经扣下。

AI智能体
企业级AI智能体开发与部署方案
LumeValley打造企业级AI智能体全流程方案,涵盖需求洞察、定制开发、多平台适配部署。凭借专业算法与丰富经验,确保智能体精准理解业务,高效执行任务,无缝融入企业生态,为企业数字化转型提供强劲智能引擎,提升核心竞争力。
点赞 | 78

Lumevalley——全栈AI服务领航者,以“战略-应用-算力”三位一体服务框架,为企业提供从顶层战略规划、场景化AI智能体(AI Agent)开发/搭建/部署,到企业级AI应用开发、AI+行业场景解决方案的全链路服务,并配套AI大模型部署与高性能AI算力底座支撑,助力客户在营销、服务、运营等核心环节实现效率倍增与模式创新。

马上扫码获取产品资料
相关文章

相关文章

填写以下信息, 免费获取方案报价
姓名
手机号码
企业名称
  • 建筑建材
  • 化工
  • 钢铁
  • 机械设备
  • 原材料
  • 工业
  • 环保
  • 生鲜
  • 医疗
  • 快消品
  • 农林牧渔
  • 汽车汽配
  • 橡胶
  • 工程
  • 加工
  • 仪器仪表
  • 纺织
  • 服装
  • 电子元器件
  • 物流
  • 化塑
  • 食品
  • 房地产
  • 交通运输
  • 能源
  • 印刷
  • 教育
  • 跨境电商
  • 旅游
  • 皮革
  • 3C数码
  • 金属制品
  • 批发
  • 研究和发展
  • 其他行业
需求描述
填写以下信息马上为您安排系统演示
姓名
手机号码
你的职位
企业名称

恭喜您的需求提交成功

尊敬的用户,您好!

您的需求我们已经收到,我们会为您安排专属电商商务顾问在24小时内(工作日时间)内与您取得联系,请您在此期间保持电话畅通,并且注意接听来自广州区域的来电。
感谢您的支持!

您好,我是您的专属产品顾问
扫码添加我的微信,免费体验系统
(工作日09:00 - 18:00)
电话咨询 (工作日09:00 - 18:00)
客服热线: 18011747352
售前热线: 189 2432 2993
扫码即可快速拨打热线