阿里千问这次没发论文,直接丢出了Wan3.0视频生成模型,开放公测。目标很明确:把视频生成从几秒的碎片拉进30秒一镜到底的叙事语境里。在千问创作(c.qianwen.com)和即将更新的App上,你得到的不再是零散的炫技片段,而是带分镜、有蒙太奇意图的连贯镜头。角色不会下一秒就变脸,道具不会凭空出现又消失,场景的一致性保持得相当扎实——这些在之前的生成模型里,都是硬伤。
更值得聊的是它抛出的性价比。没有天价算力门槛,没有复杂的Prompt工程训练,直接上手就能跑。这意味着短视频团队和广告创作者可以用极低的试错成本去验证一条故事线,甚至把分镜脚本实时视觉化。当生成一段30秒的完整叙事变得像现在生成一张图一样便宜,短剧的生产逻辑就会被重构:从脚本到成片的周期可能从周压缩到天。
导演级镜头控制不是噱头。Wan3.0在镜头运动、剪辑节奏上的潜力,让它更像一个迭代中的AI影像工具,而不仅仅是“生成一段视频”。当然,真正工业级的交付还有距离,但它已经踩在从玩具走向生产力的临界点上。阿里这步棋,押的是创作者手里下一块拼图。

