8月初,字节跳动发布了视频生成模型Seedance 2.5,最显著的变化是单次视频生成时长提升到了30秒。
30秒这个数字放在一年前是不可想象的。2024年大部分视频生成模型还停留在几秒到十秒的区间,生成的画面虽然看起来不错,但时长太短,很难用于实际的视频制作流程。
Seedance 2.5把时长拉到30秒,意味着AI生成的视频开始接近实际使用的门槛。一条短视频广告、一个产品展示动画、一段社交媒体内容,30秒基本够用了。
字节跳动在视频生成领域的投入一直比较坚决。他们有抖音这个全球最大的短视频平台,对视频内容的理解和数据积累有天然优势。Seedance系列从早期版本到2.5,生成质量和时长的进步速度在同类产品中属于第一梯队。
视频生成模型目前面临的挑战主要在几个方面。一是时序一致性,长视频里人物、物体的外观和动作能不能保持稳定。二是物理合理性,生成的画面里物体的运动是否符合物理规律。三是可控性,用户能不能精确控制视频的内容和风格。
从几秒到30秒,不仅仅是时长数字的变化,背后是模型在时序建模和一致性控制方面的技术进步。当然,30秒的视频质量到底如何,还需要看实际生成的效果。
视频生成是目前AI领域竞争最激烈的赛道之一。OpenAI的Sora、Google的Veo、快手的可灵都在这个方向上持续投入。字节跳动通过Seedance 2.5表明了自己在这个赛道上的位置,接下来就要看市场反馈和实际应用场景的拓展了。
申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!
