OpenAI发布Sora,AI视频生成能力实现跨越式发展,模型强大的视频生成能力推高行业天花板,产业赋能的深度和广度有望超预期拓展。Sora模型通过文本描述生成60秒长视频,还可以对视频色彩风格等要素精确理解,创造出人物表情丰富、情感生动的视频内容。Sora尚未对公众全面开放,仅邀请部分测试者进行体验,但是OpenAI CEO在社交平台上展示了由网友提供文本描述生成的视频案例,展现了Sora在视频生成方面的强大能力。Sora三大亮点突出,实现AIGC领域的里程碑式进展。Sora可以保持视频主体与背景的高度流畅性与稳定性,单视频多角度镜头,Sora在一个视频内实现多角度镜头,分镜切换符合逻辑且十分流畅,再是理解真实世界的能力,Sora对于光影反射、运动方式、镜头移动等细节处理得十分优秀,极大地提升了真实感。Sora的技术基础保障了强大功能的持续迭代。Sora是一种Diffusion模型,同时具备良好的扩展性。Sora使用DALL·E 3的Recaption技术,使视频可以更符合文本指令,此外还具备静图生视频、原视频拓展补帧等能力。OpenAI表示Sora是构建世界模型的基础,未来将向实现AGI继续迈进,我们认为该模型的当前表现展现出了这种潜力。