字节发布Seedance 2.5,延续多模态音视频联合生成架构,重点突破长叙事、多模态参考和视频编辑能力。 模型支持单次生成#最长30秒视频,并支持多轮延长,能够在长视频中保持人物、场景、镜头以及音画的一致性,实现更完整的故事表达。同时,模型进一步升级多模态参考能力,#支持最多30张图片、10段视频及10段音频输入,可综合理解人物、动作、风格、场景等信息,实现更加复杂、可控的视频创作。 相比此前AI视频模型主要关注画质和单镜头生成,Seedance 2.5更加强调内容生产流程的完整性和商业化落地能力。通过时间戳精准编辑、绿幕编辑、视角调整、白模参考等能力,模型能够更好满足影视、广告、电商、游戏等专业场景需求,有望进一步降低内容制作成本,提升AI视频生产效率。 MiniMax全模态生成模型H3,侧重点更加偏向通用多模态能力建设。MiniMax H3支持文本、图像、视频、声音等多模态信息统一理解与生成,并具备原生音视频生成能力。 Seedance 2.5和MiniMax H3分别代表了AI多模态发展的两个方向: #前者聚焦视频创作工业化,通过更强的视频生成和编辑能力推动应用落地; #后者强化通用全模态能力,通过开放生态扩大模型应用范围。 随着模型能力持续提升、成本不断下降,AI应用侧有望迎来新一轮景气周期,视频生成、智能创作、内容生产等场景是重点关注方向。 AI大模型:MiniMax、智谱、阿里巴巴、腾讯控股; Token运营及垂类数据:荣信文化、易点天下、中信出版、中国科传、世纪天鸿、新华网、人民网等; AI影视内容生成与多模态内容:荣信文化、中文在线、掌阅科技、昆仑万维、华策影视、博纳影视等; 全链路AI营销+电商:易点天下、汇量科技、值得买等; AI智能体解决方案:迈富时等 风险提示:市场风险,技术风险,政策风险等