OpenAI与谷歌AI技术创新概览
OpenAI Sora模型亮点:
- 视频生成长度:Sora模型可生成1分钟长度的视频,远超竞品。
- 3D空间一致性:支持动态镜头运动,人物和场景元素在三维空间中保持连贯运动。
- 长期连续性和物体持久性:能有效处理长期依赖关系,即使对象短暂离镜,也能保持不变。
- 视频扩展与连接:能向前或向后扩展视频,以及连接不同主题的视频,用于长视频制作。
- 模拟数字世界:能够模拟人工过程,如控制游戏内角色。
AIGC与算力需求:
- Sora模型技术:基于扩散模型,使用transformer架构,将视频和图像表示为Patch,类似GPT中的token。
- 算力需求:Sora暂未开放使用,可能受限于算力瓶颈;AIGC技术应用将大幅提升视频创作效率,推动算力需求激增。
谷歌Gemini1.5 Pro特性:
- 上下文长度:支持高达100万个token的上下文窗口,处理大量信息。
- 多模态能力:支持文本、代码、图像、音频和视频处理,展现强大理解与推理能力。
- 性能提升:相较于前代,Gemini 1.5 Pro在多种评估中表现更优,尤其是在LLM基准测试中。
投资建议与风险提示:
- 算力侧:推荐关注中科曙光、浪潮信息等算力硬件供应商。
- 映射应用:考虑万兴科技、大华股份等受益于AI应用的企业。
- 风险提示:
- 技术迭代不及预期风险。
- 经济下行超预期风险。
- 行业竞争加剧风险。
此概览总结了OpenAI的Sora模型创新点,AIGC应用对算力的需求增长,以及谷歌Gemini1.5 Pro的技术优势,同时提供了相应的投资建议与风险考量。