根据报告,谷歌的Gemini模型进行了全面升级,包括基础大模型和多模态模型。基础大模型升级为Gemini 1.5 Pro和轻量级Gemini 1.5 Flash,支持长文本和多模态,同时实现了轻量化、低延迟和高效推理。多模态模型也有所优化,图像生成模型Imagen 3可以生成更多细节、光影丰富且干扰伪影更少的图像,视频生成模型Veo可以生成高质量的视频。Gemini全面赋能谷歌应用,包括搜索、日历、文档、幻灯片、云盘等应用,同时支持语音交互。此外,谷歌还发布了交互式场景应用Gemini Live,让用户与Gemini更加自然的交互。我们预计,具备真实世界感知的输入以及低延迟语音输出的超级智能助手将成为下一阶段行业竞争核心,谷歌的Project Astra有望推动语音交互类AI应用的落地进程,特别是在社交、游戏、教育领域。我们建议关注AI C端应用落地较快的昆仑万维、盛天网络,以及估值低位、业绩较优的游戏标的恺英网络、巨人网络。