字节豆包大模型家族加速更新、模型调用量大幅提升
核心观点与关键数据
- 字节跳动豆包大模型家族进行重大更新,新增视频、音乐、同声传译三大新成员,并优化文生图和语音合成模型。
- 截至2023年9月,豆包大模型Tokens调用量提升超过10倍,日均Tokens使用量超过1.3万亿。
- 多模态表现:日均生成图片5000万张,日均处理语音85万小时(相当于7万天广播节目时长)。
新模型发布
- 文生视频模型:发布PixelDance(采用Sora的DiT结构)和Seaweed(纯transformer结构)两个版本。
- PixelDance可生成10秒视频,支持镜头变焦、环绕、缩放等效果,指令遵循和镜头一致性能力显著提升。
- 该模型与快手的“灵之后”形成竞争,标志着字节在文生视频领域取得突破。
- 文生图模型:优化六类复杂生成任务。
- 语音合成模型:支持混合数百种音色。
发展趋势与算力需求
- 豆包大模型家族自2023年下半年开始快速迭代,涵盖文字、视频、音频、图像等领域。
- API调用量和豆包APP活跃用户数快速增长,反映算力基础设施的快速扩容。
- 研究机构看好字节后续继续扩容算力基础设施,尤其关注国产算力。
建议关注
- 国产算力相关企业:寒武纪、海光信息、华为产业链、润泽科技。