火山引擎旗下围绕火山方舟大模型服务平台搭建了丰富的豆包大模型产品矩阵,覆盖不同场景、不同性能需求,核心相关的火山系模型及配套能力可以梳理为以下几类:
一、Doubao-Seed 1.6系列模型
这是火山方舟2025年11月推出的多模态深度思考模型家族,支持手动开关深度思考能力:
- doubao-seed-1.6:非思考模式下能力对比1.5代大幅提升,上下文窗口256k,输入长度224k,支持配置最大回答32K,或最大输出(回答+思维链)64k,支持图文、视频理解 【1】 。
- doubao-seed-1.6-flash:主打高推理速度,文本处理、视频理解能力超过1.5代lite系列模型,上下文窗口256k,输入长度224k,支持配置最大回答32K,或最大输出(回答+思维链)64k,支持图文、视频理解 【1】 。
- doubao-seed-1.6-thinking:大幅强化思考能力,编程、数学、逻辑推理能力进一步提升,新支持视觉理解,上下文窗口256k,输入长度224k,支持配置最大回答16k,支持图文、视频理解 【1】 。
- 豆包大模型1.6lite:轻量化高性价比模型,效果超越豆包大模型1.5pro,企业级场景测评表现提升14%,0-32k输入区间综合使用成本较豆包1.5pro降低53.3%;低思考长度模式下,总输出Tokens比旧版单一思考模式下降77.5%、思考时间下降84.6%,效果保持不变 【11】 。
二、豆包通用主力模型
- 豆包通用模型pro:火山引擎的旗舰通用大模型,2024年升级后能力对齐GPT-4o,使用价格仅为后者的1/8,32k版推理输入价格仅为0.0008元/千tokens;企业生产环境落地时最高支持10kRPM和800kTPM,还可根据需求进一步扩容 【2】 【4】 【10】 。
- 豆包大模型1.8:2025年底推出的迭代版本,工具调用、复杂指令遵循、OS Agent能力大幅增强,复杂任务规划执行能力显著提升;多模态理解能力升级,单次视频理解帧数从640帧提升至1280帧,支持低帧率理解超长视频,视频运动理解、复杂空间理解、文档结构化解析能力也同步优化,可广泛应用于在线教育、安全巡检、产品质检等场景 【8】 。
三、垂直场景专项模型
火山引擎还布局了大量面向细分场景的专用模型,覆盖多模态生成、语音处理等多个领域:
- 生成类模型:豆包3D生成模型(和数字孪生平台veOmniverse结合可完成智能训练、数据合成、数字资产制作)、豆包文生图模型2.1(业界首次实现精准生成汉字和一句话P图的产品化能力,已接入即梦AI和豆包App)、豆包图生图模型、豆包音乐模型4.0(可生成3分钟完整音乐作品,支持全曲生成、局部修改、曲风连贯)、豆包视觉理解模型等 【4】 【7】 【15】 。
- 语音交互类模型:豆包同声传译模型、豆包语音识别模型、豆包语音合成模型、豆包声音复刻模型等 【7】 。
- 功能工具类模型:豆包角色扮演模型、豆包Function Call模型、豆包向量化模型等 【7】 。
四、配套落地支撑能力
火山引擎通过火山方舟大模型服务平台为这些模型提供全链路保障:既可以提供瞬时可用、极致弹性的海量算力资源,也搭建了覆盖身份认证、数据保密、环境隔离、操作可审计的全周期安全可信方案,还配套了大模型生态广场的各类MCP工具接口,帮助企业快速把火山系大模型落地到生产场景中 【2】 【3】 【14】 。