事项:2025年1月15日至1月20日,科大讯飞、月之暗面、MiniMax等五家大模型公司发布最新一代模型,在语音交互、长文本理解、推理能力等方面取得突破性创新,对标海外OpenAI系列,刷新SOTA,加入全球大模型前沿阵营,展现国内大模型快速迭代的追赶态势,国内外模型水平差距正不断缩小。
评论:
-
豆包大模型1.5效果领先,性能表现卓越:
- 全新Doubao-1.5-pro模型综合能力显著增强,综合得分优于GPT-4o、Claude 3.5 Sonnet等业界一流模型,达到全球领先水平。
- 在知识、代码、推理、中文等多个权威测评基准上获得最佳成绩。
- 豆包实时语音大模型突破真人级语音对话能力限制,整体满意度更高。
- 轻量版语言模型Doubao-1.5-lite和视觉理解模型Doubao-1.5-vision-pro同样处于全球一流水平。
-
DeepSeek-R1性能显著上升,API成本更低:
- 模型推理能力提升,在数学、代码、自然语言推理等任务上性能比肩OpenAI o1正式版。
- 团队开源模型权重,License使用MIT,明确可“模型蒸馏”,输出蒸馏小模型在多项能力上对标OpenAI o1-mini。
- API服务定价为每百万输入tokens 1元(缓存命中)/ 4元(缓存未命中),每百万输出tokens 16元,性价比显著上升。
-
Kimi k1.5模型刷新SOTA,性能大幅增加:
- 多模态思考模型推理能力显著增强,short-CoT模式下数学、代码、视觉多模态和通用能力领先GPT-4o和Claude 3.5 Sonnet 550%。
- long-CoT模式下数学、代码、多模态推理能力达到OpenAI o1正式版水平。
-
讯飞星火大模型迎来全面升级:
- 首个基于全国产算力平台训练的深度思考和推理大模型,攻克国产算力训练深度推理模型难关,实现多学段数学能力国内第一。
- 讯飞星火4.0 Turbo底座全新升级,七大核心能力全面上升,对标GPT-4o,并首发混域知识搜索技术。
- 星火语音同传大模型成为国内首个具有端到端语音同传能力的模型,效果超过国外主流大模型,最快可实现5秒以内的同传时延。
-
MiniMax模型架构取得突破性创新:
- MiniMax-Text-01和MiniMax-VL-01首次大规模实现新的线性注意力机制,输入上下文窗口大幅增长至400万token,是其他模型的20-32倍。
- 模型长文本能力和学术测试集表现强劲,整体可与其他SOTA模型媲美。
投资建议:
- AI大模型本质应落脚垂类应用,国内大模型正快速追赶美国先进水平,看好AI+应用产品力与商业化落地进程。
- 建议关注AI+应用侧(安全、办公、法律、医疗、教育、金融、邮箱、传媒、数据、电商、OA、ERP)和算力侧(算力基础、服务器)相关标的。
风险提示:
- 商业化后表现不及预期,用户付费意愿低,行业技术迭代速度较快。