玫瑰MiniMax拟发布M3.1及M3 Pro。M3.1预计是M3优化;M3 Pro预计2.7T大参数,沿用MSA架构。M3已验证MSA在长上下文下显著降低Attention计算量,M3 Pro验证更大规模Scaling,推理效率及Token成本,即“高性能+低成本”的技术路线能否继续向超大模型延伸。
玫瑰Minimax H3将全模态、开源、低成本三条路线整合。H3推动模型权重开源,将视频模型从封闭API能力变成开发者可部署、可微调、可二次开发的基础模型,扩大开发者生态及企业私有化部署场景。视频模型相比LLM对推理算力更加敏感,低成本有望推动视频生成更规模化走向商业场景。
玫瑰算力侧,公司自建/自持卡并推进国产算力适配,从算法降本进一步延伸至基础设施降本,有望强化算力供给稳定性及单位Token成本优势。
Minimax当前估值仍有明显性价比,M3 Pro上线,H3生态扩大,效率提升等多点均有超预期可能,推荐持续关注。
详情联系:林起贤/任梦妮18616267592
玫瑰MiniMax拟发布M3.1及M3 Pro。M3.1预计是M3优化;M3 Pro预计2.7T大参数,沿用MSA架构。M3已验证MSA在长上下文下显著降低Attention计算量,M3 Pro验证更大规模Scaling,推理效率及Token成本,即“高性能+低成本”的技术路线能否继续向超大模型延伸。
玫瑰Minimax H3将全模态、开源、低成本三条路线整合。H3推动模型权重开源,将视频模型从封闭API能力变成开发者可部署、可微调、可二次开发的基础模型,扩大开发者生态及企业私有化部署场景。视频模型相比LLM对推理算力更加敏感,低成本有望推动视频生成更规模化走向商业场景。
玫瑰算力侧,公司自建/自持卡并推进国产算力适配,从算法降本进一步延伸至基础设施降本,有望强化算力供给稳定性及单位Token成本优势。
Minimax当前估值仍有明显性价比,M3 Pro上线,H3生态扩大,效率提升等多点均有超预期可能,推荐持续关注。
详情联系:林起贤/任梦妮18616267592