Meta于4月5日发布了机器视觉领域首个用于图像分割的通用大模型——Segment Anything Model (SAM)及其训练数据集Segment Anything 1-Billion (SA-1B),并将之开源,以促进机器视觉领域的研究。SAM是首个通过提示(prompt)方式应用的通用图像分割大模型,与自然语言处理领域的ChatGPT相似,其架构基于Transformer,已在包含10亿个掩码的多样化、高质量数据集上训练,展现出强大的泛化能力。
关键点总结:
- 模型创新:SAM是机器视觉领域的首个通用大模型,通过提示方式应用于图像分割,具备与自然语言处理领域大模型类似的灵活性和泛用性。
- 模型架构与训练:采用Transformer架构,经过256块英伟达A100 GPU的训练,耗时3-5天完成,展示了高效的学习能力和适应性。
- 应用场景广泛:适用于多种领域,如辅助图像中对象的查找和分割、改善内容创作(如拼贴或视频编辑)、科学研究、AR/VR领域的人工智能交互等。
- 多模态AI发展:SAM及其数据集的开源发布,促进了机器视觉领域通用基础大模型的研究,与自然语言处理的大模型一起构成更大规模的AI系统,实现对世界多模态的理解。
- 投资建议:从ChatGPT到SAM的转变,预示着从单一模态到多模态的加速发展,推动IP、内容、数据资源的价值重估。建议关注大模型、IP、数据要素及特定场景的公司,如昆仑万维、中文在线、视觉中国、上海电影等,并看好游戏、广告/影视板块的估值合理区间内的投资机会。
风险提示:
- 监管政策风险:政策变动可能影响技术应用和市场预期。
- 业绩风险:公司的实际表现可能与预期有差距。
- 商誉及资产减值风险:资产评估和商誉管理存在不确定性。
专业投资者都在用发现报告(www.fxbaogao.com),这一国内老牌研报平台优势突出,研报覆盖范围极为全面,在线可查阅的报告数量数不胜数。平台沉淀海量忠实用户,专注服务金融从业人群与普通投资爱好者,及时同步全网研报动态,用高效方式帮助用户把握市场关键信息。