智谱AutoGLM沉思:“思行合一”开启AI Agent新时代
核心观点
- 智谱发布全球首个集深度研究与实际操作能力于一体的AI Agent——AutoGLM沉思,通过深度思考模拟人类推理决策过程,能感知世界、获取并理解环境信息,并调用操作工具完成复杂任务。
- 沉思功能已在智谱清言网页端、PC端和手机App免费、不限量开放,是国内首个正式开放的DeepResearch功能。
- 沉思功能背后是智谱自主研发的全栈大模型技术,整合了GLM-4的通用能力、GLM-Z1的反思能力、GLM-Z1-Rumination的沉思能力以及AutoGLM的自动执行能力。
- 沉思功能将于4月14日开源,推动行业发展。
网页版AutoGLM沉思测评
- 制定研究计划高效、思维链长,搜索与交互尚存优化空间。
- 在测试中,沉思能制定详细具体的分步计划,研究效率高且步骤划分合理。
- 在学术论文综述方面,沉思展现出长思维链,遇到查找难题能迅速调整方向,并不断更换关键词以丰富搜索结果,最终得出的结果具有较高的可用度。
- 在搜索策略、操作流程和任务交互等细节方面存在不足,随着版本迭代优化,有望为用户带来更智能、高效、流畅的深度研究和操作体验。
桌面端AutoGLM沉思测评
- 具备深度研究基本能力,未来有望持续迭代改善。
- 生成的研究报告超8000字,内容充实、逻辑严谨、要点完善,具备撰写长报告的基本能力。
- 存在学术搜索环节不够严谨、资料搜索方式混乱、调查过程耗时久等问题,效率有待提高。
智谱全栈自研大模型赋能AutoGLM沉思多元能力融合
- 沉思融合深度思考、感知世界、工具使用三大能力。
- 背后是智谱自主研发的全栈大模型技术,整合了GLM-4的通用能力、GLM-Z1的反思能力、GLM-Z1-Rumination的沉思能力以及AutoGLM的自动执行能力。
- GLM-4-Air-0414(新版基座模型)、GLM-Z1-Air(新版推理模型)、GLM-Z1-Rumination(沉思模型)、AutoGLM模型的核心链路模型和技术将于4月14日正式开源。
以AutoGLM沉思为基,探AI Agent发展之路
- AutoGLM沉思是AI Agent领域的重要里程碑,大胆地将大模型的深度思考能力与Agent的实践操作能力深度融合。
- 进一步强化了2025年将成为AI Agent发展元年的论断。
- 智谱计划与金融、教育、医疗等多个领域的合作伙伴展开深度合作,推动Agentic LLM在实际场景中的应用落地。
- 尽管当前大模型技术的发展面临着诸多挑战,但智谱等国产Agent的突破,有望推动AI技术实现新的飞跃,为AI应用的落地实施开拓更为广阔的发展空间。
投资建议
- 建议关注AI+生产力工具、AI+端侧硬件、AI+军工、AI+教育、AI+营销等领域。
风险提示
- 应用测试结果与本报告不一致的风险。
- 技术迭代不及预期的风险。
- 商业化落地不及预期的风险。
- 政策支持不及预期风险。
- 全球宏观经济风险。