Skill(智能体技能)是面向大模型/智能体的可主动调用、组合、复用的标准化能力单元,不是简单的提示词模板或独立APP,而是把工具、上下文、流程、记忆策略整合进模型运行时的核心能力组件,是Agent能力链条的关键组成部分 【3】 。
一、典型Skill的基础组成
一个标准Skill通常以独立文件夹的形式组织,核心构成包括:
- 必需的核心定义文件SKILL.md:采用YAML前置元数据+Markdown正文的混合格式,元数据部分会声明技能名称、描述、依赖条件、环境变量等信息,正文则约定该Skill的用途、触发规则、输入输出格式、安全约束和具体操作步骤 【1】 【4】 。其中名称必须和Skill所在文件夹名保持一致,仅能使用小写字母、数字和连字符,功能描述建议采用「功能描述+TRIGGER when+关键词列表」的形式,覆盖足够多的用户意图表达场景,保障触发准确率 【5】 。
- 可选扩展内容:可按需附带可执行代码脚本(Python、Node.js、Shell等)、参考文档、模板资源等,用来实现具体的行动逻辑,比如调用外部API、操作本地文件、对接第三方系统等 【1】 【4】 。
从更完整的技术维度拆解,Skill还包含三大核心模块:负责实际执行操作的功能逻辑、给模型做使用指引的结构化调用接口、用于技能分发治理的元数据信息 【10】 。
二、和普通Prompt相比的核心特点
- 可复用与可组合:定义完成后可以被多个Agent或工作流反复调用,还能和其他Skill串联搭配,输出的行为比每次临时编写Prompt更稳定可预测 【1】 。
- 可执行:不止能给出文本层面的指引,还可以附带可运行代码,直接对本地系统或外部服务产生实际影响,相当于Agent的“手脚” 【1】 。
- 可发现与共享:可以发布到ClawHub这类公开技能市场或者开源仓库,形成类似npm的生态模块,供其他用户安装复用,拓展整个社区的能力边界 【1】 。
三、实际应用场景与风险
目前Skill已经广泛接入OA、邮箱、知识库、数据库、客服系统、运维平台等各类企业业务系统,覆盖开发工具、数据分析、内容创作、金融投研、办公效率等数十个领域,市面上已经出现了大量面向不同场景的成熟商用Skill 【12】 【13】 【14】 【15】 。
但随着Skill成为Agent运行链路的关键节点,它的安全风险也从单点隐患升级为系统性风险:除了传统的恶意代码问题,还可能出现提示词注入、恶意投毒、权限滥用、数据窃取等新型攻击,一旦出问题会直接影响企业的账号体系、数据资产、业务系统和合规管理 【2】 。