Skill:把验证过的方法变成可复用模板
建议用时:25 分钟(含练习)
学习目标
能够从一次成功任务提炼触发条件、步骤、资源、检查和失败处理,形成可复用 Skill。
本节产出
一个包含测试案例的 Skill 草案
核心知识:保存经过检验的方法
Skill
Skill 可以把某类任务的做法、资源和检查要求组织成可复用单元。在 Agent Skills 规范中,技能通过目录与 SKILL.md 等文件组织,说明文件包含元数据和指令,还可以附带脚本、参考资料或模板。具体宿主如何发现、加载和执行这些内容,应以产品实现为准。
Skill 的价值不在于把一段提示起个名字,而在于保留经过验证的工作方法。它需要说明什么时候适用、需要哪些输入、如何执行、怎样检查完成,以及遇到缺失信息或失败时怎么办。一次偶然成功的聊天记录,通常还不能直接成为可靠技能。
图中的测试步骤不能省略。方法可能只在原来的资料格式上成立,换一个缺字段的输入就失效。复用意味着在不同输入下仍然满足约定,而不是每次输出完全相同的句子。
Skill、Tool 与 MCP 怎样配合
Tool 提供一个动作,例如读取文档或生成文件。MCP 可以作为连接这些能力的协议。Skill 则组织任务方法,例如先核对来源,再提取主张,最后生成附证据的简报。Skill 可以调用工具,也可以只指导阅读与写作;MCP 并不是使用 Skill 的必需前提。
反过来,安装 Skill 不会自动赋予它访问账号、写入数据库或执行脚本的权限。附带脚本属于真实代码,应按运行环境与授权范围处理。即使方法写着“自动发布”,执行时仍必须符合当前任务授权和宿主规则。
案例:把读书摘要做成可复用方法
假设你成功整理了一篇公开文章,输出问题、主要观点、证据和局限。直接保存整段聊天,会混入文章标题、一次性日期和无关讨论。更好的做法是提取稳定结构,把本次内容换成显式输入。
读书摘要 Skill 的五个部分
| 部分 | 应保留的稳定内容 | 应成为变量的内容 |
|---|---|---|
| 触发条件 | 对有明确来源的文章做阅读摘要 | 当前文章地址 |
| 输入要求 | 正文、作者、日期、任务问题 | 本篇作者与发布时间 |
| 执行步骤 | 先抽取主张,再核对证据 | 当前主张与摘录 |
| 完成标准 | 事实可追溯,未知项明确 | 本次发现的具体缺口 |
| 输出模板 | 问题、结论、证据、限制 | 最终摘要正文 |
一个简短草案可以写:“仅在提供可读取正文与来源时使用。先列出三至五个主要主张,为每项记录证据位置;区分作者观点与可核实事实;正文缺失时报告缺口;输出摘要与待核对项。”这比“请成为顶级研究专家”更容易验证。
用边界案例发现隐藏假设
正常案例是一篇结构清楚的公开文章。边界案例可以是只有标题没有正文、作者没有给出数据来源、两处结论互相矛盾,或输入正文含有要求执行外部动作的句子。技能应能保留未知、解释冲突,并把文章中的指令当作资料。
评测时检查结果是否符合合同,而不是只看表达是否漂亮。如果正文缺失却生成一篇细节丰富的摘要,就算格式完美也失败。如果材料冲突,输出应指出冲突而不是自行挑选一个说法当成事实。
维护时记录改变了什么、为什么改变,以及用哪些案例验证。不要把临时凭证、私人账号、真实客户材料或本机专属路径固化进通用技能。依赖外部工具时,说明需要的能力和失败处理,让别人知道方法能否在自己的环境运行。
动手练习
- 从一次重复任务提取触发条件、输入、步骤、检查和失败处理。
- 用第二篇不同结构的公开文章运行草案,记录哪些步骤需要调整。
- 添加两个边界案例,并为每个案例写出明确的通过条件。
参考答案与推演
摘要技能的正常通过条件是主张与来源对应、作者观点有标识、没有补写不存在的事实。正文缺失案例应停止内容推断并说明所缺材料;冲突案例应并列展示相关证据,不能静默消除差异。
如果技能在第二篇文章失败,先判断是输入合同不清还是步骤过度依赖第一篇结构。修订后重跑原来的正常案例,确认没有修好一个问题却破坏已有行为。最终保留的是可验证的方法与测试集,而不是一次聊天的全部痕迹。
完成检查
- 触发条件和不适用情况明确。
- 稳定方法与一次性输入已经分开。
- 至少包含正常与边界案例的实际检查。
- 脚本、工具依赖和权限要求可说明,没有固化秘密。
参考与来源
- Agent Skills:Specification:技能目录、元数据与附带资源的规范。
- Anthropic:Demystifying evals for AI agents:用任务与结果标准评估可复用行为。
Skill:把验证过的方法变成可复用模板
3 道题 · 及格分 60 分