Summary
创建、审计、修复和优化 Agent Skills。Use when 用户要新建 Skill、检查 Skill 质量、恢复原版或修正明确错误、比较新旧效果,或更新本 Skill 借鉴的上游方法。触发词:"创建skill""写一个skill""改skill""优化skill""给skill打分""skill体检""review skill"。
hanzhcn/laohan-skills
创建、审计、修复和优化 Agent Skills。Use when 用户要新建 Skill、检查 Skill 质量、恢复原版或修正明确错误、比较新旧效果,或更新本 Skill 借鉴的上游方法。触发词:"创建skill""写一个skill""改skill""优化skill""给skill打分""skill体检""review skill"。
npx skills add hanzhcn/laohan-skills --skill laohan-skillcreator
创建、审计、修复和优化 Agent Skills。Use when 用户要新建 Skill、检查 Skill 质量、恢复原版或修正明确错误、比较新旧效果,或更新本 Skill 借鉴的上游方法。触发词:"创建skill""写一个skill""改skill""优化skill""给skill打分""skill体检""review skill"。
Related neighbors and high-traction skills in the same topics — useful to compare before installing.
Helps users discover and install agent skills when they ask questions like "how do I do X", "fi…
3.3M installsBrowser automation CLI for AI agents. Use when the user needs to interact with websites, includ…
810.4K installsReview UI code for Web Interface Guidelines compliance. Use when asked to "review my UI", "chec…
617.3K installsBuild, deploy, evaluate, optimize, fine-tune, and manage Microsoft Foundry agents, models, and …
576.5K installsPrepare azd-based Azure projects for deployment: generates azure.yaml, infrastructure (Bicep/Te…
568.3K installsOther skills from hanzhcn/laohan-skills · top by installs.
npx skills add hanzhcn/laohan-skills
Declared targets from SKILL.md / docs. Unmarked agents are not listed — the skill may still install via the CLI.
main
Parsed from SKILL.md frontmatter.
Files included with this skill beyond the listing page.
SKILL.md
20,712 B
SUMMARY.md
341 B
创建是生产能力,审计是只读诊断,修复是小范围纠错,优化才是实验性演进。先判断模式,再使用与风险相称的验证;不得把一次明确的小修复升级成完整优化项目。
当前借鉴 6 组上游来源。具体文件与最近核验 commit 记录在 [references/upstream-sources.json](references/upstream-sources.json)。修改本 Skill 自身或用户要求更新方法时,先运行 scripts/check-upstreams.sh;发现上游变化后阅读相关 diff,只吸收能改善本地真实行为的变化,不自动覆盖本地方法。
- 借鉴:渐进式披露(metadata→body→bundled 三层)、同条件 baseline 对比、盲比较、description 优化器、从 transcript 找重复工作、更新保持原名 - 核心理念:好的 skill 分三层渐进披露,不是一坨
- 借鉴:frontmatter 公共规范、渐进式披露、真实经验优先、控制强度与任务脆弱性匹配、从执行轨迹删除无效步骤 - 核心理念:Skill 应补充 agent 缺少的领域经验,不重复常识;过度全面同样会降低效果
- 借鉴:触发分支、信息层级、完成条件、单一真源、去除 duplication/sediment/no-op - 核心理念:Skill 追求过程可预测,不追求所有输出相同;不同分支只加载各自需要的信息
- 借鉴:verbatim recitation(首次一次+逐字+silent apply)、硬门控措辞、refuse to draft、跨 skill offer 非自动、先质疑意图、cite or it didn't happen - 核心理念:不确定就停下来,每个 claim 要有引用
- 借鉴:9 维评分体系、反例黑名单 8 条、棘轮机制(git ratchet)、独立子 agent 复评、人在回路 5 阶段 - 核心理念:SkillLens 显示无 rubric 的 LLM 成对判断只有 46.4% 准确率,验证过的 meta-skill rubric 提升到 73.8%,仍不足以代替真实任务验证
- 借鉴:只有深度创建/优化才做无 Skill baseline 与压力场景;可机械执行的约束优先交给脚本或 verifier - 核心理念:测试应证明 Skill 改变了实际行为,但不能把 TDD 仪式强加给明确的小修复
四原则:
每次只选一个主模式:
| 模式 | 何时用 | 默认验证强度 |
|---|---|---|
CREATE |
新建一个可复用 Skill | 真实样本、触发/反触发、执行测试;复杂或高影响 Skill 再加 held-out |
AUDIT |
体检、评分、检查合理性 | 只读,引用具体行和行为证据;不修改文件 |
SURGICAL_FIX |
恢复原版、修正明确错误、更新固定合同或路径 | 比对真源、最小修改、直接覆盖该错误的针对性回归;不做静态评分、blind judge 或无关 held-out |
OPTIMIZE |
用户明确要求提升效果、比较新旧方案或全面演进 | 冻结 baseline/指标,运行 held-out;主观结果才用 blind judge |
UPSTREAM_REFRESH |
更新本 Skill 借鉴的方法或核验引用是否变化 | 运行上游检查,阅读变化,只合并相关增益并更新记录 commit |
用户说“改 Skill”但给出了明确错误或原版真源,默认 SURGICAL_FIX;只有用户要求“优化效果、全面审核、比较方案”才进入 OPTIMIZE。AUDIT 不隐含修复授权,CREATE 不隐含安装或发布授权。
UPSTREAM_REFRESH 和修改 laohan-skillcreator 自身时:
bash scripts/check-upstreams.sh。CURRENT:继续当前任务。UPDATED:读取记录 commit 到最新 commit 的相关文件 diff,判断是否改变本地借鉴的方法。references/upstream-sources.json 的 commit 和 verified_at。UNVERIFIED:报告无法核验,不声称已经跟上上游;不阻断与上游无关的 SURGICAL_FIX。新建前强制检查三个问题;先用 catalog/项目证据自主回答,只有用户意图无法从对话确定时才询问:
如果 1 或 2 答 yes → 告诉用户替代方案(扩展哪个 skill / 为什么不必建),不新建。
从对话提取(或问用户):
用户说不清 → 停下来,列出不明确的部分,等补充。不要猜。
确认 Step 0 的"不能扩展已有"结论(重查 catalog 和当前项目)。如发现可扩展 → 回 Step 0。
按下方骨架模板和写法规则。先判断极简还是完整骨架,再填。
NOT_APPLICABLE不是每个 Skill 都需完整骨架。逻辑简单到几行能说清时直接写指令,别为“专业”加多余章节。
判断标准:单步、无复杂条件分支(简单回退除外)、无角色区分 → 极简。多步/有条件分支/多角色 → 完整骨架。
---
name: caveman
description: 极简回应模式,只输出关键信息。Use when 用户说"caveman mode""极简""少说废话""简短"。
---
所有回应控制在 3 句话以内。只给结论和关键依据,不解释过程。如果用户要求详细解释,恢复正常模式。
---
name: skill-name
description: 一句话说清做什么。Use when 用户说"触发词1""触发词2""触发词3"或提到[相关场景]。 # ≤1024字符,3-8触发词,第三人称
# version: 1.0 # 只在目标 runtime/profile 允许时加
---
# Skill 标题
一句话定位。
## 核心理念(复杂 skill 必加,简单可省)
为什么存在、遵循什么原则。先讲 why 再讲 how——比直接列步骤更有效。
## 工作流
### 1. [步骤名]
- 做什么
- **完成条件:** [怎么判断这步做完了]
- **🔴 CHECKPOINT:** [仅当该步有外部副作用、高风险或用户保留决策时填;否则删除]
- **🛑 STOP:** [强制停止条件]
### 2. [步骤名]
- 做什么
- **失败处理(只有存在复杂降级链时用三段式;单一安全 STOP 直接写 if-then):**
| 触发条件 | 一线修复 | 仍失败兜底 |
|---------|---------|-----------|
| [X 失败] | [Y] | [Z] |
### 3. [步骤名]
- 做什么
- **涉及外部动作 → 🔴 等用户确认再执行**
## 操作规则
跨步骤常驻约束:
- [规则1]
- [规则2]
- 遇到 [异常] → [怎么处理](不静默跳过)
## 不适用场景(refuse to draft 硬拒绝,v2 升级)
- 场景 A → 改用 [其他 skill]
- **缺 [必要输入 X] → 列出缺什么并停,不硬编、不猜**(9arm post-mortem 模式)
## 反模式(复杂 skill 必加,v2 从可选升级)
❌ 差:
"[反例]"
✅ 好:
"[正例]"
## 输出格式(可选)
# [标题模板]
## [章节1]
精简自 darwin 9 维(完整 9 维见 [references/scoring-rubric.md](references/scoring-rubric.md))。给任何 skill 打分:
| # | 维度 | 权重 | 评分标准 |
|---|---|---|---|
| 1 | frontmatter 质量 | 10 | name/description 符合目标 runtime 的允许字段;description 同时说做什么与何时用。触发词数是启发式,不为凑 3-8 个堆词 |
| 2 | 工作流清晰度 | 20 | 编号步骤+明确完成条件+输入输出清晰 |
| 3 | 失败模式编码 ⭐ | 20 | 覆盖真实可发生且会影响结果的失败面;一个安全 STOP 已足够时不强行写三段表,复杂降级链才要求三段式 |
| 4 | 检查点设计 ⭐ | 15 | 外部副作用、高风险或用户保留决策前有显性 gate;自治/确定性 skill 说明无人工 gate 的理由也可满分,不为格式加假 checkpoint |
| 5 | 可执行具体性 ⭐ | 25 | 有具体参数/格式/示例可直接执行;只在软化词替代必要决策规则时扣分,引用、用户输出和不确定事实不机械命中 |
| 6 | 反例与风险边界 ⭐ | 10 | 阻止本 skill 实际可能触发的误用和危险动作;不涉及 git/删除/发布的 skill 不因没列这些动作扣分 |
算分:每维 1-10 分,总分 = Σ(维度分/10 × 权重),满分 100。
cite or it didn't happen(9arm):每个扣分必须引用 SKILL.md 具体行号或段落原文。不允许泛泛"这里不够好"。
评分档位:
BLOCKING、BEHAVIORRISK、MAINTENANCE 和 NOISSUE,不把静态分数当问题数量。SURGICAL_FIX 或 OPTIMIZE。优化已有 skill(只改自研 laohan 系列;npx 第三方 fork 后改):
git revert,不用破坏性 reset需要大样本多轮优化时,读 references/scoring-rubric.md 跑完整 9 维;如当前 catalog 已安装 darwin-skill,也可按它的 held-out 循环执行。不在当前任务中自动安装。
所有模式的共同约束:
research-helper 就输出同名,不是 v2(anthropics)只审查可执行指令段:以下措辞若代替了具体条件/动作,出现 ≥3 处时 dim5 扣 ≥3 分;引用、反例、用户输出或客观不确定性不计:
改用具体指令:"做 X"(祈使句 + 具体参数/示例)。完整禁用词表见 references/blacklist-phrases.md。
创建/优化时禁止:
git revertAUDIT 可标 STRUCTURE_ONLY;只有 OPTIMIZE 的效果改善结论必须有 baseline/with-skill/held-out 行为证据npx skills update 覆盖原地改动)---
name: skill-name # kebab-case,与目录名一致
description: 功能描述。Use when 触发场景列举。 # ≤1024字符,第三人称
# version: 1.0 # 只在目标 runtime/项目 schema 允许时使用;laohan-local 要求
---
name + description 是 agent 路由 skill 的常驻元数据。description 必须含:
| 规则 | 说明 |
|---|---|
| 篇幅控制 | 以完整加载且没有冗余为准;尽量 <500 行,接近/超过时把长参考和详细 eval 流程拆到 references/ |
| 核心理念先行 | 3 步以上 skill 在工作流前加核心理念章节(先 why 后 how) |
| 工作流+操作规则分离 | 工作流=步骤序列;操作规则=跨步骤约束,独立章节 |
| 阶段门控 | 只在外部副作用、高风险或用户保留决策前设硬 gate;确定性内部步骤不加假 CHECKPOINT |
| 反模式 WRONG/RIGHT | 核心规则用对比块(❌差/✅好) |
| 口诀植入(verbatim) | 只在任务真的需要可背诵纪律时使用;不把 debug-mantra 形式套到所有 skill |
| 输出格式 | 用模板定义,不给模糊指令 |
| 降级级联 | 多方案用严格优先级(依次尝试),非菜单 |
| 跨 skill 调用 | 完成后 offer 衔接另一个 skill(不自动 handoff,9arm post-mortem) |
| 写作原则 | 祈使句 + 具体例子 + 不用 ALL CAPS ALWAYS/NEVER + 内容创作类定义语气 |
| scripts/ 判断 | 确定性操作/重复生成的相同代码/需显式错误处理 → scripts(mattpocock) |
| references/ 判断 | 平台专属方法/长模板/不需每次加载的背景知识 → references(仅一层深) |
渐进式披露(anthropics):metadata(常驻)→ SKILL.md body(触发加载)→ bundled resources(按需)。SKILL.md 别一坨塞完,重的拆 references/scripts。
创建/优化完成后:
AUDIT 保持只读,SURGICAL_FIX 没有升级成完整优化scripts/check-upstreams.sh,并按实际核验结果更新上游记录