o0000-code/meta-analysis-skill · Archived

systematic-review

Strict systematic review per Cochrane v6.5 + PRISMA 2020 + AMSTAR 2: PROSPERO/OSF protocol, PRISMA-S search, dual-blind screening + Cohen's kappa, RoB 2 / ROBINS-I, GRADE, AMSTAR 2. Use when user requests "systematic review", "系统综述", "系统性文献综述", "循证综述(含 RoB/GRADE 等环节)", "PRISMA review", "Cochrane-style review". Trigger when user explicitly requires PRISMA 2020 / Cochrane / RoB / GRADE / AMSTAR 2, OR submits to BMJ / Lancet / Cochrane Library / Psych Bulletin. If user says on…

Installation

$ npx skills add o0000-code/meta-analysis-skill --skill systematic-review

Stronger alternatives

This repository is archived — consider an actively maintained alternative.

Similar popular skills

Related neighbors and high-traction skills in the same topics — useful to compare before installing.

Also in this package

Other skills from o0000-code/meta-analysis-skill.

npx skills add o0000-code/meta-analysis-skill

Browse all from o0000-code/meta-analysis-skill

More details

Agent compatibility

Declared targets from SKILL.md / docs. Unmarked agents are not listed — the skill may still install via the CLI.

Claude Code Not declared
Cursor Not declared
Codex Not declared
GitHub Copilot Not declared
Windsurf Not declared
Gemini CLI Not declared
Cline Not declared
OpenCode Not declared

Repository health

Stars 1
License LICENSES
Default branch main
Open issues 0
Status Archived

Skill metadata

Parsed from SKILL.md frontmatter.

Version1.1.1
LicensePolyForm-Noncommercial-1.0.0 AND CC-BY-NC-SA-4.0
More metadata
author
Bo
version
1.1.1
consumes_ssot
review-methodology-foundations

Package contents

Files included with this skill beyond the listing page.

  • skill md SKILL.md 61,703 B
  • docs SUMMARY.md 1,050 B

History

  1. First recorded snapshot · 1 installs

SKILL.md

Systematic Review

严格 PRISMA 2020 系统综述工作流。在 12 阶段生命周期中全面执行 Cochrane Handbook v6.5 标准,含 PRISMA-S 检索文档化、双盲筛选 + Cohen's κ、双人提取、按研究设计选用 RoB 工具、GRADE 证据等级、AMSTAR 2 自评。


1 你产出什么、不产出什么

1.1 路径 A 产出(严格模式 / 默认)

交付物 必含元素
主稿 PRISMA 2020 27 条全对接(IMRaD 六大块)
PRISMA 流程图 4 阶段 + 每阶段排除数与理由
PRISMA-S 文档 16 项检索可复现性 YAML
协议声明 PROSPERO/OSF 注册号;未注册需显式声明 + 时间戳
纳入排除标准表 PICO 三层 + FINER
筛选记录 双盲 κ + 仲裁记录
提取表 SSOT-EXTRACTION-FIELDS 六大类 + 双人一致性
RoB 评估表 按设计选 RoB 2 / ROBINS-I / QUADAS-2 / NOS / JBI(单被试用 SCED/RoBiNT,不是 SCRIBE
综合 SWiM 9 项 + Popay 4 元素(不能元分析时)
GRADE 证据等级 5 降 + 3 升 + SoF 表
AMSTAR 2 自评 16 项 7 关键域,置信度等级
写作过程档案 SubAgent 分工 + 双盲披露 + 模式选择
决策档案 decisions/01-11_*.md(应用 §3.3)

1.2 路径 B 产出(学习模式 / 课程提案)

学习模式按 §9.2 简化项执行,但保留 L1+L2+L11 + PRISMA 流程图 三条硬约束。具体披露见 §9.3。

1.3 不产出(边界)

  • 定量元分析(点估计合并、森林图、漏斗图、Egger 检验)→ 转 meta-analysis Skill 配套使用
  • 范围综述(领域映射、概念地图,PRISMA-ScR)→ 转 field-overview-review
  • 叙述综述(无双盲、无 PRISMA 流程图)→ 转 field-overview-reviewfield-evolution-review
  • 理论建构综述(构念分析、对立理论比较)→ 转 theoretical-review

详见 §13 与其他 Skill 的关系。

1.4 标准交付物清单(独立小表,便于一眼对账)

主稿 / PRISMA 流程图 / PRISMA-S YAML / 协议声明 / PICO 三层表 / 双盲筛选记录 / 双人提取表 / RoB 评估表 / SWiM+Popay 综合 / GRADE+SoF 表 / AMSTAR 2 自评 / 写作过程档案 / 决策档案目录(共 13 类)。


2 触发与适用场景

2.1 应触发场景

正向触发的关键场景:

  • 用户明确说"系统综述"、"systematic review"、"PRISMA review"、"Cochrane-style review"、"循证综述"
  • 投稿目标是要求 PRISMA 2020 / Cochrane 标准的期刊(BMJ、Lancet、Cochrane Library、JCE、《心理学报》系统综述栏目)
  • 用户描述含"双盲筛选"、"RoB 评估"、"GRADE 等级"、"AMSTAR 2"、"PROSPERO 注册"
  • 学位论文方法学章节、博士资格审核、循证临床应用(指南制定、HTA 报告)

潜在触发场景(即使用户不说 PRISMA,也应推荐本 Skill):

  • 用户明示需要 PRISMA / Cochrane / RoB / GRADE / AMSTAR 2 程序
  • 用户提到"风险偏倚"、"证据等级"、"可复现的检索"
  • 用户的研究问题是 PICO 形式(明确 Population/Intervention/Comparison/Outcome)

2.2 反向触发(Do NOT use)

用户场景 应转 Skill 理由
"探索某领域研究进展"、"做个文献综述了解领域"(无 PRISMA 关键词) field-overview-review 探索式综述,无双盲、无 RoB
"50 年研究发展史"、"领域演化" field-evolution-review 时间维度 + 5 维度检索
"理论建构、构念分析" theoretical-review 论证为主、方法宽松
"只做量化元分析",无质性合成需求 meta-analysis 直接进 L9 量化(如已有完整数据)

2.3 模糊地带路由(消除 LS / SR 重叠 — W5-1 §1.3 题 14/15)

关键路由规则

  • 用户已提供文献集 + 要求 PRISMA / Cochrane → 用 systematic-review(本 Skill),跳过 L4-L5 检索;不用 literature-set-review
  • 用户已提供文献集 + 要求"基于文献集写综述",无 PRISMA 要求 → 用 literature-set-review
  • 用户没有现成文献集 + 要求 PRISMA → 用 systematic-review 完整 L1-L12

2.4 与 meta-analysis 的关系(联合工作流)

systematic-review 与 meta-analysis 是配套关系,不是替代关系:

  • systematic-review 提供 L1-L8 + L11-L12 全部基础(PICO、检索、筛选、提取、RoB、报告、自评)
  • 当数据可元分析时,L9 切换到 meta-analysis Skill 处理(详见 §4.2 L9 决策表)
  • 联合工作流(切 MA):systematic-review 完成 L1-L8 → meta-analysis 完成 L9-L12(含 GRADE / APA MARS 报告 / AMSTAR 2,由 MA 产 10gradedecision.md / 11reportingstandard.md / L12_amstar2.md;锁4 §4.4 裁定:以元分析为终点的联合路径 MA 拥有 L9-L12)。纯 SR 路径(不切 MA)则由 SR 完成 L9-L12。

3 主 Agent 角色与责任

3.1 主 Agent 必读(启动即必读 —— G5:启动足迹从 ≈72k 三件套砍到 ≤10k digest)

主 Agent 在 Skill 触发后立即加载 review-methodology-foundations/references/LAUNCH-DIGEST.md(启动即必读,正文 ≤10k)——它蒸馏了原"启动即必读三件套"(SSOT-LIFECYCLE-12-PHASES + SSOT-METHODOLOGY-TERMINOLOGY + SSOT-AI-FAILURE-DEFENSES,≈72k)的全部载荷条款 + §1.2-18 前沿条款 + Cohen / k→限定语 / I² / GRADE / 学科×数据库 / 构念方向六张查表。读完这一份即掌握全流程载荷红线。

为什么改(G5):实战审计实测三件套 66-72k"启动即必读"被跳过 2/3——从未打开;被读率是主 Agent 派发 prompt 是否点名的函数,不是"必读"规定的函数。故三层修复:①启动只读 ≤10k digest(真读);②三件套 + 深层 SSOT 全文降级"按需下钻"(路径经 SSOT-INDEX.md 全库 resolver,见 §8);③关键载荷投放到 SubAgent 靠 PROMPT-COPY-BLOCKS.md 复制块(§6 · 内容进 prompt 的构造性保证),不靠自觉去读深文件。

SR 特定深层(不在启动加载,resolver 定位、按需下钻)SSOT-PRISMA-S-TEMPLATE(L5)/ SSOT-PRISMA-FLOW-DIAGRAM(L6 / L11)/ SSOT-MODE-PROFILES(L3)/ SSOT-AMSTAR-2-CHECKLIST(L12)——digest 给决策阈值,需完整模板 / 条目原文时按 resolver 路径下钻。关键载荷已在 digest / §6 复制块,SubAgent 不必自行去开深文件

3.2 协调而非执行

主 Agent 在本 Skill 中是协调者,不直接调 MCP,不直接写综述章节。具体执行(检索、筛选、提取、写作、评估)全部外包给 SubAgent。

主 Agent 的核心动作:

  • 理解:与用户对齐研究问题、综述类型、模式(严格/学习)、字数、语言、引用格式
  • 规划:基于 SSOT-LIFECYCLE-12-PHASES 拆分阶段任务、识别依赖、决定串行 vs 并行
  • 派发:写明确的 SubAgent prompt(含必读文件 + 任务 + 输出契约 + 自检)
  • 审核:每阶段产出对照 PRISMA 2020 + AMSTAR 2 自检;发现问题派 Fix-Agent
  • 整理:跨 SubAgent 文档落盘到工作目录,最终主 Agent 整合主稿

3.3 跨阶段决策档案规则(强制,应用 C1 模板)

主 Agent 在每阶段产出后,将决策性结论写入 decisions/ 子目录。这是 6 Skill 共享的工作流跨阶段决策档案机制,避免 L9/L11/L12 SubAgent 重新决策。SR 完整 11 类决策档案:01typedecision.md(L1 类型 + 4 项判定矩阵)/ 02researchquestion.md(L2 三层 PICO + FINER)/ 03modedecision.md(L3 严格 vs 学习)/ 04searchstrategy.md(L4)/ 05searchexecution.md(L5 PRISMA-S 16 项)/ 06screeningdual.md(L6 κ + 仲裁)/ 07datatypes.md(L7 提取 ICC/κ)/ 08robtooldecision.md(L8 RoB 工具,SCED/RoBiNT 而非 SCRIBE)/ 09synthesisdecision.md(L9 含切换 MA 阈值)/ 10gradedecision.md(L10)/ 11reporting_standard.md(L11)。

每个决策档案使用统一 YAML frontmatter + 正文 + 上下游依赖 + 校验清单结构,完整模板见 references/decision-provenance.md

L9/L11/L12 SubAgent 必读 decisions/:所有 L9/L11/L12 SubAgent prompt 必须显式列出 decisions/01-11_*.md(按阶段对应字段,参见 references/decision-provenance.md §3"消费者-生产者"映射)。不读决策档案直接执行 → 阻断;矛盾时主 Agent 仲裁。

追认①(G5 · 公理 8 好偏离追认)——规划文档=上下文容器:实战 SubAgent prompt 未逐档点名上列 decisions(01/03 普遍缺席),而由主 Agent 用"每轮专属规划文档"承载上下文(内嵌决策档指针),效果更优。规范承认此模式:上列决策档必读可由"读本轮规划文档(内嵌所需 decisions/*.md 指针)"等价满足;构造性底线 = §6 派发复制块把关键决策载荷直接写进 SubAgent prompt(填空题),不依赖 SubAgent 自觉去开 decisions 档。决策档案禁止自证式"[ ] 已读 <文件>"勾选(G5 · R3 实测 decisions/01 虚假"[x] 已读"已发生、transcript 零访问);"规定应读"改用模板 frontmatter required_readings 声明性机读字段,preflight --gate readings 一行 WARN 计数,差异表→v2。

L11 写作前主 Agent 二次验证:派发前主 Agent 验证当前 L11 SubAgent 计划的报告标准与 01typedecision.md + 11reportingstandard.md 一致(SR 必为 PRISMA 2020 27 项;心理学场景叠加 APA MARS)。不一致即阻断

3.4 不允许的妥协

  • 不允许在 systematic-review 中"压缩到 PRISMA 2 条"——这是 AMSTAR 2 Critical Domain 失败
  • 不允许擅自降级英文检索代替中文检索(参见 §11.1 检索回退:主路径 paper-search-pro / 中文人工导出题录 → ingestsearchexports.py 摄入)
  • 不允许把 SCRIBE 误用作单被试 RoB 工具(应用 SCED Scale / RoBiNT Scale,参见 SSOT-ROB-TOOL-MAPPING)

4 完整工作流(12 阶段对齐)

4.1 12 阶段总览表

每阶段对应一个或多个 references/ 文件。当前阶段加载对应文件即可,不需要前置加载全部。详见 §6 何时加载哪个 references 文件。

L# 阶段名 关键产物 主 SSOT 主 references
L1 类型识别 + 4 项判定矩阵 类型确认 + 模式建议 + Skill 路由 SSOT-REVIEW-TYPES references/L1-question-construction.md
L2 PICO 严格构造 三层 PICO + FINER + 假设三分 SSOT-PICO-FRAMEWORKS references/L1-question-construction.md
L3 协议预注册 PROSPERO/OSF 注册号 / 状态声明 SSOT-REPORTING-STANDARDS §1.2.2 references/L2-protocol-registration.md
L4 检索策略 数据库列表 + 同义词 + 布尔 + PRESS SSOT-SEARCH-STRATEGY references/L4-search-protocol.md
L5 检索执行 PRISMA-S 16 项 + 去重记录 SSOT-PRISMA-S-TEMPLATE references/L5-prisma-s-execution.md
L6 双盲筛选 一致性 + Cohen's κ + 仲裁 SSOT-AI-FAILURE-DEFENSES §1 references/L6-screening-dual-blind.md
L7 双人提取 结构化字段 + 一致性 + LLM 披露 SSOT-EXTRACTION-FIELDS references/L7-extraction-dual.md
L8 风险偏倚评估 按设计选工具 + 完整域评分 SSOT-ROB-TOOL-MAPPING references/L8-rob-assessment.md
L9 综合(Synthesis) SWiM 9 项 / Popay 4 元素 / 切换 MA SSOT-SYNTHESIS-METHODS references/L9-synthesis-swim.md
L10 GRADE 证据等级 5 降 + 3 升 + SoF 表 SSOT-GRADE-FRAMEWORK references/L10-grade.md
L11 写作 + 报告 PRISMA 2020 27 条 + 流程图 + APA MARS SSOT-REPORTING-STANDARDS references/L11-prisma-reporting.md
L12 自评 AMSTAR 2 16 项 + ROBIS SSOT-AMSTAR-2-CHECKLIST references/L12-amstar2-self-assessment.md

4.2 各阶段任务详解

4.2.1 L1 类型识别 + 4 项判定矩阵(W5FIXPLAN E.P0.4 修缮)

systematic-review 的 4 项判定要素 + 判定矩阵(替代原"任一不满足则建议切换"的硬条件):

4 项判定要素

  1. 用户的研究问题可形式化为 PICO(Population-Intervention-Comparison-Outcome)
  2. 用户接受双盲筛选 + RoB 评估 + GRADE 的工作量
  3. 数据可得性可支撑结构化提取(不仅是讨论级别概览)
  4. 用户接受 8,000+ 字综述长度(学习模式可降到 6,000-8,000)

判定矩阵(不再是"任一不满足切换"):

通过项数 决策 操作
4/4 严格模式 默认完整 12 阶段 + AMSTAR 2 ≥ Moderate 目标
3/4 严格模式 + 显式披露 完整 12 阶段,但在 Limitations 显式披露未满足项及其影响。例:项 1 失败(PICO 弱),披露"研究问题接近但不严格满足 PICO 形式,影响 Eligibility Criteria 边界"
2/4 学习模式 + 强烈披露 切到学习模式(§9.2),所有简化点必须按 §9.3 披露原文模板写入。同时建议用户考虑切到 FO/LS
1/4 切到 FO/LS 不在 systematic-review 内做。主 Agent 显式向用户说明原因并推荐替代 Skill

示例

  • 通过项 = {1, 2, 3}(4 失败:用户字数预算 4000)→ 3/4 → 严格模式 + 在 Discussion 显式披露"字数限制下,部分综合段落简化"
  • 通过项 = {1, 3}(2/4:用户拒绝双盲 + 字数 5000)→ 学习模式 + 双盲降级披露 + 字数受限披露 + 询问是否切到 FO

判定结论写入 decisions/01typedecision.md

附加:FINER 5 项过滤(参见 references/L1-question-construction.md §3 + SSOT-PICO-FRAMEWORKS §5)。

4.2.2 L2 PICO 严格构造(Cochrane 三层)

systematic-review 强制三层 PICO(Cochrane v6.5 Ch.2 §2.3):

  • Review PICO:综述层面的研究问题
  • PICO for each synthesis:每个综合(如不同 Outcome 的 subgroup)的 PICO
  • PICO of the included studies:每篇纳入研究实际的 PICO

三层间偏离必须在 Limitations 中显式报告。

4.2.3 L3 协议预注册(强制声明)

强制规则:即使未注册,也必须在主稿 Methods 节"Protocol and Registration"中显式声明(参见 references/L2-protocol-registration.md §1.1/1.2/1.3 三种模板)。

未声明协议状态属于 AMSTAR 2 项 2(Critical Domain 1)失败,自评最高 Low。

4.2.4 L4-L5 检索策略与执行(PRISMA-S)

systematic-review 严格模式必含:

  • 4+ 学科核心数据库(如 MEDLINE / PsycINFO / EMBASE / CENTRAL)+ 灰色文献
  • 引文追踪(forward + backward citation)
  • PRESS 同行评审(推荐,Tier 2)
  • PRISMA-S 16 项全部填写(YAML 模板)
  • Bramer EndNote 6 步去重 + 记录每步去重数

学习模式可降级(≥ 2 库 + 简化布尔),但必须按 §9.3 披露原文模板显式披露简化点。

自动预筛(追认④,G5 · 公理 8):召回优先检索命中量大、噪音多(实战 ~80% 无构念词)时,双盲筛选前可加一步验证式自动预筛(构念关键词粗过滤,Nraw→Nprescreen)——但必须走三件套:种子 100% 保全 + 双重假阴抽验(0 假阴)+ Methods 显式披露,且不替代双盲(§4.2.5)与全文双人硬点。完整标准流程见 references/L6-screening-dual-blind.md §12

检索执行外包(G6 · 外包交接包模式):L5 的检索执行(登录订阅库/粘贴检索式/逐库导出题录)是程序性外部劳动——主 session 不做,即使派 SubAgent 也不做(注意力经济)。L4 冻结签核后,主 session 生成检索请求包 searchrequestpack/request.yaml 机读 SSOT → rendersearchpack.py 渲染 perdb/*.md 人读卡 + exportcontract.md + hitlogtemplate.md),外包给可插拔执行器(人/Codex/另一 CC session/pending 检索 skill),回执经 scripts/validateexports.py 硬门(复用 ingest 解析器 dry-run + 种子在场 + 命中一致性 + 无摘要披露 U-49;exit≠0 不摄入)验收后才交 ingestsearchexports.py。逐库导出陷阱见 references/db-quirks.md;模式规范见 review-methodology-foundations/references/OUTSOURCING-HANDOFF-PATTERN.md契约边界:主 session 只产请求包 + 验收回执;"执行"是可插拔 executor 契约(入 request.yaml → 出 L5export<db><date>.<ext> + 命中记录 + executed_date 回写)。

4.2.5 L6 双盲筛选(关键 LLM 防御 — 10/10 范本所在)

LLM 实现的双盲:

  • 派发 2 个独立筛选 SubAgent(不共享上下文,独立 prompt)
  • 各自筛选同一份文献集合
  • 主 Agent 比对两份决策清单 → 计算 Cohen's κ
  • 不一致项进入第三个仲裁 SubAgent判定
  • 全部决策记录写入 screening_log.csv

全文筛 = 双人硬点(U-16,2026-07-03 升硬点)标题/摘要筛与全文筛两层都必须双人独立——不是只有标题/摘要层双盲、全文层单人。实战教训:T/A 双盲花掉 16 SubAgent 后,全文层退化成单人筛(无 A/B、无全文层 κ),违反本规范且伤 AMSTAR 2 Item。故:全文合格性判定同样派 2 个独立 SubAgent + 仲裁 + 算全文层 κfulltextkappa),落 L6kappafulltext.json;SP2 签核门的 06a 以 fulltextkappa_json 指针指向它(preflight additive 校验,缺则 WARN 起步——见 SUPERVISED-MODE-GATES §9.4)。Methods 披露须覆盖两层双人(若某层实际单人,诚实写单人、不得声称双人)。

显式披露要求(强制):在主稿 Methods 节明示"双盲筛选(标题/摘要 + 全文两层)由 2 个独立 LLM SubAgent 执行 + 1 个仲裁 SubAgent 处理不一致项;每个 SubAgent 不可见对方决策"。完整披露原文参见 references/L6-screening-dual-blind.md §6.1(W5-4 唯一 10/10 范本,复制即可用)。

Cohen's κ 阈值化决策(W5FIXPLAN E.P1.3)

κ 值 决策
κ ≥ 0.60(严格模式期望)/ ≥ 0.40(学习模式期望) 仲裁不一致项即可
0.40 ≤ κ < 0.60 仲裁 + 重审 prompt(检查纳入排除标准歧义)
κ < 0.40 重做筛选(检查 SubAgent prompt 隔离失败 / 纳入排除标准歧义重大)

4.2.6 L7 双人提取(含 LLM 实现披露)

全文获取+转换外包(G6 · 外包交接包模式):L6 纳入判定后、L7 提取前,纳入研究的全文下载 + PDF→Markdown 转换同属程序性外部劳动——主 session 不做。生成全文请求包 fulltextrequestpack/(下载清单 CSV + downloadpolicy.yaml[Sci-Hub 预先点头 + 渠道白名单 + 依赖档位] + 自包含执行 Prompt)外包;执行器先 paper-downloader-portable 批量下(渠道白名单显式 + Sci-Hub 类需生成期预先点头 + 逐篇记实际渠道,治 U-08 不可追溯)→ 失败转手工逐库指引 → document-to-markdown PDF→MD + 抽图 + 保页码锚点(deriveanchors.pyanchors.json。回执格式契约见 meta-analysis/references/FULLTEXT-RECEIPT-FORMAT.md,经 scripts/validate_fulltext.py 硬门(文件在场/命名/转换完成/锚点可派生/MD 质量抽检:OCR 结构性掉行 + 元噪声,exit≠0 不摄入)验收。渠道纪律 = 公开边界红线上游执行面(G10 对齐)。

消费面(治 A-Q6 头号 token 浪费):提取 SubAgent 默认消费 MD + 按锚点回 PDF 关键页p.N Table M 粒度);整本读 PDF 降为例外(仅锚点降级/关键数值歧义时)。关键数值/方向一律回 01_原始PDF/ 核对(MD 为 OCR),结论附页/表锚点——这是实战验证过的消费纪律。

systematic-review 严格模式:

  • 派发 2 个独立提取 SubAgent
  • 按 SSOT-EXTRACTION-FIELDS 六大类字段(R/P/I/C/O/M)+ X 类(编码者)
  • 不一致项进入仲裁 + 报告 ICC(连续)/ Cohen's κ(分类)

LLM 双人提取披露原文(应用 C4 三段体例,复刻 L6 §6.1 范本):完整三段披露原文参见 references/L7-extraction-dual.md §"双人提取的诚实披露"。SubAgent 在 L11 写作时复制到 Methods 节"Data Collection Process"。

学习模式:单 SubAgent 提取 + 主 Agent 抽样 20% 复核(披露见 §9.3)。

4.2.7 L8 风险偏倚评估(按研究设计选工具)

按研究设计自动路由:

  • RCT → RoB 2(5 域 + Cluster/Crossover 变体)
  • 非随机干预研究 → ROBINS-I(7 域)
  • 诊断准确性 → QUADAS-2
  • 队列/横断 → NOS(Newcastle-Ottawa Scale)
  • 质性研究 → CASP / JBI Qualitative
  • 测量工具综述 → COSMIN
  • 单被试设计 → SCED Scale 或 RoBiNT Scale不是 SCRIBE — SCRIBE 是单被试报告指南,不是 RoB 工具,参见 SSOT-ROB-TOOL-MAPPING §11.2/§11.3)

主 Agent 按纳入研究类型批量分配,每篇研究按对应工具完整域评分。RoB 工具默认选择披露见 §10.3。

4.2.8 L9 综合(Synthesis) — 切换 MA 阈值决策表(W5FIXPLAN E.P0.5 修缮)

systematic-review 在 L9 默认走质性合成路径。切换 meta-analysis 决策表(替代原"k ≥ 5 且异质性可控"模糊表述):

数据条件 决策 路径
k ≥ 5 + I² < 75% + τ² 估计有效 推荐切换 meta-analysis systematic-review L1-L8 → meta-analysis L9-L12(切 MA 后 L10-L12 由 MA 完成,锁4 §4.4)
k ≥ 5 + I² ≥ 75% 留 SR L9 SWiM/Popay 不合并效应量;走 §11.4 异质性故障决策
k ≥ 5 + I² > 90% 完全禁止合并 + 强制 subgroup / meta-regression 参见 §11.4
k < 5(任意 I²) 留 SR L9 SWiM/Popay 元分析统计推断弱(Cochrane v6.5 Ch.10 §10.10.4)
数据类型异质(连续 vs 二分)/ 测量工具不可转换 留 SR L9 SWiM/Popay 不可元分析
质性证据综合 主题综合(Thomas-Harden 2008)/ 元民族志(Noblit-Hare 1988) 走 GRADE-CERQual

关键约束:禁止使用基于显著性的 vote counting(Cochrane v6.5 Ch.12 §6.5/6.6 — 不可接受方法)。

L9 综合方法决策写入 decisions/09synthesisdecision.md

4.2.9 L10 GRADE 证据等级

每个关键 Outcome 单独评 GRADE(Cochrane v6.5 Ch.14):

  • 起始等级:RCT = High,NRSI = Low(ROBINS-I 启用时可豁免到 Moderate)
  • 5 降级因素:RoB / Inconsistency / Indirectness / Imprecision / Publication Bias
  • 3 升级因素:Large Effect / Dose-Response / Plausible Confounders Reduce
  • 输出 Summary of Findings 表(GRADEpro 格式)

质性证据综合走 GRADE-CERQual(4 维度:Methodological Limitations / Coherence / Adequacy / Relevance)。

4.2.10 L11 写作 + 报告(PRISMA 2020 27 条)

主 Agent 整合各阶段产出,写主稿。结构对应 PRISMA 2020 27 条:

  • Title (1) / Abstract (2) / Introduction (3-4) / Methods (5-15) / Results (16-22) / Discussion (23-26) / Other (27)

心理学场景叠加 APA JARS-Quant Table 9(MARS)12 处差异。

PRISMA 流程图(SSOT-PRISMA-FLOW-DIAGRAM)4 阶段强制:Identification → Screening → Eligibility → Included。

4.2.11 L12 综述自评(AMSTAR 2 + ROBIS)

systematic-review 强制 AMSTAR 2 自评:

  • 16 项 7 关键域逐条自评
  • 输出置信度等级(High / Moderate / Low / Critically Low)
  • 严格模式目标 ≥ Moderate(最好 High)
  • 学习模式不强制(但鼓励)

ROBIS(综述自身偏倚风险)作为 Tier 2 推荐项。


5 SubAgent 任务模板

详见 references/subagent-templates.md。顶层映射:

  • L1 type-identification-agent / L2 pico-construction-agent / L3 protocol-registration-agent(各 1,串行前置)
  • L4 search-strategy-design-agent + press-review-agent(串行)
  • L5 search-execution-agent + dedup-agent + citation-tracking-agent(可并行)
  • L6 screening-agent ×2 双盲 + arbitration-agent(2 并行 + 仲裁串行)
  • L7 extraction-agent ×2 双人 + extraction-arbitration-agent(同 L6 编排)
  • L8 rob-assessment-agent(1 或按设计分多个,可并行)
  • L9 synthesis-agent / L10 grade-assessment-agent(各 1,串行)
  • L11 writing-agent + reporting-agent + prisma-flow-agent + writing-process-archive-agent(4 个,串行;后两个为 W5FIXPLAN E.P1.5 新增)
  • L12 amstar-self-assessment-agent + robis-agent(Tier 2)

总计 ~16-18 个 SubAgent(双盲/双人提取为最大并行峰值)。


6 派发 SubAgent 复制块 + references 加载(G5:填空题投放,非选择题加载)

机制(治病根,同 §3.1):实测一个 reference 被不被读,100% 取决于派发 prompt 是否点名它。故对载荷密集阶段(L6-L11),派发时把复制块整段贴进 SubAgent promptreview-methodology-foundations/references/PROMPT-COPY-BLOCKS.md §C,前置其 §A 共享底座块 = LAUNCH-DIGEST §0/§2/§3)——关键载荷进 prompt(填空题),SubAgent 读不读深文件不再决定成败。下钻路径经 SSOT-INDEX.md 全库 resolver 解析(治 wrong-path;注意 L2-protocol-registration.md 实服务 L3、L1-question-construction.md 覆盖 L1+L2)。

阶段·动作 复制块 / references 该阶段最高危载荷(一句)
L1 类型判定 / L2 PICO 构造 references/L1-question-construction.md 4 项判定矩阵;三层 PICO;FINER 5 项
L3 协议起草 / 模式选择 references/L2-protocol-registration.md(+ L3-mode-disclosures.md 披露) 注册或显式未注册声明;协议偏离必记(禁 HARKing)
L4 检索策略 references/L4-search-protocol.md ≥4 库+PRESS;主题词+自由文本双轨
L5 检索执行 references/L5-prisma-s-execution.md PRISMA-S 16 项;Bramer 6 步去重;命中数记录
L6 双盲筛选 ×2+仲裁 COPY-BLOCKS §C·L6 全文筛=双人硬点;κ≥0.60 仲裁 / <0.40 重做;自动预筛标准流程(追认④,§4.2.4)
L7 双人提取 ×2+仲裁 §C·L7 双人 κ≥0.7 / ICC;8 类信息全覆盖 + 信度字段
L8 RoB 评估 §C·L8 工具×设计必配(RCT→RoB2 / NRSI→ROBINS-I / 单被试→SCED 非 SCRIBE / 单组前后测→ROBINS-I UBA);研究层×outcome 层两级
L9 综合 SWiM/Popay §C·L9 基于显著性的 vote count 禁令(Cochrane);PRISMA+SWiM 9 项;§4.2.8 切 MA 决策表
L10 GRADE §C·L10(L10-grade.md 住本 skill) "研究数少"≠imprecision(用 OIS);升级前先 5 降级;SoF≤7
L11 写作 ×4 §C·L11 PRISMA 27 项 + 24-27 不遗漏;流程图 4 阶段;Limitations ≥4 维
L12 自评 references/L12-amstar2-self-assessment.md AMSTAR 2 16 项 7 关键域;任一失分 Critically Low
写/查决策档案 references/decision-provenance.md + COPY-BLOCKS §D 规划文档=上下文容器(追认①,§3.3);禁自证式"已读"勾选
任何 Review-Agent 前 references/quality-control.md 跨阶段交叉对账(§14.3)+ 四铁律

subagent-templates.md = 各角色 6 段完整模板(on-demand 深潜;复制块 = 其"必读段"的即用压缩,主 Agent 无需先开模板即可派发)。


7 字数控制

字数公式与矩阵详见 review-methodology-foundations/references/SSOT-WORDCOUNT-RULES.md §3.1(综述类型 × 文献规模矩阵第 4 行:系统综述)+ §3.3(调整因子)+ §4(字数纪律)。本节不复制 SSOT 数字。

  • 默认字数:12,000 字(SSOT §2.2 系统综述行);下限 8,000 字
  • 三种确认模式:A(用户已指定 → 直接采用)/ B(未指定 → 默认 12,000 + 通知 + 不阻塞)/ C(自适应 → L7 完成后按 SSOT §3.1 矩阵估算)
  • 严格 vs 学习模式:均按 SSOT §3.1 矩阵;严格模式下限 8,000 字
  • 字数纪律:不硬凑 / 不铺陈 / 质量优先(详细定义见 SSOT §4)
  • 字数严重不匹配阈值:参见 §11.6(应用 C2)

8 何时加载底座 SSOT(路径权威 = 全库 resolver)

路径唯一权威 = review-methodology-foundations/references/SSOT-INDEX.md(全库 file-resolver):阶段/关键词 → 唯一正确路径,覆盖三 skill 全部 references(治两次实战 wrong-path;跨 skill 归属陷阱见其 §B)。全文按需下钻时用 resolver 解析,不凭阶段编号直觉猜路径。SR 各阶段核心 SSOT:

阶段 / 决策点 SSOT
启动后立即(主 Agent 必读) LAUNCH-DIGEST.md(≤10k 启动即必读,蒸馏三件套载荷 + §1.2-18 前沿条款六表);三件套全文(AI-FAILURE / LIFECYCLE / TERMINOLOGY)降级为按需下钻
L1 类型决策 SSOT-REVIEW-TYPES
L2 PICO 三层 SSOT-PICO-FRAMEWORKS
L3 模式选择 SSOT-MODE-PROFILES
L4 检索策略 SSOT-SEARCH-STRATEGY
L5 PRISMA-S SSOT-PRISMA-S-TEMPLATE
L6 流程图准备 SSOT-PRISMA-FLOW-DIAGRAM
L7 提取字段 SSOT-EXTRACTION-FIELDS
L8 RoB 工具映射 SSOT-ROB-TOOL-MAPPING
L9 综合方法 SSOT-SYNTHESIS-METHODS(如切到 MA 加 SSOT-EFFECT-SIZE-DECISION)
L10 GRADE SSOT-GRADE-FRAMEWORK
L11 报告标准 SSOT-REPORTING-STANDARDS(心理学叠加 SSOT-PSYCHOLOGY-SUPPLEMENTS)
L12 自评 SSOT-AMSTAR-2-CHECKLIST
心理学场景 SSOT-PSYCHOLOGY-SUPPLEMENTS
中文场景 SSOT-CHINESE-CONTEXT
字数 SSOT-WORDCOUNT-RULES

9 严格 / 学习 / 监督模式

参见 review-methodology-foundations/references/SSOT-MODE-PROFILES.md v2.0.0(系统综述子集 §4.4 + 三模式定义 §1)。

三模式速览:严格(顶刊投稿,全自动 + 人最终验收一次)/ 学习(课程作业,简化 + 抽样核查)/ 监督(§9.4:发表级方法学完整度 + 人在 7 不可逆点逐一签字把关)。监督模式见 §9.4。

9.1 严格模式(默认)

目标:顶刊投稿、循证临床、Cochrane 标准、AMSTAR 2 ≥ Moderate。

完整执行 12 阶段,全部 Tier 1(25 项)。Tier 2 推荐:PRESS、AMSTAR 2 自评、Open Science 披露。

9.2 学习模式(用户主动声明或场景判断)

目标:课程作业、开题报告、学习方法论、时间预算 ≤ 1 周。

简化的 11 项 Tier 1:

  • 保留:L1 / L2 / L4(≥ 2 库)/ L5(简化布尔)/ L6(关键字段)/ L8(简化 3-4 项 RoB)/ L9(基础综合)/ L11(PRISMA 核心 8-10 条 + 流程图)
  • 跳过但披露:L3(声明未注册)/ L4(PRESS)/ L6(双盲降级为单 SubAgent + 抽样人工核查)/ L10(GRADE 不强制)/ L12(AMSTAR 不强制)

学习模式 ≠ 不规范。三条硬约束:

  1. 保留 L1+L2+L11(类型识别、PICO、按报告标准写)
  2. 保留 PRISMA 流程图
  3. 综述末尾"Method Limitations"按 §9.3 披露原文模板逐条列出简化点

模式判定规则参见 SSOT-MODE-PROFILES §2.1(用户场景 → 推荐模式决策表)+ §4.2.1 L1 4 项判定矩阵。

9.3 学习模式 5 简化点的诚实披露原文模板(应用 C4 三段体例,W5FIXPLAN E.P0.6)

学习模式允许在 5 个简化点降级,但必须在主稿 Methods / Limitations 显式披露。每段披露含三段:教材原假设 / LLM 实现差异(≥ 3 处差异列举)/ 缓解措施 + Limitations 披露。

完整三段披露原文模板存放于 references/L3-mode-disclosures.md,主 Agent 在 L11 写作阶段加载该文件复制对应模板。5 个简化点:

# 简化点 嵌入主稿位置 教材依据
1 跳过 PRESS 同行评审(L4) Methods §4.3 Search Strategy 末尾 Cochrane v6.5 §4.4.5
2 双盲筛选降级(L6) Methods §4.4 Selection Process 末尾 Cochrane §4.6 + AMSTAR 2 Item 5
3 跳过 GRADE(L10) Methods §4.11 Certainty Assessment + Discussion Limitations Cochrane v6.5 Ch.14
4 跳过 AMSTAR 2 自评(L12) Discussion Limitations 末尾 Shea et al. 2017 BMJ
5 协议未注册(L3) Methods §4.0 Protocol and Registration Cochrane v6.5 + AMSTAR 2 Item 2 (CD 1)

每个简化点的完整三段披露原文("段 1 教材原假设 / 段 2 LLM 实现差异 ≥ 3 处 / 段 3 缓解措施")参见 references/L3-mode-disclosures.md。学习模式主 Agent 必须为本综述实际触发的简化点逐一嵌入对应模板(不允许"段 1+段 3"省略段 2)。

9.4 监督模式(Supervised Mode)

一句话:AI 把粗活干完(检索执行、双盲筛选、双人提取、初稿),人只在机器判不了的 7 个关键节点拍板——方法学和严格模式一样完整(PRISMA 2020 全 27 条 / AMSTAR 2 ≥ Moderate),但每个不可逆的决策都有人亲自签字担责。定义见 review-methodology-foundations/references/SSOT-MODE-PROFILES.md §1.4。

什么时候选它:教授/导师要的"AI 初编、人 check、确保不出错、达发表级"——既不放心让 AI 全自动一路跑过关键判断,又不能用课程级的随机抽查。一个研究者 + AI 协作产出可投稿的系统综述、但要逐点亲自把关时,选监督模式。

它和严格模式差在哪:方法学完整度一模一样(都是发表级 Tier 1 全覆盖),唯一区别是把"最后人验收一次"换成"7 个不可逆点各审一次"。系统综述侧,前几个签核点主要落在 L4 检索+纳排冻结、L6 筛选分歧、L7 提取校准/低置信(后续 L9/L11 解读与引用终审在切到元分析终点时由 meta-analysis 路径承接,见 §13.1)。每点产一张为它定制的审核卡,人看卡拍板"接受还是打回"。

为什么是"真门"而不是"提醒一下":每个签核点的裁决落进 decisions/ 对应文件的 user_signoff 标记。下游阶段启动前由 preflight 脚本读它——没签字 / pending / 打回 → 脚本退出码 ≠ 0,下游根本启动不了。同时 κ 由脚本算(不是 AI 心算)、可复现性硬检查(缺 sessionInfo / 退出码 ≠ 0 / κ 太低 / 种子召回不足)先于人审直接阻断。7 门的运行时操作契约(每门触发时机、产物路径、preflight 命令、缺签阻断哪个下游、硬检查、审核面上限)见 review-methodology-foundations/references/SUPERVISED-MODE-GATES.md

平衡(两边都不过拟合):不处处拦人审——双盲一致项自动放行、κ 判 pass 且无红灯则该点无人审队列、可逆中间产物不设门;也不放任 AI 跑过关键判断——7 个不可逆冻结点、筛选分歧/提取低置信/关键数值必审。每个签核点待审条数设上限,超限收紧上游过滤而非把长清单甩给人。

签核体验(G1 vNext,2026-07-03 · 两段式):运行中=心流优先的知情确认(保留「(推荐)」预标+理由+后果+下钻+打回;不做负样本注入、不加考验摩擦),真正的独立人类审核在事后署名人审核包(L12.5)。卡/gate 合一(唯一人面文档=gate markdown 六段 a-f,HTML 卡为可选增强);判断点由结构化决策块单一源头驱动,signoff_ask.py 是唯一合规提问/回填通道(agent 不许手写 signed);preflight additive 强制同源 hash / 证据完备 / 叙事自洽 / 三字段。完整机制见 review-methodology-foundations/references/SUPERVISED-MODE-GATES.md §0.5。

披露:监督模式产出须披露"哪些步 AI 做、人在 7 签核点各审了什么"(RAISE:人类监督 + 透明披露 + 最终责任在人)。披露强度由签核事实(presentedvia/evidenceopened/签字页状态)机读生成、单调不超过事实、语义用 attestation;两段式如实写作:in-run informed confirmations with drill-down access + post-hoc independent audit via structured audit package。详见 SSOT §6.6。

负责任使用(单一 SSOT):监督模式的立场、两段式监督模型、7 门与诚实边界的完整表述见发布仓根 RESPONSIBLE_USE.md——核心:AI 初编 + 人在 7 门签核 + 署名人负全责;运行中=知情确认(非独立判断),事后审核包=真正的独立人类审核;披露强度机读生成、单调不超过事实;不支持无人审核的自动投稿。


10 心理学场景与中文场景的特殊处理

10.1 心理学场景

触发条件:按 SSOT-PSYCHOLOGY-SUPPLEMENTS.md §0.4 4 类信号清单(APA 期刊 / 量表名 / 心理学构念 / 复制危机 + JARS 关键词)扫描,任 1 类命中即触发。判定结果(yes/no/boundary)写入 decisions/01typedecision.md 心理学判定字段(决定 L11 是否叠加 JARS-Quant)。

参见 SSOT-PSYCHOLOGY-SUPPLEMENTS.md。SR 心理学场景额外要求:

  • APA JARS-Quant Table 9(MARS)12 处差异(SSOT-REPORTING-STANDARDS §3)
  • APA Thesaurus(PsycINFO)替代 MeSH
  • 心理学元分析 8 议题(L9 切到 meta-analysis 时叠加)
  • 复制危机响应:预注册声明、p-curve、Many Labs(SSOT-EXPERT-METHODOLOGY-INSIGHTS 维度 5)

按综合路径切换 JARS 子标准:L9 量化综合 → JARS-Quant Table 9(MARS);L9 质性综合(SWiM / 主题综合 / 元民族志)→ JARS-Qual Table 2 + ENTREQ;混合方法 → JARS-MM Table 1

期刊投稿映射:Psychological Bulletin / Psychological Review → JARS-Quant Table 9 + APA 7 + Open Science;心理学报 / 心理科学进展 → 参照 SSOT-CHINESE-CONTEXT。

10.2 中文场景

参见 SSOT-CHINESE-CONTEXT.md。中文 SR 特殊要求:CNKI 检索语法 + 主题词;中文核心期刊综述格式(《心理学报》《心理科学进展》《管理世界》);GB/T 7714-2015 引用格式(vs APA 7);预注册可选"预见(PRECISE-CHINA)"+ PROSPERO 中文版。中文检索回退路径见 §11.1(检索主路径 paper-search-pro;中文 0 命中 → 人工导出 CNKI/万方题录 → ingestsearchexports.py 摄入;关键约束:不擅自降级英文检索代替中文检索)。

10.3 默认 RoB 工具选择的诚实披露(应用 C4,W5FIXPLAN E.P1.4)

主 Agent 在 L8 阶段使用按研究设计自动路由的 RoB 工具选择策略(教材依据:Cochrane v6.5 §8 / §25 / §28),需在主稿 Methods 节"Study Risk of Bias Assessment"嵌入完整三段披露(教材假设 / LLM 实现差异 ≥ 3 处 / 缓解措施 + Limitations 披露)。完整披露原文模板参见 references/L8-rob-assessment.md §"默认 RoB 工具选择的诚实披露"。

关键约束:单被试设计使用 SCED Scale 或 RoBiNT Scale(不是 SCRIBE — SCRIBE 是单被试报告指南,不是 RoB 工具)。详见 SSOT-ROB-TOOL-MAPPING §11.2/§11.3。


11 故障诊断与回退(应用 C2 模板)

本章节按"诊断信号 + 阈值 + 回退路径"三件套组织。故障切换决策写入 decisions/<阶段>failureswitch.md

11.1 检索主路径与回退(含中文场景)

检索主路径 = paper-search-pro Skill(OpenAlex / Semantic Scholar / CrossRef / PubMed 均走 HTTP API,需配置对应 API key,无需任何 MCP server)。若运行环境未提供 semantic-scholar / openalex MCP server(常见默认情况)——故障诊断以"paper-search-pro 检索结果异常"为准,以"SS/OpenAlex MCP 报错"为准(该环境下这类报错不会出现)。中文检索因 OpenAlex/SS/CrossRef/PubMed 覆盖中文文献有限,主路径 = 用户人工导出 CNKI/万方 → scripts/ingestsearchexports.py 摄入。

故障信号 回退路径
英文检索 0 命中 / 召回过低(关键词为英文,paper-search-pro 命中明显不足) 扩展同义词 / 放宽布尔逻辑重检;跨源交叉(OpenAlex↔CrossRef↔PubMed)补召回
中文检索经 paper-search-pro 0 命中(0 命中 + 关键词为中文) (a) 用户人工导出 CNKI / 万方 / VIP 题录 → scripts/ingestsearchexports.py 摄入统一字段;(b) 已有文献集时转 literature-set-review关键约束:SubAgent 不擅自降级英文检索代替中文检索
检索整体不可用(HTTP 持续失败 / 网络受限 / key 失效,持续失败 ≥ 3 次) 阻断 + 警示用户 + 引导人工导出题录后走 ingestsearchexports.py + 不强行降级到本地推理凭记忆编造文献
检索结果元数据不完整(abstract 缺失 ≥ 50%) 派发 firecrawl-abstract Skill 补抽(见下注降级路径) OR 扩展同义词重检索

firecrawl-abstract 降级注若运行环境无 semantic-scholar MCP server → 该 Skill 的 paper_details(Semantic Scholar API / SS 法)通道不可用;默认走 Firecrawl Scrape / Firecrawl Extract 两法(Firecrawl key 在场可用),按 DOI / URL 抓取并解析摘要。

11.2 检索回报极端值(W5FIXPLAN E.P1.2)

  • identify_count > 50000强制降级(不允许继续作为 SR),扩窄 PICO 或转 FO
  • identify_count > 10000 → 强烈建议降级(PICO 扩窄 / 切到 FO)
  • identify_count ∈ [5, 20) → 警示 + 询问用户是否扩展 PICO 或转 LS
  • identify_count < 5 → 阻塞 + 切到 LS 或扩展 PICO

引用 PRISMA-S Item 15-16 报告。

11.3 数据严重不足

  • L7 数据可提取字段 < 50% → 主 Agent 仲裁;不能 → 切到 FO
  • 含信度数据的研究 < 5(心理学元分析)→ 信度概化 sensitivity;Hunter-Schmidt 警示 + 抽样校正
  • §4.2.1 4 项判定矩阵 = 1/4 → 切到 FO/LS

11.4 异质性极端 / 综合失败(W5FIXPLAN F.P1.4 协同)

  • I² > 75%(合并阻断)→ 不允许仅合并效应;改用 subgroup / meta-regression
  • I² > 90%(极端)→ 完全禁止合并 + 必须 subgroup / meta-regression / SWiM
  • k < 5 异质性高 → 不元分析,转 SWiM/Popay

应用 §4.2.8 L9 切换 MA 决策表执行。

11.5 双盲筛选 κ 异常 + 11.6 字数严重不匹配

  • κ 异常(详见 §4.2.5):κ ≥ 0.60 仲裁不一致即可;0.40 ≤ κ < 0.60 仲裁 + 重审标准歧义;κ < 0.40 重做筛选
  • 字数严重不匹配(SSOT-WORDCOUNT-RULES §8):偏差 ≥ 30% 报告用户 + 建议调整;偏差 ≥ 50% 强制调整或转 Skill

12 输出格式与文件命名

工作目录结构 <task_root>/工作产出/

  • decisions/01typedecision.md ... 11reportingstandard.md(决策档案 11 类)
  • L1typeidentification.md / L2picoconstruction.md / L2synonymgroups.md / L2finercheck.md
  • L3protocoldraft.md / L3registrationstatement.md
  • L4searchstrategy.md / L4databaselist.md / L4greyliterature_plan.md
  • L5searchrecords<database>.csv / L5searchdocumentation<database>.yaml / L5deduplog.md / L5finalrecords.csv
  • L6screeninglog.csv / L6arbitrationlog.md / L6excludedstudieswithreasons.csv
  • L7extraction<agentID>.csv / L7extractionfinal.csv / L7extractionconsistency.md
  • L7toMAfieldmapping.md(SR L7 → MA L9.1 字段映射,W5FIXPLAN E.P1.6)
  • L8robassessment.csv / L8robsummarytable.md / L8trafficlightplot.md
  • L9synthesisresults.md
  • L10gradeassessment.csv / L10summaryof_findings.md
  • L11manuscript.md(主稿)/ L11prismaflowdiagram.md(prisma-flow-agent 产出)/ L11writingprocess_archive.md(writing-process-archive-agent 产出)
  • L12amstar2selfassessment.md / L12robis_assessment.md(严格模式 Tier 2)
  • finalqualitycheck.md

文件命名规则:L<N><task>.<ext>(与 LS PRES-016 NN 前缀风格平行)。

纯 SR 路径 L12 交付打包(G9 指针):纯 SR 终稿的交付打包与联合路径同一规范——①调 manuscript-typeset 默认产投稿四件(docx / PDF man / PDF jou / 干净 md,不待用户追加;四元组见 §13.4);②按 manifest 五节模板产 03交付/00交付清单manifest.md(模板 = meta-analysis/references/delivery-manifest-template.md住 meta-analysis 被本 Skill 引用;§3a 逐条覆盖①产出的 PLACEHOLDERS.md、§1 登记实产件数);③与 L12.5 审核包的 00审核入口.md 分离互链,不合并(manifest = 投稿物索引;审核入口 = 署名人终审动线)。完整五步见 meta-analysis SKILL §12.4(联合路径 L12 归 MA,锁4 §4.4)。


13 与其他 Skill 的关系

13.1 配套关系(强推荐组合)

  • systematic-review + meta-analysis:systematic-review 完成 L1-L8,meta-analysis 完成 L9-L12(量化合成 + GRADE + APA MARS 报告 + AMSTAR 2;锁4 §4.4:以元分析为终点的联合路径 MA 拥有 L9-L12)。投顶刊系统综述 + 元分析的标准组合。联合工作流路由:systematic-review L1-L8 → 应用 §4.2.8 L9 切换 MA 决策表 → meta-analysis L9-L12。
  • systematic-review + ma-plots 渲染器 / ssci-plots:森林图、漏斗图属元分析路径(上条联合工作流,由 meta-analysis §13.2 内置渲染器产出);纯 SR 路径 L11 的 PRISMA 流程图 / RoB 图 = ma-plots 固定渲染器固定命令prismaflow.py / robtraffic.py + QC exit≠0,渲染器住 meta-analysis/scripts/plots/ 被本 Skill 引用,四元组见 §13.4);ssci-plots = 样式底座 + 非四件套通用统计图出口。

13.2 替代关系(用户选错时切换)

用户场景 应切换到 理由
只想探索领域、不要严格 PRISMA field-overview-review 探索式综述,无双盲、无 RoB
想做 50 年发展史、领域演化 field-evolution-review 时间维度 + 5 维度检索
已有文献集、不再检索、无 PRISMA 要求 literature-set-review 跳过 L4-L5、增加输入质量自审
已有文献集、要 PRISMA / Cochrane systematic-review(本 Skill) 跳过 L4-L5 检索、保留 L1-L3 + L6-L12(消除与 LS 模糊地带
理论建构、构念分析、对立理论比较 theoretical-review 论证为主、方法宽松、Psychological Review 风格
只做量化元分析 meta-analysis 直接进 L9 量化(如已有完整数据)

13.3 降级路径

如果用户初始想做系统综述但发现不可行(如检索回报量 > 50000、研究异质性极高、文献不足),主 Agent 应推荐降级:

  • 降到 field-overview-review(整合综述路径)
  • 或降到 literature-set-review(手头文献集驱动)
  • 不允许在 systematic-review 中"压缩到 PRISMA 2 条"

13.4 卫星依赖矩阵(四元组硬契约 —— G9)

定位:同 meta-analysis SKILL §13.4——每个卫星调用锁成四元组命令行契约【何时调 / 命令或入口 / IO 契约 / 缺失时降级】,替代叙述性"联动"(E-Q4 病根:叙述性依赖可被合法绕开)。每行"缺失时降级"给明确阻断/降级动作,禁静默。路径 = skill-根相对路径;<skill> = 该 skill 根目录(严禁 runtime ~/.claude/skills/ 与裸相对 skills/)。

卫星 何时调 命令或入口 IO 契约 缺失时降级
paper-search-pro L4/L5 检索主路径(L4 冻结签核后执行检索) Skill 工具显式加载并触发(HTTP API:OpenAlex / Semantic Scholar / CrossRef / PubMed,key 已配,无 MCP) 进:检索式。出:题录导出(BibTeX/RIS/CSV)→ scripts/ingestsearchexports.py 摄入;外包路线时回执先过 scripts/validate_exports.py 硬门(exit≠0 不摄入,§4.2.4) → §11.1 回退表(中文 0 命中 → 人工导出 CNKI/万方 → ingest 摄入;整体不可用 → 阻断警示、不凭记忆编造文献)+ G6 检索请求包人工路线(§4.2.4)。本行指针即可,不复述 §11.1
document-to-markdown + paper-downloader-portable L6 纳入判定后、L7 提取前(全文下载 + PDF→MD 转换) G6 全文请求包机制(不直接调 CLI):主 session 产 fulltextrequestpack/(downloadlist CSV + downloadpolicy.yaml + 自包含执行 Prompt)外包给可插拔执行器(§4.2.6;模式 = review-methodology-foundations/references/OUTSOURCING-HANDOFF-PATTERN.md 进:downloadlist.csv + downloadpolicy.yamlallowscihub 一次性预先点头 / 渠道白名单 8 枚举 / 依赖档位)。出:回执按 meta-analysis/references/FULLTEXT-RECEIPT-FORMAT.md(8 字段 fulltextreceipt.csv + 人读清单;住 meta-analysis 被本 Skill 引用,resolver §B #9);scripts/validate_fulltext.py 硬门验收(exit≠0 不摄入;--receipt --policy 渠道纪律 fail-closed) G6 依赖档位download_policy.downloader.tier):本地 paper-downloader-portable 优先;缺 → 第三方下载 skill(G10 依赖矩阵选定,档位占位)或 manual-only 手工逐库指引。d2m(执行 Prompt 必需转换器)缺 → 换具备 d2m 的执行器,或转换缺件如实进回执 + 主 session 阻断消费并披露——主 session 不回退自己下载/转换
ma-plotsmeta-analysis/scripts/plots/ 被本 Skill 引用,非独立 skill) 纯 SR 路径 L11 的 PRISMA 流程图 / RoB 图(联合路径产图归 MA L11,见 §13.1) python3 <meta-analysis>/scripts/plots/prismaflow.py --counts <prismacounts.yaml> --out <stem>python3 <meta-analysis>/scripts/plots/robtraffic.py --data <robdomains.csv> --labels <labels.csv> --tool both --out <stem>--tool 亦可 rob2 / robinsCLI 签名权威 = meta-analysis/scripts/plots/README.md 进:meta-analysis/references/prisma-flow-contract.md(counts YAML)/ rob-figure-contract.md(domains CSV)。出:<stem>.png + <stem>.pdf;退出码 0/1/2/3,QC exit≠0(码 2 非 warn-only)不落盘labels 机械同源纪律同 MA §13.2:--labels 从特征表 / ID 对照卡机械生成并落盘、禁手造;交付验收抽行核"显示名↔study_id↔数值三方一致" 渲染器或其依赖缺失 → 阻断交付图并明确报告缺什么(不静默、绝不现场手写渲染代码顶替);缺 R / 官方包(PRISMA2020 / robvis)→ exit 1 明确报错--warn-only 不降)→ 装包后重跑
manuscript-typeset(独立通用 skill) 纯 SR 路径 L12 终稿交付打包(联合路径归 MA §12.4);默认产投稿四件,不待用户追加 python3 <manuscript-typeset>/scripts/typeset.py --request typeset_request.yaml --outdir <dir> 进:typesetrequest.yaml(契约权威 = manuscript-typeset/references/MANUSCRIPT-INPUT-CONTRACT.md)。出:四件(投稿 docx / 投稿 PDF man / 发表预览 PDF jou / 干净 md)+ BUILDNOTES / PLACEHOLDERS / STRIP_REPORT。退出码 0/1/2/3;fidelity fail = exit 2 该件不落 + 阻断(无 --warn-only xelatex → 降级出 docx + md 两件(exit 0 + BUILD_NOTES 声明);缺 pandocexit 1 阻断并报告;fidelity fail 永不降级
academic-ref-check 引用终审(L11 终稿 + 引用表定稿后、交付前);纯 SR 终稿同样 100% 过核验(academic-reference-verification Rule);监督模式联合路径 = SP7 门 python3 <academic-ref-check>/scripts/verifyhttp.py --in L11refs.json --out-dir decisions/ --topic "终稿引用"(或 --in-text L11_references.md 自解析);接线细节 = meta-analysis/references/L11-mars-reporting.md §8.3 进:终稿全部引用。出:decisions/L11refverify_report.md(人读)+ .json(机读);逐条核验存在/第一作者姓/期刊/年份 + 补回 DOI。退出码:有红→1 / 否则 unverified→3 / 否则有黄→2 / 全绿→0 核验能力缺失 ≠ 通过(fail-closed):改人工多源核验(OpenAlex / CrossRef 手查)且负担显式披露;unverified 须重跑至可判;绝不"跳过核验照交付"

14 Skill 独有方法学章节

14.1 学习模式简化点的诚实披露

学习模式 5 简化点的完整 C4 三段披露见 §9.3。

14.2 默认 RoB 工具选择的诚实披露

按研究设计自动路由的披露见 §10.3(含 SCED/RoBiNT vs SCRIBE 修正)。

14.3 跨阶段交叉对账(PRES-004 多角度验证保留)

阶段间交叉对账机制(防漏防错)参见 references/quality-control.md §2-§3:

  • L2 → L4 / L4 → L5 / L5 → L6 / L6 → L7 / L7 → L8 / L8 → L10 / L9 → L10 / L10 → L11 / L11 → L12

15 参考文档清单

15.1 教材基础:Cochrane Handbook v6.5(2024)/ Cooper 5e Research Synthesis and Meta-Analysis(2017)/ Higgins et al. Cochrane Handbook / Borenstein et al. Introduction to Meta-Analysis 2e(2021,配套 meta-analysis Skill)/ JBI Manual for Evidence Synthesis(2024,质性证据综合)。

15.2 报告标准:PRISMA 2020(Page et al. 2021 BMJ,27 条 + 4 阶段流程图)/ PRISMA-S(Rethlefsen et al. 2021 Syst Rev,16 项)/ PRISMA-P(Moher et al. 2015,17 项协议预注册)/ AMSTAR 2(Shea et al. 2017 BMJ,16 项 7 关键域)/ GRADE Working Group(Cochrane Ch.14 + GRADE Handbook)/ ROBIS(Whiting et al. 2016 J Clin Epidemiol)。

15.3 风险偏倚工具:RoB 2(Cochrane v6.5 Ch.8,RCT 5 域)/ ROBINS-I(Ch.25,NRSI 7 域)/ QUADAS-2(诊断)/ NOS(队列/横断)/ CASP / JBI Qualitative(质性)/ COSMIN(测量工具)/ SCED Scale / RoBiNT Scale(单被试设计 RoB 工具;SCRIBE 是单被试报告指南,不是 RoB 工具)。

15.4 SSOT 引用清单

本 Skill 通过引用而非粘贴使用 review-methodology-foundations 的 20 个 SSOT。完整 SSOT × 阶段映射参见 §8 + review-methodology-foundations/references/SSOT-INDEX.md。简表:SSOT-REVIEW-TYPES(L1)/ SSOT-LIFECYCLE-12-PHASES(全)/ SSOT-METHODOLOGY-TERMINOLOGY(弱)/ SSOT-AI-FAILURE-DEFENSES(全 必读)/ SSOT-EXPERT-METHODOLOGY-INSIGHTS(仲裁)/ SSOT-PICO-FRAMEWORKS(L2)/ SSOT-SEARCH-STRATEGY(L4)/ SSOT-PRISMA-S-TEMPLATE(L5)/ SSOT-PRISMA-FLOW-DIAGRAM(L6/L11)/ SSOT-EXTRACTION-FIELDS(L7)/ SSOT-EFFECT-SIZE-DECISION(L9 切 MA 时)/ SSOT-ROB-TOOL-MAPPING(L8)/ SSOT-SYNTHESIS-METHODS(L9)/ SSOT-GRADE-FRAMEWORK(L10)/ SSOT-REPORTING-STANDARDS(L11)/ SSOT-AMSTAR-2-CHECKLIST(L12)/ SSOT-PSYCHOLOGY-SUPPLEMENTS(心理学场景)/ SSOT-CHINESE-CONTEXT(中文场景)/ SSOT-MODE-PROFILES(L3)/ SSOT-WORDCOUNT-RULES(L11)。


16 变更记录

  • 2026-06-10(v1.1.1):修复轮 F10–F17(依据 = 2026-06-10 实测审计)。新建 review-methodology-foundations/references/SSOT-INDEX.md(修复本文件 §8 / §15.4 的断链引用);subagent-templates / L6 / L7 中的硬编码模型名参数化(规范性语句改为"当前可用的最强模型",披露模板原文改为按会话如实填写的占位符)。
  • 2026-06-20(S4 WP-C 编排修补):§2.4 / §4.2.8 / §13.1 联合路径 L10-L12 措辞消歧——按锁4 §4.4 裁定,以元分析为终点的联合路径由 meta-analysis 完成 L9-L12(GRADE/报告/AMSTAR2 由 MA 产),纯 SR 路径仍 SR 完成 L10-L12(原"回 systematic-review 完成 L10-L12"在切 MA 场景与 MA §12.1 交付物清单冲突,已消歧)。SR L7→MA L9.1 字段映射表(L7-extraction-dual.md §11)由 S4 同步重写对接 MA L9.1 §8.2 输入契约(关 BK-2)。
  • 2026-06-23(S6B WP-E② 监督模式):关 BK-9。§9 标题改"严格 vs 学习"→"严格 / 学习 / 监督" + 三模式速览,新增 §9.4 监督模式(= 严格方法学完整度 + 人在 7 不可逆点 SP1-SP7 结构性强制门决策审核;何时选=教授诉求"AI 初编+人 check 达发表级";SR 侧签核点主要落 L4 检索冻结/L6 筛选/L7 提取,L9/L11 在切 MA 终点时由 MA 路径承接;真门=preflight 缺签 exit≠0 + κ 由脚本算 + 硬检查先于软评;平衡=两边都不过拟合 + 审核面上限;披露=RAISE 人类监督+透明+最终责任);指向操作契约 review-methodology-foundations/references/SUPERVISED-MODE-GATES.md + SSOT-MODE-PROFILES v2.0.0。用户面文字按 meta-analysis/scripts/CARDNARRATIVEVOICE.md 精神去黑话。仅改 §9(OWNER_MAP §2.2 段落 owner),未触碰其余章节。
  • 2026-06-23(S7 WP-F Lane A 检索回退一致化):关 doc 12c P2-3/P2-4。§11.1 检索回退表去除运行环境不存在的 SS MCP 假信号(batchsearch 报错 / phantom limit / fields 类型 / "SS MCP 不返回 CNKI"),主路径改为 paper-search-pro(HTTP,OpenAlex/SS/CrossRef/PubMed key 已配)/ 中文人工导出 CNKI 万方 → scripts/ingestsearchexports.py 摄入;保留真实回退(中文 0 命中→人工导出+摄入/转 literature-set-review、整体不可用→阻断警示不凭记忆编造、元数据补抽)与关键约束"不擅自降级英文检索代替中文检索";§3.4/§10.2 检索回退 cross-ref 同步去 SS MCP 框架。新增 firecrawl-abstract SS 法降级注:运行环境无 SS MCP → paperdetails(SS 法) 不可用,默认走 Firecrawl Scrape/Extract 两法。仅改 §3.4/§10.2/§11.1(OWNER_MAP §2.2 S7 段落 owner),未触碰其余章节。
  • 2026-07-04(G5 必读投放与瘦身):治实战病根"references 39.3% 从未被读 / 三件套被跳 2/3 / 被读率=派发 prompt 点名的函数"。①§3.1 启动即必读改指 LAUNCH-DIGEST.md(≤10k)(蒸馏三件套 ≈72k 载荷 + §1.2-18 前沿条款六表,三件套/深层全文降级按需下钻);②§6 从"何时加载"改"派发复制块"(关键载荷经新建 PROMPT-COPY-BLOCKS.md §C 整段进 SubAgent prompt = 填空题构造性保证,最高危载荷一句内联本表);③§8 路径权威改指 SSOT-INDEX.md 全库 resolver(阶段→绝对路径,治 L10/L11/L12 住 SR 被 MA 引用的两次 wrong-path);④好偏离追认(公理 8):追认①规划文档=上下文容器(§3.3)+ 追认④验证式自动预筛标准流程(§4.2.4 指针 + L6-screening-dual-blind.md §12 新节:种子 100% 保全 + 双重假阴抽验 + Methods 披露,不替代双盲/全文双人);⑤required_readings 保字段砍报表 + 禁自证式"已读"勾选(模板删 + preflight --gate readings 一行 WARN)。仅改 §3.1/§6/§8/§3.3/§4.2.4/§16,未触碰 §9.4+§4.2.5(G1)/§11.1(S7)/其余章节。
  • 2026-07-06(G9 集成接线):①新增 §13.4 卫星依赖矩阵(五行四元组硬契约:paper-search-pro[L4/L5 主路径,降级指针 §11.1 不复述] / document-to-markdown+paper-downloader-portable[G6 全文请求包 §4.2.6 + downloadpolicy 依赖档位] / ma-plots[住 meta-analysis/scripts/plots 被本 Skill 引用:纯 SR 路径 L11 的 PRISMA/RoB 图固定命令+QC exit≠0+labels 机械同源纪律] / manuscript-typeset[纯 SR L12 默认投稿四件] / academic-ref-check[引用终审 fail-closed];每行降级明确禁静默);②§13.1 "systematic-review + ssci-plots" 行事实同步(森林图/漏斗图归 MA 路径;纯 SR PRISMA/RoB 图 = ma-plots 固定渲染器;ssci-plots = 样式底座 + 通用统计图出口);③§12 尾新增纯 SR 路径 L12 交付打包指针 blockquote(manifest 五节模板住 MA 被 SR 引用 + 投稿四件 + 与 00审核入口.md 分离互链;详 meta-analysis SKILL §12.4)。纯 additive/措辞事实同步:避开 §9.4+§4.2.5(G1)/§11.1(S7)/§4.2.4+§4.2.6 G6 blockquote/G5 owned §3.1/§6/§8/§3.3/L6 §12;S4 的 §12 命名规则行与 §13.1 联合工作流行一字未动。④references 消费面同步subagent-templates.md L8 RoB 输出行(发表级图=robtraffic.py)+ 11.3 prisma-flow-agent 步骤 6 改 prismaflow.py 固定命令+失败回退改"明确报告缺什么、草稿不得当交付图" / L9-synthesis-swim.md :338 effect direction plot 指针化(ssci-plots 通用图出口正确角色)。⑤critic 交叉复核后加修:§12 打包指针 blockquote 调序(typeset①→manifest②,治依赖倒置);L11-prisma-reporting.md :152 与 L8-rob-assessment.md :189/:207/:327 漏网 ssci-plots 活指令改固定渲染器契约指针。