Imported from wyh2255/paper-research-assistant (
searcher-agent/.agents/skills/hybrid-literature-search/SKILL.md). Install upstream withnpx skills add wyh2255/paper-research-assistant --skill hybrid-literature-search. Copyright stays with the author (MIT).
混合文献检索协议(Hybrid Literature Search)
目标与适用范围
用于把“找某主题论文”升级为可审计的研究地图:既能发现近期工作,也能追溯基础路线、检查覆盖与证据缺口、核验代码/数据/机构生态,并在需要时并行纳入安全与治理问题。
适用于:综述准备、选题调研、系统设计前证据收集、benchmark 选型、技术路线比较。
不适用于:只需一两篇指定论文的全文阅读;此时直接建立论文包并使用 paper-note-generation。不把搜索摘要、第三方综述、GitHub star 或引用量直接写成论文事实或质量结论。
核心思想
主题发现 ──→ 综述/种子锚定 ──→ 双向引文图谱 ──→ 矩阵补检与证据分级
│ │ │ │
└───── 时间窗/同义词补漏 ────────────────┴────→ 生态/资源核验 ───┘
└──→ 安全/治理专项(按需)
- 关键词发现防止只沿既有引用网络走;
- 综述/种子锚定提供研究谱系与术语坐标;
- 滚雪球发现基础论文、关键转折与平行分支;
- 矩阵补检区分“没搜到”和“证据不足/暂定研究缺口”;
- 生态核验独立确认作者、机构、venue、benchmark、代码、模型与数据关系;
- 安全专项不能混入普通方法结论,需单独记录证据类型与威胁模型。
输入、边界与最小交付
输入
开始前固定以下字段;用户未指定时采用默认并写入结果:
topic: 主题与研究问题
cutoff: 当前日期(必须用系统工具取得)
time_window: 默认 2023–当前
languages: 中文 + 英文检索,英文原始来源优先
source_types: 论文、官方 venue/项目/仓库、benchmark/数据页
exclusions: 与主题仅弱相关的通用 RAG、新闻、未核验二手解读
mode: shortlist | mapping | design-review
shortlist 只执行 Phase 0–2;mapping 执行 Phase 0–4;design-review 执行全部阶段并默认加入安全/治理分片。
最小交付
无论模式,都必须交付:
- 检索边界、截止时间、查询族、来源与未覆盖范围;
- 论文族去重后的候选/节点表,含精确 ID、实际检查版本、直接 URL;
- 事实、作者主张、调研归纳、待核验线索的明确区分;
- 不把“无结果”写成“不存在”。
mapping 和 design-review 额外交付:引文边、P×M×S×E 矩阵、补检日志、资源/生态关系表与优先阅读顺序。
统一证据账本
协调者维护以下最小字段;子 Agent 不可自定义未带来源的结论字段。
family_id | title | exact_id | version_inspected | doi | published | updated
query_family | discovery_url | status(lead/id_verified/venue_verified/resource_verified/merged/excluded)
read_depth(ABS/SEC/FULL) | P[] | M[] | S[] | evidence_grade(E0-E5)
venue | authors | affiliations | code | model | data | benchmark[]
source_urls[] | locator | limitation | worker_id | unresolved_issue
规则:
- 身份使用
arXiv base ID → DOI → 规范化标题+第一作者+年份去重;预印本、会议版、项目页、代码仓库是一篇论文族的关联资源,不重复计数。 ABS最高可标 E2;E3+ 必须读到评测相关章节。- affiliation、代码托管者、模型/数据托管者、venue 是不同关系,不能因同一组织名称而合并。
- 资源状态只可标为
[OS] / [promised] / [third-party reproduction] / [not located],且必须有直接来源。
Phase 0:主题发现与初筛
三路发现配额(提高作者/机构反查权重)
主题关键词不再是唯一入口。默认将发现工作量分为:主题/机制查询约 40%,作者/机构/实验室反查约 40%,引文与 venue/benchmark 入口约 20%。这是候选发现的预算,不是论文质量评分;作者名气、机构名气、引用量、star/fork 均不得直接抬高证据等级或最终排序。
- 主题/机制路:建立 3–6 个查询族:核心术语、同义词/近义机制、任务/系统、评测/benchmark。
- 作者/机构路:从 1–3 篇近期高质量综述、正式 venue 论文和官方 benchmark/项目页提取候选作者、实验室、机构与维护组织;对每个实体执行
实体 × 至少两个机制同义词、作者署名检索、官方 publication 页、项目/仓库与 venue 索引检索。即使标题和摘要不出现主题主关键词,只要其原始来源显示机制/任务相关,也进入author-institution-discovery候选池。 - 引文/生态路:从已核验种子向前后引文、venue 主题索引、benchmark 论文引用页和官方资源仓库 README 发现候选。
- 中英文并行搜;优先 arXiv/DOI/venue/官方项目页,搜索摘要只作线索。近期窗口按提交时间排序,另做相关性排序;默认覆盖 2023–当前,近期窗口为最近 90 天。
- 合并三路候选后再精确核验:标题、作者、ID、版本、首次/更新日期、摘要、撤稿与 venue 状态。记录
discovery_route,使后来可审计某篇论文为何进入候选池。 - 选 1–3 篇高质量综述、3–8 篇跨路线种子论文。综述必须检查其主题边界、更新时间、分类框架和参考文献覆盖,不能仅因标题含 Survey 入选。
退出门:种子多样化覆盖主要路线,所有种子有精确标识与原始来源。
Phase 1:双向引文图谱
以每个种子为锚点,默认只跑一跳后向和一跳前向,每方向每种子最多保留 20 个主题相关论文。
- 后向:优先 OpenAlex references → Semantic Scholar references → 论文参考文献。
- 前向:优先 OpenAlex cites → Semantic Scholar citations → 官方 venue/作者页作发现线索。
- 每条主图边必须保存
A ← B、方向、来源、检索日期;两端身份均核验后才能入图。 - 对跨多个种子重复、位于路线交叉、或与主题高度匹配的节点才允许进一步扩展;禁止图谱无界增长。
- 图谱完成后,按阶段和同义词执行一次独立的近期关键词补漏。补漏条目要标明“无已核验种子边”,不能因无引文边排除。
退出门:记录最大深度/宽度、实际回退源、图谱盲区和关键词补漏结果。
Phase 2:P×M×S×E 证据矩阵与定向补检
将论文编码到:
P:问题/能力(建议 3–8 个);M:方法类别(建议 3–8 个);S:实际系统、框架或模型;E:证据强度(E0–E5)与读取深度。
对每个 EMPTY、THIN 或 CONFLICT 单元执行补检:
- 问题中心、方法中心、问题+方法组合三类查询;
- 中英文同义词;
- 至少两个独立引擎(arXiv + OpenAlex/Semantic Scholar);
- 前后向引文扩展与综述参考文献检查;
- 写明“什么样的来源可关闭该格”的验收条件。
只在完成上述判别后把格子标为 FILLED 或 GAP-PROV。GAP-PROV 表示本次边界下的暂定研究缺口,绝不等于该方向不存在。
退出门:覆盖缺口和证据缺口分开报告;所有高价值空格有查询日志或明确标为未执行。
Phase 3:生态与资源核验
针对保留论文族,单独核验:
- 作者和 affiliation:PDF 首页或官方来源;
- venue:官方 proceedings/接收页;
- benchmark:定义论文和官方任务页;
- 代码/模型/数据:论文、官方项目或 README 的明确链接;
- 实体关系:作者、机构、代码托管、模型/数据托管分别建边。
默认扫描最近 90 天的新增项:作者/实验室/venue/benchmark × 主题同义词。对于已验证的活跃作者/机构,扫描不能只依赖主题词:还要检查其官方 publication 列表、arXiv 作者记录、官方项目与仓库活动,再由父 Agent 做主题相关性判定。空结果只能表述为“该窗口未检出可核验新增项”。
退出门:每条实体边都有 URL、来源类型、核验日期;未把机构声望、star 或引用量作为质量证明。
Phase 4:安全与治理专项(design-review 默认开启)
将安全证据与一般方法论文分开保存,按风险分类:memory poisoning、经检索激活的 prompt injection、错误固化、PII/合规、删除权、provenance、访问控制与多租户隔离。
每条证据标注:
M = memory 专项论文/事件
O = 官方安全资料
E = 已披露真实事件/漏洞
A = 相邻 RAG/通用 LLM 证据(不得冒充专项)
T = 可落地测试工具/基准
每一类风险的交付格式为:风险 → 机制与来源 → 控制项 → 可验证测试。必须诚实保留“暂无 peer-reviewed 实现/官方专项文档”的缺口。
子 Agent 编排
仅在候选≥8、待补检单元≥6,或主题天然可分成论文/工程/评测/安全分片时并行。
Wave 0 父 Agent:冻结边界、词表、种子、深度和宽度;建立作者/机构候选表
Wave 1 workers:按主题机制路、作者机构路、引文生态路发现候选;不得评级或排序
Wave 2 workers:精确身份 / venue / 资源字段分责核验
Wave 3 workers:按种子×方向做引文扩展;或按矩阵单元补检
Wave 4 workers:生态/安全专项
Final 父 Agent:论文族去重、版本裁决、矩阵状态、排序、最终门检
约束:
- 最多 5 个并发 worker;每个发现批最多 10 个论文族;
- worker 只能回传带来源的结构化记录,不得自行写
E等级、GAP-PROV、论文族合并或最终结论; - 父 Agent 必须检查子产物实际存在,抽样回读直接来源,再写入主报告;
- 429/超时最多退避重试一次后切换回退源;空结果留痕,不重复原样查询。
最终质量门
- 当前日期、主题、时间窗、纳入/排除条件明确;
- 至少两个独立查询族,且有近期窗口补漏;
- 作者/机构反查已执行并记录查询、来源和发现候选;其发现权重未被误写为质量证据;
- 每个保留节点有精确 ID/版本和直接来源;
- 论文族已去重,论文/venue/代码/模型/数据关系未混淆;
- 主图引用边都可追溯;
- P×M×S×E 的 EMPTY、THIN、CONFLICT 未被误称研究空白;
- 安全相邻证据已标注,不越界;
- 任何数字都带任务、模型、指标和预算条件,或不予报告;
- 结论、作者主张、合理归纳、待核验线索分层呈现。
默认阅读产出顺序
- 30 秒结论与边界;
- 优先阅读清单;
- 研究演化图与 P×M×S×E 证据矩阵;
- 系统/benchmark/资源对照;
- 安全与治理矩阵;
- 查询日志、排除项、未覆盖范围和来源索引。