SCI Reference Audit

A comprehensive tool for auditing academic reference lists against multiple online sources to verify authenticity and detect AI-generated fakes.

Sby Skills Guide Bot
ContentAdvanced
007/24/2026
Claude CodeCursor
#reference-audit#academic-integrity#ai-detection#literature-verification#citation-audit

Recommended for


name: sci-reference-audit description: | SCI级文献真实性与引用一致性审计工具。对学术论文参考文献列表进行系统性联网核查, 验证文献真实性、DOI有效性、作者/标题/期刊/年份/卷期页准确性, 识别AI伪造文献,生成10节标准Markdown审计报告。 核心特色:多轮次验证、多数据源交叉、多Agent并行互查、审计后自学习。 触发词:审计文献、文献真实性、reference audit、查文献、验证引用、核查参考文献、 文献核实、文献校验、假文献检测、SCI文献审计 allowed-tools:

  • Read
  • Write
  • Edit
  • Bash
  • WebSearch
  • WebFetch
  • Agent
  • AskUserQuestion metadata: emoji: "🔬" category: academic trigger: 审计文献真实性/核查参考文献/验证引用准确性 agent_created: true

SCI级文献真实性与引用一致性审计

对学术论文参考文献列表进行系统性联网核查,达到SCI期刊投稿前审计标准。 核心原则:多轮次、多数据源、多Agent互查——任何单一来源的结论不可采信。

适用场景

  • 学术论文投稿前参考文献全面核查
  • 识别AI伪造/幻觉文献
  • 补全缺失的DOI、卷期页、作者列表
  • 修正期刊名错误或缺失
  • 标准化引用格式(Vancouver/AMA)
  • 核查正文引用位置与参考文献的一致性
  • 检测重复引用、编号错误等结构性问题

输入要求

用户需提供以下至少一项:

  1. 文献列表文件(.txt/.md/.docx):包含待审计的参考文献
  2. 直接粘贴的文献列表:在对话中直接提供
  3. 含文献列表的论文正文:可同时进行引用位置审计

可选提供:

  • 正文文件(用于引用位置核查)
  • 指定审计范围(如"只查[1]-[10]")
  • 指定引用格式(默认Vancouver/AMA)
  • 目标期刊(用于匹配特定期刊的引用格式要求)

核心工作流:7阶段+多轮多源多Agent+自学习

┌──────────────────────────────────────────────────────────────────────┐
│  阶段〇:预检(结构性质检,不需联网)                                    │
│  ↓                                                                    │
│  阶段一:解析与分组                                                     │
│  ↓                                                                    │
│  阶段二:多Agent并行初查(第一轮)← Agent-PubMed / Agent-CrossRef 并行  │
│  ↓                                                                    │
│  阶段三:多源交叉复核(第二轮)← 不同来源验证第一轮结果                    │
│  ↓                                                                    │
│  阶段四:冲突仲裁与深度验证(第三轮)← Agent-Referee 解决冲突            │
│  ↓                                                                    │
│  阶段五:AI伪造识别 + 假文献替换                                        │
│  ↓                                                                    │
│  阶段六:正文引用位置核查                                               │
│  ↓                                                                    │
│  阶段七:报告生成 + 全局一致性检查 + 审计后自评 + 教训回流               │
└──────────────────────────────────────────────────────────────────────┘

阶段〇:预检(Pre-flight Check)

在正式审计前,先执行结构性质检,这些检查不需要联网,可立即完成:

  1. 编号连续性检查:[1],[2],...无跳号/重复/格式不统一
  2. 重复引用检测
    • 完全重复(作者+标题+期刊完全相同)
    • 变体重复(同一论文不同格式)
    • 检测方法:标题相似度 + 第一作者+年份+期刊组合去重 + DOI比对
  3. 排序检查:Vancouver按正文首次出现顺序;无正文按作者姓氏

预检输出:

📋 预检结果
- 总文献数:22条
- 编号连续性:✅ 连续 / ❌ 发现跳号[3]
- 重复引用:✅ 无重复 / ❌ [7]与[12]为同一论文
- 排序规则:按正文出现顺序 / 按作者姓氏
- 著录完整性:A级3条 / B级8条 / C级9条 / D级2条

阶段一:解析与分组(Parse & Partition)

  1. 逐条解析参考文献,提取结构化字段:编号、作者、标题、期刊、年份、卷(期):页、DOI、PMID
  2. 识别著录完整性等级:A级完整 / B级部分完整 / C级严重不完整 / D级仅标题+作者
  3. 优先审计C/D级(高风险),再审计A/B级

阶段二:多Agent并行初查(第一轮 — Round 1)

启动2-3个独立Agent,各自使用不同数据源,对同一批文献并行核查。

| Agent | 主数据源 | 辅助数据源 | 适用文献 | |-------|----------|-----------|----------| | Agent-PubMed | PubMed E-utilities API | PubMed网页搜索 | 全部生物医学文献 | | Agent-CrossRef | CrossRef API | Europe PMC API | 全部文献(侧重DOI) | | Agent-Journal | 期刊官网/出版商 | Google Scholar | 高风险文献 |

≤8条文献:2个Agent;>20条:按5-8条一组分配。

Agent Prompt模板:参见 references/agent_prompts.md

Agent结果整合:对每条文献构建多源对照表:

| 字段 | Agent-PubMed | Agent-CrossRef | 是否一致 | |------|-------------|---------------|----------|

判定规则:

  • ✅ 两源一致 → 采信,标记"双源确认"
  • ⚠️ 两源不一致 → 进入阶段四冲突仲裁
  • ❌ 某源无法检索到 → 以另一源为准,标记"单源确认,待复核"
  • ⚠️ 同一文献部分字段一致、部分不一致 → 一致字段采信,不一致字段进入阶段四仲裁

阶段三:多源交叉复核(第二轮 — Round 2)

对第一轮中所有"发现问题的文献"执行交叉验证。核心规则:第一轮用PubMed的→第二轮必须用CrossRef/期刊官网;反之亦然。

交叉验证矩阵:

| 第一轮主数据源 | 第二轮验证数据源 | |----------------|-----------------| | PubMed | CrossRef + 期刊官网 | | CrossRef | PubMed + PMC | | PubMed无结果 | Europe PMC + Google Scholar | | Agent间结果不一致 | 期刊官网(权威来源) |

结果分类:三源一致 → 最高置信度 | 双源一致 → 确认 | 单源确认 → 待手动确认 | 源间冲突 → 仲裁 | 全源无果 → AI伪造检测

阶段四:冲突仲裁与深度验证(第三轮 — Round 3)

当Agent间出现结果冲突时,启动独立仲裁Agent(Agent-Referee)解决。

仲裁规则:

| 冲突类型 | 仲裁规则 | |----------|----------| | 卷期页冲突 | 以PubMed正式记录为准 | | 年份冲突 | 以PubMed正式卷期年份为准;检查Epub vs正式出版 | | 期刊名冲突 | 以PubMed ISOAbbreviation(NLM缩写)为准 | | DOI冲突 | 以CrossRef为准(DOI注册机构),实际解析两个DOI确认 | | 作者列表冲突 | 以PubMed为准,按Vancouver格式截取 | | 标题微小差异 | 以PubMed完整标题为准(含副标题) |

Agent-Referee Prompt模板:参见 references/agent_prompts.md

最终确认检查(所有文献):

  1. DOI解析验证:访问 https://doi.org/[DOI] 确认返回正确论文
  2. 回溯验证:用修正后的完整元数据在PubMed搜索确认

阶段五:AI伪造文献识别

前提:文献在所有Agent和所有来源中均无法检索到。

AI伪造特征检查清单(7项):过于完美的标题 / 不可验证的作者 / 不可验证的机构 / 期刊-内容不匹配 / DOI/PMID缺失且不可查 / 年份异常 / 引用量异常

判定流程:

  • 2-3个来源无结果 + 3个以上AI特征 → ❌ 高度疑似AI伪造
  • 所有来源无结果 + 5个以上AI特征 → ❌❌ 确认AI伪造

假文献替换:报告判定理由 → 提取正文引用意图 → 搜索替代文献 → 推荐2-3篇替换候选 → 用户决定

阶段六:正文引用位置核查

仅在用户提供了正文时执行。

一致性判断:✅一致 / ⚠️部分一致 / ❌不一致 / ❌过度推断 / ❌引而未用

额外检测:未引用检测(参考文献在正文中未被引用)

阶段七:报告生成 + 全局一致性检查 + 审计后自评

  1. 生成标准10节Markdown报告,默认 reference_audit_report.md
  2. 执行全局一致性检查(见下方清单)
  3. 审计后自评:参见 references/quality_self_assessment.md
  4. 教训回流:从本次审计中提炼新教训,写入 references/audit_lessons.md

置信度评分体系

每条文献的每个字段都有独立的置信度评分。

| 等级 | 定义 | 采信规则 | |------|------|----------| | A | 三源确认 | 直接采信 | | B | 双源确认 | 采信,附注 | | C | 单源确认 | 采信但标记"⚠️ 建议手动确认" | | D | 仲裁确认 | 采信但标记"⚠️ 建议手动确认" | | E | 无法验证 | 不修改原文 | | F | 确认伪造 | 标记假文献,推荐替换 |

文献总体置信度取所有字段中的最低置信度


多Agent并行执行策略

| 文献数量 | Agent数量 | 分配策略 | |----------|----------|----------| | ≤5条 | 2 | Agent-PubMed + Agent-CrossRef 各查全部 | | 6-15条 | 2-3 | 按编号平分,高风险文献启动第3个 | | 16-30条 | 3 | 分3组(前1/3 + 中1/3 + 后1/3),各分配1组Agent | | >30条 | 3+ | 按8条一组分配,分批启动 |

Agent并行关键原则:

  1. 独立运行:互不干扰
  2. 统一输入:完全相同的原始文献列表
  3. 结果汇总:主Agent构建对照表
  4. 冲突上报:任何错误必须经另一Agent/数据源交叉验证
  5. 单源禁改:实质性修正需≥2个独立来源

报告格式规范

报告必须包含10个章节。详细格式规范参见 references/report_format.md

章节概要:

  1. 总体审计摘要 — 统计表 + 总体可信度评级 + 多源验证统计
  2. 逐条文献审计报告 — 每条10个子节(原始文献/Agent-PubMed/Agent-CrossRef/对照表/交叉复核/冲突仲裁/最终确认/存在问题/修正后文献/查询来源)
  3. 查询网址列表 — 含使用Agent标注
  4. 网址信息提取列表 — 完整元数据
  5. 文献简报列表 — 含置信度
  6. 前后修正对比表 — 含置信度
  7. 最终可信参考文献列表 — 可直接复制使用
  8. 正文引用位置核查列表 — 如有正文
  9. 高风险问题列表 — 含风险等级和置信度
  10. 最终审计结论 — 含多轮多源验证完整性声明

引用格式标准

详细规范参见 references/citation_format.md。核心要点:

  • Vancouver/AMA格式:作者列表. 标题. 期刊缩写. 年份;卷(期):起页-止页. doi: 10.xxxx/xxxxx.
  • 作者:姓+名缩写无句点;≤6全部列出,>6用et al.;中间名首字母保留(如Karway GK)
  • DOI格式:doi: 10.xxxx/xxxxx(非DOI: 或 https://doi.org/)
  • 期刊缩写:NLM标准,速查参见 references/journal_abbreviations.md

审计纪律(Critical Rules)

❗ 绝对禁止

  1. 禁止凭记忆判断 — 所有结论基于联网检索
  2. 禁止猜测修正 — 不确定则标记"待手动确认"
  3. 禁止伪造URL — 所有URL必须是实际访问过的
  4. 禁止盲目修改正确内容 — 原文正确不得"修正"为错误
  5. 禁止单源修正 — 实质性修正需≥2个独立来源
  6. 禁止单Agent定论 — 错误结论须经另一Agent/数据源交叉验证

⚠️ 特别注意

  1. 作者缩写:PubMed "George K Karway" → Vancouver "Karway GK"(中间名首字母保留)
  2. 在线发表vs正式出版:以正式卷期年份为准
  3. 中文文献:拼音作者名+英文标题+Chin Med J格式;CNKI/万方补充验证
  4. 姐妹刊混淆:JAMA系列/Lancet系列/Nature系列/KI系列——必须核对ISSN
  5. 多Agent结果整合:绝不凭一个Agent结果修改原文,必须构建对照表

✅ 质量保障

  1. 双源验证 / 逐条复核 / 全局一致性 / 多Agent互查
  2. 用户反馈 → 立即启动2个Agent独立验证 → 承认错误 → 全局修正
  3. 审计后自评:参见 references/quality_self_assessment.md
  4. 教训回流:每次审计后提炼新教训,写入 references/audit_lessons.md

报告全局一致性检查清单

修正任何条目后必须逐一检查

  • [ ] 章节一:统计数字 + 多源验证统计
  • [ ] 章节二:该条10个子节
  • [ ] 章节三:是否需补充URL + Agent标注
  • [ ] 章节四:该条信息
  • [ ] 章节五:该条简报 + 置信度
  • [ ] 章节六:修正前后对比 + 置信度
  • [ ] 章节七:该条最终引用
  • [ ] 章节九:是否需增删 + 置信度
  • [ ] 章节十:统计和建议 + 多源验证声明

参考文件索引

| 文件 | 内容 | 何时加载 | |------|------|----------| | references/agent_prompts.md | Agent-PubMed/CrossRef/Journal/Referee的完整Prompt模板 | 启动Agent时 | | references/audit_lessons.md | 实战教训库(教训1-N,持续积累) | 审计全程参照 | | references/journal_abbreviations.md | NLM期刊缩写速查表+易混淆对比 | 验证期刊名时 | | references/search_templates.md | 搜索策略矩阵+API查询模板+决策树+Semantic Scholar | 执行搜索时 | | references/quality_self_assessment.md | 审计后自评+教训回流+增量审计+版本管理 | 报告生成后 | | references/citation_format.md | 完整引用格式规范+特殊类型+姐妹刊警示 | 生成报告时 | | scripts/verify_dois.py | 批量DOI解析验证脚本 | 第三轮最终确认 |


任务管理

超过10条文献时,使用TaskCreate创建分阶段任务:

  1. 预检+解析文献列表
  2. 多Agent并行初查(第一轮)
  3. 多源交叉复核(第二轮)
  4. 冲突仲裁与深度验证(第三轮)
  5. AI伪造识别+假文献替换
  6. 生成审计报告
  7. 全局一致性复查 + 审计后自评

使用示例

| 场景 | 用户输入 | 工作流 | |------|----------|--------| | 基础审计 | 审计文献.txt中的文献真实性 | 预检→解析→多Agent初查→交叉验证→仲裁→报告→自评 | | 指定范围 | 核查参考文献[9]-[16] | 2个Agent并行→交叉验证→更新报告 | | 含正文 | 审计引用准确性,正文main.md,文献ref.txt | 多Agent核查+引用位置匹配 | | 快速验证 | 验证Tangri N 2011 JAMA的DOI | PubMed+CrossRef双源确认 | | 假文献检测 | 检查有没有假文献 | 多Agent核查→AI伪造检查→替代推荐 | | 格式标准化 | 统一成Vancouver格式 | 解析→补全→标准化 | | 用户反馈 | 第22条你们给的不对 | 2个Agent独立验证→承认错误→全局修正 |


错误处理

| 情况 | 处理 | |------|------| | 所有来源无法检索 | AI伪造特征检查→标记疑似假文献 | | CrossRef与PubMed不一致 | PubMed为准+Agent-Referee仲裁 | | DOI解析返回不同论文 | 标记不匹配+双源确认修正 | | Agent间结果冲突 | Agent-Referee仲裁 | | 某Agent报告错误但另一Agent未发现 | 第三来源验证——不能忽略 | | 用户指出报告错误 | 立即2个Agent独立验证+全局修正 | | 期刊网站反爬虫 | PubMed/CrossRef替代+标记"来源受限" | | Agent超时/中断 | 标记该Agent负责的文献为"未完成",用另一Agent补查+标记"单源确认" | | 大量文献(>30)分批超时 | 按批次保存中间结果到审计日志,断点续审 |


重复引用检测阈值

判断两条文献是否为同一论文的不同格式:

| 判定条件 | 判定结果 | |----------|----------| | DOI相同 | ❗ 确认重复(同一论文) | | 第一作者姓氏+年份+期刊+卷期页完全相同 | ❗ 高度疑似重复 | | 标题规范化后(去标点/空格/大小写)相似度≥90% | ⚠️ 疑似重复,需人工确认 | | 仅作者+年份相同但标题/期刊不同 | ✅ 非重复(同年同作者不同论文) |


审计结果交付

  1. deliver_attachments 发送报告文件
  2. open_result_view 呈现报告
  3. 口头摘要(3-5句):总体评级 + 最严重问题 + 多源验证覆盖率 + 需手动确认项 + 下一步建议

配置选项

| 选项 | 默认值 | 说明 | |------|--------|------| | 引用格式 | Vancouver/AMA | 可指定APA/Harvard | | 审计深度 | 三轮+多Agent | 可简化(会降低置信度) | | 并行Agent数 | 2-3 | 按文献数量自动调整 | | 最少验证来源数 | 2 | 实质性修正最低来源数 | | AI伪造检测 | 开启 | 可关闭以加速 | | 替换文献推荐 | 开启 | 检测到假文献时搜索替代 |


版本历史

| 版本 | 日期 | 变更 | |------|------|------| | 3.3.0 | 2026-05-24 | 全面质检修复:修正Semantic Scholar速率限制数据(无密钥100次/5min,非1000次);verify_dois.py标题子串匹配增加60%长度阈值防误匹配;16-30条Agent分配策略明确为3组(非2组);教训13/14消除与SKILL.md规则重复改为侧重经验洞察;补充PubMed E-utilities速率限制(3次/秒);自评检查清单9→10章节;Agent结果整合增加"部分字段不一致"处理规则;report_format.md补充Corrected (D-grade)状态;Agent-Journal查询方式补充Semantic Scholar;期刊缩写表BMJ全称去The;教训库数量描述改为N条(持续积累) | | 3.2.0 | 2026-05-24 | 精细化修复:修正错别字(章业九→章节九);统一状态命名(Corrected Single-Source→Corrected C-grade);Agent Prompt明确指定general-purpose类型;补充Agent超时/中断处理;补充重复引用检测量化阈值;补充Semantic Scholar API;CrossRef礼貌池说明;clarify参考文献索引描述 | | 3.1.0 | 2026-05-24 | 自学习升级:添加agent_created标记;Agent Prompt移入references/;新增审计后自评+教训回流+增量审计+版本管理+审计日志+质量自评清单(quality_self_assessment.md);新增批量DOI验证脚本(verify_dois.py);SKILL.md精简为核心工作流+规则 | | 3.0.0 | 2026-05-24 | 多Agent并行互查+置信度评分+7阶段工作流+冲突仲裁 | | 2.1.0 | 2026-05-24 | 预检+AI伪造识别+PubMed E-utilities+全局一致性清单 | | 2.0.0 | 2026-05-24 | 初始版本 |

Related skills