Audit de Références SCI

Outil complet d'audit des références académiques vérifiant l'authenticité via plusieurs sources en ligne et détectant les fausses références générées par IA.

Spar Skills Guide Bot
ContenuAvancé
1024/07/2026
Claude CodeCursor
#reference-audit#academic-integrity#ai-detection#literature-verification#citation-audit

Recommandé pour


name: sci-reference-audit description: | SCI级文献真实性与引用一致性审计工具。对学术论文参考文献列表进行系统性联网核查, 验证文献真实性、DOI有效性、作者/标题/期刊/年份/卷期页准确性, 识别AI伪造文献,生成10节标准Markdown审计报告。 核心特色:多轮次验证、多数据源交叉、多Agent并行互查、审计后自学习。 触发词:审计文献、文献真实性、reference audit、查文献、验证引用、核查参考文献、 文献核实、文献校验、假文献检测、SCI文献审计 allowed-tools:

  • Read
  • Write
  • Edit
  • Bash
  • WebSearch
  • WebFetch
  • Agent
  • AskUserQuestion metadata: emoji: "🔬" category: academic trigger: 审计文献真实性/核查参考文献/验证引用准确性 agent_created: true

SCI级文献真实性与引用一致性审计

对学术论文参考文献列表进行系统性联网核查,达到SCI期刊投稿前审计标准。 核心原则:多轮次、多数据源、多Agent互查——任何单一来源的结论不可采信。

适用场景

  • 学术论文投稿前参考文献全面核查
  • 识别AI伪造/幻觉文献
  • 补全缺失的DOI、卷期页、作者列表
  • 修正期刊名错误或缺失
  • 标准化引用格式(Vancouver/AMA)
  • 核查正文引用位置与参考文献的一致性
  • 检测重复引用、编号错误等结构性问题

输入要求

用户需提供以下至少一项:

  1. 文献列表文件(.txt/.md/.docx):包含待审计的参考文献
  2. 直接粘贴的文献列表:在对话中直接提供
  3. 含文献列表的论文正文:可同时进行引用位置审计

可选提供:

  • 正文文件(用于引用位置核查)
  • 指定审计范围(如"只查[1]-[10]")
  • 指定引用格式(默认Vancouver/AMA)
  • 目标期刊(用于匹配特定期刊的引用格式要求)

核心工作流:7阶段+多轮多源多Agent+自学习

┌──────────────────────────────────────────────────────────────────────┐
│  阶段〇:预检(结构性质检,不需联网)                                    │
│  ↓                                                                    │
│  阶段一:解析与分组                                                     │
│  ↓                                                                    │
│  阶段二:多Agent并行初查(第一轮)← Agent-PubMed / Agent-CrossRef 并行  │
│  ↓                                                                    │
│  阶段三:多源交叉复核(第二轮)← 不同来源验证第一轮结果                    │
│  ↓                                                                    │
│  阶段四:冲突仲裁与深度验证(第三轮)← Agent-Referee 解决冲突            │
│  ↓                                                                    │
│  阶段五:AI伪造识别 + 假文献替换                                        │
│  ↓                                                                    │
│  阶段六:正文引用位置核查                                               │
│  ↓                                                                    │
│  阶段七:报告生成 + 全局一致性检查 + 审计后自评 + 教训回流               │
└──────────────────────────────────────────────────────────────────────┘

阶段〇:预检(Pre-flight Check)

在正式审计前,先执行结构性质检,这些检查不需要联网,可立即完成:

  1. 编号连续性检查:[1],[2],...无跳号/重复/格式不统一
  2. 重复引用检测
    • 完全重复(作者+标题+期刊完全相同)
    • 变体重复(同一论文不同格式)
    • 检测方法:标题相似度 + 第一作者+年份+期刊组合去重 + DOI比对
  3. 排序检查:Vancouver按正文首次出现顺序;无正文按作者姓氏

预检输出:

📋 预检结果
- 总文献数:22条
- 编号连续性:✅ 连续 / ❌ 发现跳号[3]
- 重复引用:✅ 无重复 / ❌ [7]与[12]为同一论文
- 排序规则:按正文出现顺序 / 按作者姓氏
- 著录完整性:A级3条 / B级8条 / C级9条 / D级2条

阶段一:解析与分组(Parse & Partition)

  1. 逐条解析参考文献,提取结构化字段:编号、作者、标题、期刊、年份、卷(期):页、DOI、PMID
  2. 识别著录完整性等级:A级完整 / B级部分完整 / C级严重不完整 / D级仅标题+作者
  3. 优先审计C/D级(高风险),再审计A/B级

阶段二:多Agent并行初查(第一轮 — Round 1)

启动2-3个独立Agent,各自使用不同数据源,对同一批文献并行核查。

| Agent | 主数据源 | 辅助数据源 | 适用文献 | |-------|----------|-----------|----------| | Agent-PubMed | PubMed E-utilities API | PubMed网页搜索 | 全部生物医学文献 | | Agent-CrossRef | CrossRef API | Europe PMC API | 全部文献(侧重DOI) | | Agent-Journal | 期刊官网/出版商 | Google Scholar | 高风险文献 |

≤8条文献:2个Agent;>20条:按5-8条一组分配。

Agent Prompt模板:参见 references/agent_prompts.md

Agent结果整合:对每条文献构建多源对照表:

| 字段 | Agent-PubMed | Agent-CrossRef | 是否一致 | |------|-------------|---------------|----------|

判定规则:

  • ✅ 两源一致 → 采信,标记"双源确认"
  • ⚠️ 两源不一致 → 进入阶段四冲突仲裁
  • ❌ 某源无法检索到 → 以另一源为准,标记"单源确认,待复核"
  • ⚠️ 同一文献部分字段一致、部分不一致 → 一致字段采信,不一致字段进入阶段四仲裁

阶段三:多源交叉复核(第二轮 — Round 2)

对第一轮中所有"发现问题的文献"执行交叉验证。核心规则:第一轮用PubMed的→第二轮必须用CrossRef/期刊官网;反之亦然。

交叉验证矩阵:

| 第一轮主数据源 | 第二轮验证数据源 | |----------------|-----------------| | PubMed | CrossRef + 期刊官网 | | CrossRef | PubMed + PMC | | PubMed无结果 | Europe PMC + Google Scholar | | Agent间结果不一致 | 期刊官网(权威来源) |

结果分类:三源一致 → 最高置信度 | 双源一致 → 确认 | 单源确认 → 待手动确认 | 源间冲突 → 仲裁 | 全源无果 → AI伪造检测

阶段四:冲突仲裁与深度验证(第三轮 — Round 3)

当Agent间出现结果冲突时,启动独立仲裁Agent(Agent-Referee)解决。

仲裁规则:

| 冲突类型 | 仲裁规则 | |----------|----------| | 卷期页冲突 | 以PubMed正式记录为准 | | 年份冲突 | 以PubMed正式卷期年份为准;检查Epub vs正式出版 | | 期刊名冲突 | 以PubMed ISOAbbreviation(NLM缩写)为准 | | DOI冲突 | 以CrossRef为准(DOI注册机构),实际解析两个DOI确认 | | 作者列表冲突 | 以PubMed为准,按Vancouver格式截取 | | 标题微小差异 | 以PubMed完整标题为准(含副标题) |

Agent-Referee Prompt模板:参见 references/agent_prompts.md

最终确认检查(所有文献):

  1. DOI解析验证:访问 https://doi.org/[DOI] 确认返回正确论文
  2. 回溯验证:用修正后的完整元数据在PubMed搜索确认

阶段五:AI伪造文献识别

前提:文献在所有Agent和所有来源中均无法检索到。

AI伪造特征检查清单(7项):过于完美的标题 / 不可验证的作者 / 不可验证的机构 / 期刊-内容不匹配 / DOI/PMID缺失且不可查 / 年份异常 / 引用量异常

判定流程:

  • 2-3个来源无结果 + 3个以上AI特征 → ❌ 高度疑似AI伪造
  • 所有来源无结果 + 5个以上AI特征 → ❌❌ 确认AI伪造

假文献替换:报告判定理由 → 提取正文引用意图 → 搜索替代文献 → 推荐2-3篇替换候选 → 用户决定

阶段六:正文引用位置核查

仅在用户提供了正文时执行。

一致性判断:✅一致 / ⚠️部分一致 / ❌不一致 / ❌过度推断 / ❌引而未用

额外检测:未引用检测(参考文献在正文中未被引用)

阶段七:报告生成 + 全局一致性检查 + 审计后自评

  1. 生成标准10节Markdown报告,默认 reference_audit_report.md
  2. 执行全局一致性检查(见下方清单)
  3. 审计后自评:参见 references/quality_self_assessment.md
  4. 教训回流:从本次审计中提炼新教训,写入 references/audit_lessons.md

置信度评分体系

每条文献的每个字段都有独立的置信度评分。

| 等级 | 定义 | 采信规则 | |------|------|----------| | A | 三源确认 | 直接采信 | | B | 双源确认 | 采信,附注 | | C | 单源确认 | 采信但标记"⚠️ 建议手动确认" | | D | 仲裁确认 | 采信但标记"⚠️ 建议手动确认" | | E | 无法验证 | 不修改原文 | | F | 确认伪造 | 标记假文献,推荐替换 |

文献总体置信度取所有字段中的最低置信度


多Agent并行执行策略

| 文献数量 | Agent数量 | 分配策略 | |----------|----------|----------| | ≤5条 | 2 | Agent-PubMed + Agent-CrossRef 各查全部 | | 6-15条 | 2-3 | 按编号平分,高风险文献启动第3个 | | 16-30条 | 3 | 分3组(前1/3 + 中1/3 + 后1/3),各分配1组Agent | | >30条 | 3+ | 按8条一组分配,分批启动 |

Agent并行关键原则:

  1. 独立运行:互不干扰
  2. 统一输入:完全相同的原始文献列表
  3. 结果汇总:主Agent构建对照表
  4. 冲突上报:任何错误必须经另一Agent/数据源交叉验证
  5. 单源禁改:实质性修正需≥2个独立来源

报告格式规范

报告必须包含10个章节。详细格式规范参见 references/report_format.md

章节概要:

  1. 总体审计摘要 — 统计表 + 总体可信度评级 + 多源验证统计
  2. 逐条文献审计报告 — 每条10个子节(原始文献/Agent-PubMed/Agent-CrossRef/对照表/交叉复核/冲突仲裁/最终确认/存在问题/修正后文献/查询来源)
  3. 查询网址列表 — 含使用Agent标注
  4. 网址信息提取列表 — 完整元数据
  5. 文献简报列表 — 含置信度
  6. 前后修正对比表 — 含置信度
  7. 最终可信参考文献列表 — 可直接复制使用
  8. 正文引用位置核查列表 — 如有正文
  9. 高风险问题列表 — 含风险等级和置信度
  10. 最终审计结论 — 含多轮多源验证完整性声明

引用格式标准

详细规范参见 references/citation_format.md。核心要点:

  • Vancouver/AMA格式:作者列表. 标题. 期刊缩写. 年份;卷(期):起页-止页. doi: 10.xxxx/xxxxx.
  • 作者:姓+名缩写无句点;≤6全部列出,>6用et al.;中间名首字母保留(如Karway GK)
  • DOI格式:doi: 10.xxxx/xxxxx(非DOI: 或 https://doi.org/)
  • 期刊缩写:NLM标准,速查参见 references/journal_abbreviations.md

审计纪律(Critical Rules)

❗ 绝对禁止

  1. 禁止凭记忆判断 — 所有结论基于联网检索
  2. 禁止猜测修正 — 不确定则标记"待手动确认"
  3. 禁止伪造URL — 所有URL必须是实际访问过的
  4. 禁止盲目修改正确内容 — 原文正确不得"修正"为错误
  5. 禁止单源修正 — 实质性修正需≥2个独立来源
  6. 禁止单Agent定论 — 错误结论须经另一Agent/数据源交叉验证

⚠️ 特别注意

  1. 作者缩写:PubMed "George K Karway" → Vancouver "Karway GK"(中间名首字母保留)
  2. 在线发表vs正式出版:以正式卷期年份为准
  3. 中文文献:拼音作者名+英文标题+Chin Med J格式;CNKI/万方补充验证
  4. 姐妹刊混淆:JAMA系列/Lancet系列/Nature系列/KI系列——必须核对ISSN
  5. 多Agent结果整合:绝不凭一个Agent结果修改原文,必须构建对照表

✅ 质量保障

  1. 双源验证 / 逐条复核 / 全局一致性 / 多Agent互查
  2. 用户反馈 → 立即启动2个Agent独立验证 → 承认错误 → 全局修正
  3. 审计后自评:参见 references/quality_self_assessment.md
  4. 教训回流:每次审计后提炼新教训,写入 references/audit_lessons.md

报告全局一致性检查清单

修正任何条目后必须逐一检查

  • [ ] 章节一:统计数字 + 多源验证统计
  • [ ] 章节二:该条10个子节
  • [ ] 章节三:是否需补充URL + Agent标注
  • [ ] 章节四:该条信息
  • [ ] 章节五:该条简报 + 置信度
  • [ ] 章节六:修正前后对比 + 置信度
  • [ ] 章节七:该条最终引用
  • [ ] 章节九:是否需增删 + 置信度
  • [ ] 章节十:统计和建议 + 多源验证声明

参考文件索引

| 文件 | 内容 | 何时加载 | |------|------|----------| | references/agent_prompts.md | Agent-PubMed/CrossRef/Journal/Referee的完整Prompt模板 | 启动Agent时 | | references/audit_lessons.md | 实战教训库(教训1-N,持续积累) | 审计全程参照 | | references/journal_abbreviations.md | NLM期刊缩写速查表+易混淆对比 | 验证期刊名时 | | references/search_templates.md | 搜索策略矩阵+API查询模板+决策树+Semantic Scholar | 执行搜索时 | | references/quality_self_assessment.md | 审计后自评+教训回流+增量审计+版本管理 | 报告生成后 | | references/citation_format.md | 完整引用格式规范+特殊类型+姐妹刊警示 | 生成报告时 | | scripts/verify_dois.py | 批量DOI解析验证脚本 | 第三轮最终确认 |


任务管理

超过10条文献时,使用TaskCreate创建分阶段任务:

  1. 预检+解析文献列表
  2. 多Agent并行初查(第一轮)
  3. 多源交叉复核(第二轮)
  4. 冲突仲裁与深度验证(第三轮)
  5. AI伪造识别+假文献替换
  6. 生成审计报告
  7. 全局一致性复查 + 审计后自评

使用示例

| 场景 | 用户输入 | 工作流 | |------|----------|--------| | 基础审计 | 审计文献.txt中的文献真实性 | 预检→解析→多Agent初查→交叉验证→仲裁→报告→自评 | | 指定范围 | 核查参考文献[9]-[16] | 2个Agent并行→交叉验证→更新报告 | | 含正文 | 审计引用准确性,正文main.md,文献ref.txt | 多Agent核查+引用位置匹配 | | 快速验证 | 验证Tangri N 2011 JAMA的DOI | PubMed+CrossRef双源确认 | | 假文献检测 | 检查有没有假文献 | 多Agent核查→AI伪造检查→替代推荐 | | 格式标准化 | 统一成Vancouver格式 | 解析→补全→标准化 | | 用户反馈 | 第22条你们给的不对 | 2个Agent独立验证→承认错误→全局修正 |


错误处理

| 情况 | 处理 | |------|------| | 所有来源无法检索 | AI伪造特征检查→标记疑似假文献 | | CrossRef与PubMed不一致 | PubMed为准+Agent-Referee仲裁 | | DOI解析返回不同论文 | 标记不匹配+双源确认修正 | | Agent间结果冲突 | Agent-Referee仲裁 | | 某Agent报告错误但另一Agent未发现 | 第三来源验证——不能忽略 | | 用户指出报告错误 | 立即2个Agent独立验证+全局修正 | | 期刊网站反爬虫 | PubMed/CrossRef替代+标记"来源受限" | | Agent超时/中断 | 标记该Agent负责的文献为"未完成",用另一Agent补查+标记"单源确认" | | 大量文献(>30)分批超时 | 按批次保存中间结果到审计日志,断点续审 |


重复引用检测阈值

判断两条文献是否为同一论文的不同格式:

| 判定条件 | 判定结果 | |----------|----------| | DOI相同 | ❗ 确认重复(同一论文) | | 第一作者姓氏+年份+期刊+卷期页完全相同 | ❗ 高度疑似重复 | | 标题规范化后(去标点/空格/大小写)相似度≥90% | ⚠️ 疑似重复,需人工确认 | | 仅作者+年份相同但标题/期刊不同 | ✅ 非重复(同年同作者不同论文) |


审计结果交付

  1. deliver_attachments 发送报告文件
  2. open_result_view 呈现报告
  3. 口头摘要(3-5句):总体评级 + 最严重问题 + 多源验证覆盖率 + 需手动确认项 + 下一步建议

配置选项

| 选项 | 默认值 | 说明 | |------|--------|------| | 引用格式 | Vancouver/AMA | 可指定APA/Harvard | | 审计深度 | 三轮+多Agent | 可简化(会降低置信度) | | 并行Agent数 | 2-3 | 按文献数量自动调整 | | 最少验证来源数 | 2 | 实质性修正最低来源数 | | AI伪造检测 | 开启 | 可关闭以加速 | | 替换文献推荐 | 开启 | 检测到假文献时搜索替代 |


版本历史

| 版本 | 日期 | 变更 | |------|------|------| | 3.3.0 | 2026-05-24 | 全面质检修复:修正Semantic Scholar速率限制数据(无密钥100次/5min,非1000次);verify_dois.py标题子串匹配增加60%长度阈值防误匹配;16-30条Agent分配策略明确为3组(非2组);教训13/14消除与SKILL.md规则重复改为侧重经验洞察;补充PubMed E-utilities速率限制(3次/秒);自评检查清单9→10章节;Agent结果整合增加"部分字段不一致"处理规则;report_format.md补充Corrected (D-grade)状态;Agent-Journal查询方式补充Semantic Scholar;期刊缩写表BMJ全称去The;教训库数量描述改为N条(持续积累) | | 3.2.0 | 2026-05-24 | 精细化修复:修正错别字(章业九→章节九);统一状态命名(Corrected Single-Source→Corrected C-grade);Agent Prompt明确指定general-purpose类型;补充Agent超时/中断处理;补充重复引用检测量化阈值;补充Semantic Scholar API;CrossRef礼貌池说明;clarify参考文献索引描述 | | 3.1.0 | 2026-05-24 | 自学习升级:添加agent_created标记;Agent Prompt移入references/;新增审计后自评+教训回流+增量审计+版本管理+审计日志+质量自评清单(quality_self_assessment.md);新增批量DOI验证脚本(verify_dois.py);SKILL.md精简为核心工作流+规则 | | 3.0.0 | 2026-05-24 | 多Agent并行互查+置信度评分+7阶段工作流+冲突仲裁 | | 2.1.0 | 2026-05-24 | 预检+AI伪造识别+PubMed E-utilities+全局一致性清单 | | 2.0.0 | 2026-05-24 | 初始版本 |

Skills similaires