name: sci-reference-audit description: | SCI级文献真实性与引用一致性审计工具。对学术论文参考文献列表进行系统性联网核查, 验证文献真实性、DOI有效性、作者/标题/期刊/年份/卷期页准确性, 识别AI伪造文献,生成10节标准Markdown审计报告。 核心特色:多轮次验证、多数据源交叉、多Agent并行互查、审计后自学习。 触发词:审计文献、文献真实性、reference audit、查文献、验证引用、核查参考文献、 文献核实、文献校验、假文献检测、SCI文献审计 allowed-tools:
- Read
- Write
- Edit
- Bash
- WebSearch
- WebFetch
- Agent
- AskUserQuestion metadata: emoji: "🔬" category: academic trigger: 审计文献真实性/核查参考文献/验证引用准确性 agent_created: true
SCI级文献真实性与引用一致性审计
对学术论文参考文献列表进行系统性联网核查,达到SCI期刊投稿前审计标准。 核心原则:多轮次、多数据源、多Agent互查——任何单一来源的结论不可采信。
适用场景
- 学术论文投稿前参考文献全面核查
- 识别AI伪造/幻觉文献
- 补全缺失的DOI、卷期页、作者列表
- 修正期刊名错误或缺失
- 标准化引用格式(Vancouver/AMA)
- 核查正文引用位置与参考文献的一致性
- 检测重复引用、编号错误等结构性问题
输入要求
用户需提供以下至少一项:
- 文献列表文件(.txt/.md/.docx):包含待审计的参考文献
- 直接粘贴的文献列表:在对话中直接提供
- 含文献列表的论文正文:可同时进行引用位置审计
可选提供:
- 正文文件(用于引用位置核查)
- 指定审计范围(如"只查[1]-[10]")
- 指定引用格式(默认Vancouver/AMA)
- 目标期刊(用于匹配特定期刊的引用格式要求)
核心工作流:7阶段+多轮多源多Agent+自学习
┌──────────────────────────────────────────────────────────────────────┐
│ 阶段〇:预检(结构性质检,不需联网) │
│ ↓ │
│ 阶段一:解析与分组 │
│ ↓ │
│ 阶段二:多Agent并行初查(第一轮)← Agent-PubMed / Agent-CrossRef 并行 │
│ ↓ │
│ 阶段三:多源交叉复核(第二轮)← 不同来源验证第一轮结果 │
│ ↓ │
│ 阶段四:冲突仲裁与深度验证(第三轮)← Agent-Referee 解决冲突 │
│ ↓ │
│ 阶段五:AI伪造识别 + 假文献替换 │
│ ↓ │
│ 阶段六:正文引用位置核查 │
│ ↓ │
│ 阶段七:报告生成 + 全局一致性检查 + 审计后自评 + 教训回流 │
└──────────────────────────────────────────────────────────────────────┘
阶段〇:预检(Pre-flight Check)
在正式审计前,先执行结构性质检,这些检查不需要联网,可立即完成:
- 编号连续性检查:[1],[2],...无跳号/重复/格式不统一
- 重复引用检测:
- 完全重复(作者+标题+期刊完全相同)
- 变体重复(同一论文不同格式)
- 检测方法:标题相似度 + 第一作者+年份+期刊组合去重 + DOI比对
- 排序检查:Vancouver按正文首次出现顺序;无正文按作者姓氏
预检输出:
📋 预检结果
- 总文献数:22条
- 编号连续性:✅ 连续 / ❌ 发现跳号[3]
- 重复引用:✅ 无重复 / ❌ [7]与[12]为同一论文
- 排序规则:按正文出现顺序 / 按作者姓氏
- 著录完整性:A级3条 / B级8条 / C级9条 / D级2条
阶段一:解析与分组(Parse & Partition)
- 逐条解析参考文献,提取结构化字段:编号、作者、标题、期刊、年份、卷(期):页、DOI、PMID
- 识别著录完整性等级:A级完整 / B级部分完整 / C级严重不完整 / D级仅标题+作者
- 优先审计C/D级(高风险),再审计A/B级
阶段二:多Agent并行初查(第一轮 — Round 1)
启动2-3个独立Agent,各自使用不同数据源,对同一批文献并行核查。
| Agent | 主数据源 | 辅助数据源 | 适用文献 | |-------|----------|-----------|----------| | Agent-PubMed | PubMed E-utilities API | PubMed网页搜索 | 全部生物医学文献 | | Agent-CrossRef | CrossRef API | Europe PMC API | 全部文献(侧重DOI) | | Agent-Journal | 期刊官网/出版商 | Google Scholar | 高风险文献 |
≤8条文献:2个Agent;>20条:按5-8条一组分配。
Agent Prompt模板:参见 references/agent_prompts.md
Agent结果整合:对每条文献构建多源对照表:
| 字段 | Agent-PubMed | Agent-CrossRef | 是否一致 | |------|-------------|---------------|----------|
判定规则:
- ✅ 两源一致 → 采信,标记"双源确认"
- ⚠️ 两源不一致 → 进入阶段四冲突仲裁
- ❌ 某源无法检索到 → 以另一源为准,标记"单源确认,待复核"
- ⚠️ 同一文献部分字段一致、部分不一致 → 一致字段采信,不一致字段进入阶段四仲裁
阶段三:多源交叉复核(第二轮 — Round 2)
对第一轮中所有"发现问题的文献"执行交叉验证。核心规则:第一轮用PubMed的→第二轮必须用CrossRef/期刊官网;反之亦然。
交叉验证矩阵:
| 第一轮主数据源 | 第二轮验证数据源 | |----------------|-----------------| | PubMed | CrossRef + 期刊官网 | | CrossRef | PubMed + PMC | | PubMed无结果 | Europe PMC + Google Scholar | | Agent间结果不一致 | 期刊官网(权威来源) |
结果分类:三源一致 → 最高置信度 | 双源一致 → 确认 | 单源确认 → 待手动确认 | 源间冲突 → 仲裁 | 全源无果 → AI伪造检测
阶段四:冲突仲裁与深度验证(第三轮 — Round 3)
当Agent间出现结果冲突时,启动独立仲裁Agent(Agent-Referee)解决。
仲裁规则:
| 冲突类型 | 仲裁规则 | |----------|----------| | 卷期页冲突 | 以PubMed正式记录为准 | | 年份冲突 | 以PubMed正式卷期年份为准;检查Epub vs正式出版 | | 期刊名冲突 | 以PubMed ISOAbbreviation(NLM缩写)为准 | | DOI冲突 | 以CrossRef为准(DOI注册机构),实际解析两个DOI确认 | | 作者列表冲突 | 以PubMed为准,按Vancouver格式截取 | | 标题微小差异 | 以PubMed完整标题为准(含副标题) |
Agent-Referee Prompt模板:参见 references/agent_prompts.md
最终确认检查(所有文献):
- DOI解析验证:访问
https://doi.org/[DOI]确认返回正确论文 - 回溯验证:用修正后的完整元数据在PubMed搜索确认
阶段五:AI伪造文献识别
前提:文献在所有Agent和所有来源中均无法检索到。
AI伪造特征检查清单(7项):过于完美的标题 / 不可验证的作者 / 不可验证的机构 / 期刊-内容不匹配 / DOI/PMID缺失且不可查 / 年份异常 / 引用量异常
判定流程:
- 2-3个来源无结果 + 3个以上AI特征 → ❌ 高度疑似AI伪造
- 所有来源无结果 + 5个以上AI特征 → ❌❌ 确认AI伪造
假文献替换:报告判定理由 → 提取正文引用意图 → 搜索替代文献 → 推荐2-3篇替换候选 → 用户决定
阶段六:正文引用位置核查
仅在用户提供了正文时执行。
一致性判断:✅一致 / ⚠️部分一致 / ❌不一致 / ❌过度推断 / ❌引而未用
额外检测:未引用检测(参考文献在正文中未被引用)
阶段七:报告生成 + 全局一致性检查 + 审计后自评
- 生成标准10节Markdown报告,默认
reference_audit_report.md - 执行全局一致性检查(见下方清单)
- 审计后自评:参见
references/quality_self_assessment.md - 教训回流:从本次审计中提炼新教训,写入
references/audit_lessons.md
置信度评分体系
每条文献的每个字段都有独立的置信度评分。
| 等级 | 定义 | 采信规则 | |------|------|----------| | A | 三源确认 | 直接采信 | | B | 双源确认 | 采信,附注 | | C | 单源确认 | 采信但标记"⚠️ 建议手动确认" | | D | 仲裁确认 | 采信但标记"⚠️ 建议手动确认" | | E | 无法验证 | 不修改原文 | | F | 确认伪造 | 标记假文献,推荐替换 |
文献总体置信度取所有字段中的最低置信度。
多Agent并行执行策略
| 文献数量 | Agent数量 | 分配策略 | |----------|----------|----------| | ≤5条 | 2 | Agent-PubMed + Agent-CrossRef 各查全部 | | 6-15条 | 2-3 | 按编号平分,高风险文献启动第3个 | | 16-30条 | 3 | 分3组(前1/3 + 中1/3 + 后1/3),各分配1组Agent | | >30条 | 3+ | 按8条一组分配,分批启动 |
Agent并行关键原则:
- 独立运行:互不干扰
- 统一输入:完全相同的原始文献列表
- 结果汇总:主Agent构建对照表
- 冲突上报:任何错误必须经另一Agent/数据源交叉验证
- 单源禁改:实质性修正需≥2个独立来源
报告格式规范
报告必须包含10个章节。详细格式规范参见 references/report_format.md。
章节概要:
- 总体审计摘要 — 统计表 + 总体可信度评级 + 多源验证统计
- 逐条文献审计报告 — 每条10个子节(原始文献/Agent-PubMed/Agent-CrossRef/对照表/交叉复核/冲突仲裁/最终确认/存在问题/修正后文献/查询来源)
- 查询网址列表 — 含使用Agent标注
- 网址信息提取列表 — 完整元数据
- 文献简报列表 — 含置信度
- 前后修正对比表 — 含置信度
- 最终可信参考文献列表 — 可直接复制使用
- 正文引用位置核查列表 — 如有正文
- 高风险问题列表 — 含风险等级和置信度
- 最终审计结论 — 含多轮多源验证完整性声明
引用格式标准
详细规范参见 references/citation_format.md。核心要点:
- Vancouver/AMA格式:
作者列表. 标题. 期刊缩写. 年份;卷(期):起页-止页. doi: 10.xxxx/xxxxx. - 作者:姓+名缩写无句点;≤6全部列出,>6用et al.;中间名首字母保留(如Karway GK)
- DOI格式:
doi: 10.xxxx/xxxxx(非DOI: 或 https://doi.org/) - 期刊缩写:NLM标准,速查参见
references/journal_abbreviations.md
审计纪律(Critical Rules)
❗ 绝对禁止
- 禁止凭记忆判断 — 所有结论基于联网检索
- 禁止猜测修正 — 不确定则标记"待手动确认"
- 禁止伪造URL — 所有URL必须是实际访问过的
- 禁止盲目修改正确内容 — 原文正确不得"修正"为错误
- 禁止单源修正 — 实质性修正需≥2个独立来源
- 禁止单Agent定论 — 错误结论须经另一Agent/数据源交叉验证
⚠️ 特别注意
- 作者缩写:PubMed "George K Karway" → Vancouver "Karway GK"(中间名首字母保留)
- 在线发表vs正式出版:以正式卷期年份为准
- 中文文献:拼音作者名+英文标题+Chin Med J格式;CNKI/万方补充验证
- 姐妹刊混淆:JAMA系列/Lancet系列/Nature系列/KI系列——必须核对ISSN
- 多Agent结果整合:绝不凭一个Agent结果修改原文,必须构建对照表
✅ 质量保障
- 双源验证 / 逐条复核 / 全局一致性 / 多Agent互查
- 用户反馈 → 立即启动2个Agent独立验证 → 承认错误 → 全局修正
- 审计后自评:参见
references/quality_self_assessment.md - 教训回流:每次审计后提炼新教训,写入
references/audit_lessons.md
报告全局一致性检查清单
修正任何条目后必须逐一检查:
- [ ] 章节一:统计数字 + 多源验证统计
- [ ] 章节二:该条10个子节
- [ ] 章节三:是否需补充URL + Agent标注
- [ ] 章节四:该条信息
- [ ] 章节五:该条简报 + 置信度
- [ ] 章节六:修正前后对比 + 置信度
- [ ] 章节七:该条最终引用
- [ ] 章节九:是否需增删 + 置信度
- [ ] 章节十:统计和建议 + 多源验证声明
参考文件索引
| 文件 | 内容 | 何时加载 |
|------|------|----------|
| references/agent_prompts.md | Agent-PubMed/CrossRef/Journal/Referee的完整Prompt模板 | 启动Agent时 |
| references/audit_lessons.md | 实战教训库(教训1-N,持续积累) | 审计全程参照 |
| references/journal_abbreviations.md | NLM期刊缩写速查表+易混淆对比 | 验证期刊名时 |
| references/search_templates.md | 搜索策略矩阵+API查询模板+决策树+Semantic Scholar | 执行搜索时 |
| references/quality_self_assessment.md | 审计后自评+教训回流+增量审计+版本管理 | 报告生成后 |
| references/citation_format.md | 完整引用格式规范+特殊类型+姐妹刊警示 | 生成报告时 |
| scripts/verify_dois.py | 批量DOI解析验证脚本 | 第三轮最终确认 |
任务管理
超过10条文献时,使用TaskCreate创建分阶段任务:
- 预检+解析文献列表
- 多Agent并行初查(第一轮)
- 多源交叉复核(第二轮)
- 冲突仲裁与深度验证(第三轮)
- AI伪造识别+假文献替换
- 生成审计报告
- 全局一致性复查 + 审计后自评
使用示例
| 场景 | 用户输入 | 工作流 |
|------|----------|--------|
| 基础审计 | 审计文献.txt中的文献真实性 | 预检→解析→多Agent初查→交叉验证→仲裁→报告→自评 |
| 指定范围 | 核查参考文献[9]-[16] | 2个Agent并行→交叉验证→更新报告 |
| 含正文 | 审计引用准确性,正文main.md,文献ref.txt | 多Agent核查+引用位置匹配 |
| 快速验证 | 验证Tangri N 2011 JAMA的DOI | PubMed+CrossRef双源确认 |
| 假文献检测 | 检查有没有假文献 | 多Agent核查→AI伪造检查→替代推荐 |
| 格式标准化 | 统一成Vancouver格式 | 解析→补全→标准化 |
| 用户反馈 | 第22条你们给的不对 | 2个Agent独立验证→承认错误→全局修正 |
错误处理
| 情况 | 处理 | |------|------| | 所有来源无法检索 | AI伪造特征检查→标记疑似假文献 | | CrossRef与PubMed不一致 | PubMed为准+Agent-Referee仲裁 | | DOI解析返回不同论文 | 标记不匹配+双源确认修正 | | Agent间结果冲突 | Agent-Referee仲裁 | | 某Agent报告错误但另一Agent未发现 | 第三来源验证——不能忽略 | | 用户指出报告错误 | 立即2个Agent独立验证+全局修正 | | 期刊网站反爬虫 | PubMed/CrossRef替代+标记"来源受限" | | Agent超时/中断 | 标记该Agent负责的文献为"未完成",用另一Agent补查+标记"单源确认" | | 大量文献(>30)分批超时 | 按批次保存中间结果到审计日志,断点续审 |
重复引用检测阈值
判断两条文献是否为同一论文的不同格式:
| 判定条件 | 判定结果 | |----------|----------| | DOI相同 | ❗ 确认重复(同一论文) | | 第一作者姓氏+年份+期刊+卷期页完全相同 | ❗ 高度疑似重复 | | 标题规范化后(去标点/空格/大小写)相似度≥90% | ⚠️ 疑似重复,需人工确认 | | 仅作者+年份相同但标题/期刊不同 | ✅ 非重复(同年同作者不同论文) |
审计结果交付
deliver_attachments发送报告文件open_result_view呈现报告- 口头摘要(3-5句):总体评级 + 最严重问题 + 多源验证覆盖率 + 需手动确认项 + 下一步建议
配置选项
| 选项 | 默认值 | 说明 | |------|--------|------| | 引用格式 | Vancouver/AMA | 可指定APA/Harvard | | 审计深度 | 三轮+多Agent | 可简化(会降低置信度) | | 并行Agent数 | 2-3 | 按文献数量自动调整 | | 最少验证来源数 | 2 | 实质性修正最低来源数 | | AI伪造检测 | 开启 | 可关闭以加速 | | 替换文献推荐 | 开启 | 检测到假文献时搜索替代 |
版本历史
| 版本 | 日期 | 变更 |
|------|------|------|
| 3.3.0 | 2026-05-24 | 全面质检修复:修正Semantic Scholar速率限制数据(无密钥100次/5min,非1000次);verify_dois.py标题子串匹配增加60%长度阈值防误匹配;16-30条Agent分配策略明确为3组(非2组);教训13/14消除与SKILL.md规则重复改为侧重经验洞察;补充PubMed E-utilities速率限制(3次/秒);自评检查清单9→10章节;Agent结果整合增加"部分字段不一致"处理规则;report_format.md补充Corrected (D-grade)状态;Agent-Journal查询方式补充Semantic Scholar;期刊缩写表BMJ全称去The;教训库数量描述改为N条(持续积累) |
| 3.2.0 | 2026-05-24 | 精细化修复:修正错别字(章业九→章节九);统一状态命名(Corrected Single-Source→Corrected C-grade);Agent Prompt明确指定general-purpose类型;补充Agent超时/中断处理;补充重复引用检测量化阈值;补充Semantic Scholar API;CrossRef礼貌池说明;clarify参考文献索引描述 |
| 3.1.0 | 2026-05-24 | 自学习升级:添加agent_created标记;Agent Prompt移入references/;新增审计后自评+教训回流+增量审计+版本管理+审计日志+质量自评清单(quality_self_assessment.md);新增批量DOI验证脚本(verify_dois.py);SKILL.md精简为核心工作流+规则 |
| 3.0.0 | 2026-05-24 | 多Agent并行互查+置信度评分+7阶段工作流+冲突仲裁 |
| 2.1.0 | 2026-05-24 | 预检+AI伪造识别+PubMed E-utilities+全局一致性清单 |
| 2.0.0 | 2026-05-24 | 初始版本 |
Content Repurposer
Content
Transforms a single piece of content into platform-adapted publications.
SEO Blog Post Writer
Content
Writes SEO-optimized blog posts with proper structure and keywords.
YouTube Script Writer
Content
Writes engaging YouTube scripts with hooks, structure, and retention.