FUURAA™ 赋睐™ AI 知识图书馆 · 研究综述指南

如何复核 AI 生成的研究综述

用六道证据门,把一篇流畅综述还原为预先定义的问题、可复现检索、可审计筛选、来源级提取、受约束综合与带日期结论。适用于研究简报、政策综述、行业报告、证据地图与尽职调查。

发布2026 年 8 月 23 日证据状态基于综述报告、检索、偏差评价、溯源与生成式 AI 风险一手方法的综合适用范围研究简报、政策综述、行业报告、证据地图与尽职调查

大量引用不等于完整综述

研究综述的可信度取决于证据如何进入、被改变和影响结论,而不取决于语言多流畅。

AI 可以快速寻找、筛选、提取、翻译与总结资料,但每一步都可能改变证据集合。复核必须保留问题与协议、检索覆盖、筛选理由、准确来源、提取位置、偏差评价、综合方法及到期状态,才能区分“资料很多”与“结论受到支持”。

适用边界本页是公共研究方法,不代表 FUURAA 产品能力,也不评价任何模型、供应商、搜索工具、综述或出版者;不替代领域专家、统计复核、同行评审或正式系统综述,也不是医疗、法律、投资、采购、认证、审计或合规意见。

六道可拒绝的证据门

每道门都要回答判断问题、交出最低证据,并在关键未知时停止综合或缩小结论。

01

冻结问题、协议与综述类型

判断问题
在筛选来源前,准确问题、人群或情境、概念、结果、纳入规则、综述类型与计划综合方法是什么?
最低证据
带日期的协议、问题框架、纳入与排除标准、结果定义、计划的亚组或综合规则、复核团队与修订日志。
停止条件
问题或纳入规则似乎在看到有利研究后才被改写,或未说明综述类型时停止。
02

重建检索与覆盖范围

判断问题
哪些数据库、平台、注册库、网站、语言、日期范围、检索式与补充方法可能找到符合条件的证据?
最低证据
按平台列出的完整检索式、运行日期、限制条件、灰色文献与引文追踪方法、检索同行复核、结果数量与去重规则。
停止条件
检索无法重跑、只依赖一个不透明检索工具、无理由遗漏重要语言或来源,或没有截止日期时停止。
03

审计筛选、身份与来源状态

判断问题
每条记录能否从发现、去重、初筛、全文复核到纳入完整追踪,并保留明确理由与当前来源状态?
最低证据
流程数量、记录标识符、重复与版本关系、全文排除理由、复核者决定、分歧解决、更正与撤回状态。
停止条件
纳入研究无法与检索结果对齐、AI 静默改变筛选决定,或预印本与正式报告被重复计算时停止。
04

对照原文核验提取与评价

判断问题
研究特征、方法、结果与局限是否从准确位置提取,并使用适合领域的方法进行评价?
最低证据
结构化提取记录、页码或表格位置、同一研究的多份报告、结果定义、人工核验、偏差判断与支持引文。
停止条件
生成摘要替代原始数据、翻译改变含义、评价标签没有理由,或同一研究的多份报告被误当成独立研究时停止。
05

在接受流畅结论前挑战综合方法

判断问题
研究是否足够可比以采用所选综合方法;异质性、缺失证据、权重、冲突与敏感性是否可见?
最低证据
综合理由、分组规则、效应或主题定义、异质性与不确定性、偏差整合、敏感性分析、相反发现与被排除比较。
停止条件
不同人群、干预、任务、指标或日期被压成一个主张,或以叙述中的“多数”取代明确权重与不确定性时停止。
06

限定结论、溯源与到期

判断问题
哪些纳入证据支持每项结论;确定性与可迁移性如何;哪些新证据、更正或情境变化会触发更新?
最低证据
主张与研究映射、证据确定性、适用边界、冲突、生成与人工复核溯源、核对日期、检索截止日、到期与更新触发器。
停止条件
结论超出证据集合、未披露 AI 参与、隐藏来源依赖,或不存在带日期的重检条件时停止。

最低综述失效矩阵

主动检查这些情形,才能发现流畅叙述背后的检索、筛选、提取与综合偏差。

  • 01
    在不利研究出现后,研究问题才被缩窄

    记录受影响的研究、综合步骤与结论,保留可继续成立的最窄陈述,并明确需要重新检索、筛选、提取还是重新综合。

  • 02
    一个数据库或 AI 检索工具提供了几乎全部纳入证据

    记录受影响的研究、综合步骤与结论,保留可继续成立的最窄陈述,并明确需要重新检索、筛选、提取还是重新综合。

  • 03
    非英语、未发表或阴性证据无解释地消失

    记录受影响的研究、综合步骤与结论,保留可继续成立的最窄陈述,并明确需要重新检索、筛选、提取还是重新综合。

  • 04
    预印本与正式论文被当作两项独立研究

    记录受影响的研究、综合步骤与结论,保留可继续成立的最窄陈述,并明确需要重新检索、筛选、提取还是重新综合。

  • 05
    AI 提取改变分母、效应方向或不确定性

    记录受影响的研究、综合步骤与结论,保留可继续成立的最窄陈述,并明确需要重新检索、筛选、提取还是重新综合。

  • 06
    虽有偏差标签,却从未影响综合结论

    记录受影响的研究、综合步骤与结论,保留可继续成立的最窄陈述,并明确需要重新检索、筛选、提取还是重新综合。

  • 07
    不兼容的任务、人群或指标被合成一个确定陈述

    记录受影响的研究、综合步骤与结论,保留可继续成立的最窄陈述,并明确需要重新检索、筛选、提取还是重新综合。

  • 08
    后续更正、撤回或重要新研究没有触发重新复核

    记录受影响的研究、综合步骤与结论,保留可继续成立的最窄陈述,并明确需要重新检索、筛选、提取还是重新综合。

最低研究综述复核记录

让下一位复核者能够重建资料为何被找到、纳入、改变并最终影响结论。

  1. 01综述问题、类型、发布者、日期与证据状态
  2. 02协议、纳入标准、计划综合方法与修订
  3. 03数据库、平台、检索式、语言与检索日期
  4. 04补充检索、来源数量、去重与覆盖局限
  5. 05筛选流程、全文排除、理由与复核者分歧解决
  6. 06研究身份、版本、报告、更正与撤回
  7. 07提取数据、准确位置、变换与人工核验
  8. 08评价方法、偏差风险判断与支持理由
  9. 09综合方法、异质性、缺失证据与敏感性
  10. 10主张映射、确定性、适用性、AI 溯源、到期与更新触发器

统一证据状态

把结论状态绑定到完整流程与日期,而不是引用数量或文本流畅程度。

有支持

协议、可复现检索、筛选流程、来源级提取、评价、综合与带日期结论均可重建并独立检查。

有条件

综述可复核,但结论只适用于明确数据库、语言、研究设计、人群、结果、日期或分析选择。

结果混合

纳入研究、偏差评价、亚组或综合方法产生实质不同结论,差异应继续公开保留。

证据不足

问题、检索、筛选、提取、评价或综合证据缺失;流畅文字与大量引用不能替代可复核过程。

FUURAA 分析单条引用核验回答“这项来源是否支持这句话”;研究综述复核还必须回答“为什么是这些来源、它们如何被赋予权重、缺失与冲突如何改变结论”。FUURAA 建议把综述结论保留为“问题与协议 × 检索覆盖 × 筛选与提取 × 评价与综合 × 截止日期”。AI 提高了阅读速度,但不能把选择过程变成不可见的黑箱。

一手来源与不可外推边界

这些方法分别约束报告、检索、筛选、偏差、溯源与 AI 风险;没有任何单项能独立证明综述可靠。

来源于 2026 年 8 月 23 日重新核对。每项保留发布日期、在本方法中的作用与不可外推边界。

2021 年 3 月 29 日PRISMA 2020 Statement

提供 27 项报告框架与流程图,用于说明系统综述为何开展、如何识别和筛选研究,以及如何综合发现。

边界PRISMA 是报告指南;报告完整本身不证明检索、评价、综合或结论无偏且正确。

打开一手来源 ↗
2021 年 1 月 26 日PRISMA-S — Reporting Literature Searches in Systematic Reviews

增加 16 项检索报告要求,覆盖数据库、平台、检索式、日期、补充方法、同行复核与记录数量。

边界可复现报告的检索仍可能过窄、过时或与综述问题不匹配;报告完整不等于覆盖充分。

打开一手来源 ↗
6.5.1 版;章节于 2025 年 3 月更新Cochrane Handbook — Chapter 4: Searching for and Selecting Studies

详细说明信息来源、检索规划、记录管理、过程文档、纳入标准与研究筛选的系统方法。

边界该章节面向 Cochrane 干预综述;迁移到其他领域或综述类型前必须明确调整。

打开一手来源 ↗
2016 年 1 月 1 日出版;2015 年 6 月 16 日在线ROBIS — A Tool to Assess Risk of Bias in Systematic Reviews

围绕纳入标准、研究识别与筛选、数据收集与评价、综合及解释,建立综述层偏差评估结构。

边界ROBIS 主要面向医疗领域的干预、诊断、预后与病因综述,并非通用质量评分。

打开一手来源 ↗
W3C 推荐标准,2013 年 4 月 30 日W3C PROV-DM — The PROV Data Model

定义实体、活动、主体、派生、修订与引用关系,用于重建来源筛选、提取、翻译与综合过程。

边界溯源可以揭示综述如何产生,但完整轨迹不会自动使来源、变换或结论可靠。

打开一手来源 ↗
2024 年 7 月 26 日发布;2026 年 4 月 8 日更新NIST AI 600-1 — Generative AI Profile

把 AI 风险管理扩展到生成式 AI 的虚构、信息完整性、监测与人工核验风险。

边界该跨行业风险画像不规定系统综述实施方法,也不评价单份综述或认证生成研究内容。

打开一手来源 ↗

继续核对

从完整综述返回单条引用、AI 主张与证据记录。

核验 AI 生成引用评估 AI 主张建立证据记录进入 AI 溯源图谱