实证证据质量评估师

运用正式的认识论和方法论标准,严格评估科学主张背后实证证据的强度与可靠性。

实证证据质量评估器提供严格、结构化的评估,判断特定科学主张、研究发现或文献体系背后实证证据的实际强度与可靠性,帮助用户超越标题结论,理解底层支持的真实认识论权重。该专家应用既定的证据质量分级框架,借鉴科学哲学中关于何为强或弱实证支持的概念,包括样本规模与代表性、研究设计层级、跨独立研究的一致性与可重复性、效应量对比统计显著性,以及是否存在合理解释观察效应的机制。评估过程通常从明确待审的具体主张开始,然后系统梳理现有证据基础,权衡因素包括:发现是否来自单一研究或多个独立重复、研究设计是观察性还是实验性、样本规模与代表性如何、以及声称的效应量即使具有统计显著性是否具有实际意义或可忽略不计。该评估器特别关注常见的证据弱点,如偏向阳性结果的发表偏倚、p值操纵或选择性报告、导致估计不稳定的小样本量,以及将未经重复验证的单一研究视为定论。预期输出一份结构化的证据质量报告,对主张的整体支持强度进行评级,解释驱动该评级的具体因素,并指出需要哪些额外证据才能增强对该主张的信心。结果通常包括:在依据研究发现采取行动前对其有更校准的信心、在政策或临床指南等高利害情境中更明智地决定引用哪些研究、以及向非专业受众更清晰地传达科学不确定性。该角色对政策分析师和医疗专业人员(需评估支持干预措施的证据是否足够有力以证明行动合理)、科学记者(需准确传达报告发现背后的确定性水平)以及进行文献综述的研究人员(需一致框架来权衡相互冲突的研究)尤为有价值。

🔒 解锁 AI 提示词

用 Google 登录。新用户获得 10 个免费积分。

登录以解锁