占星术对照实验与证据质量:来源审核指南
证据质量取决于研究设计,而不是结果是否惊人;抽样、分配、盲法、对照、结果定义、缺失资料、不确定性、多重比较、重复验证与发表历程都会影响推论。适用范围与限制均明确列出。
概览
公平评估必须说明检验主张、预设结果、样本、对照条件、盲法、评分、不确定性、重复验证状态与推论限制。本页说明应核对什么、如何重复方法、近似反例错在哪里、哪些差异会改变结果,以及证据不能成立的范围。
概念速览
- 直接范围
- 审核结论:证据质量取决于研究设计,而不是结果是否惊人;抽样、分配、盲法、对照、结果定义、缺失资料、不确定性、多重比较、重复验证与发表历程都会影响推论。
- 应核对证据
- 方法检查:从方案到结论审核研究:重建预设假设,统计实际分析人数,核实谁被设盲,重算评分与区间,检查排除项,并寻找独立重复研究。
- 可重复方法
- 实例结果:在星盘匹配试验中,占星师从多个盲化档案中选择一项;凭证记录机会水平、揭盲前评分、置信区间、退出情况,以及是否有其他团队复制方案。
- 实例
- 失败条件:小型非盲见证调查无法回答盲法区分试验的问题;把两者都笼统称为“研究”,会掩盖期待效应、自我选择、弹性评分与缺失对照。
- 反例
- 记录差异:探索性分析可生成假设,验证性分析检验预设假设;只要如实标注,两者都有用途,但探索后发现的模式不能继承验证性确定度。
- 限制与安全
- 使用边界:单一实验很少能裁决整个传统;结果受准确任务、样本、实施方式与不确定性限制,阳性或空结果都不能授权医疗、法律、财务或安全用途。
定义与范围
公平评估必须说明检验主张、预设结果、样本、对照条件、盲法、评分、不确定性、重复验证状态与推论限制。
证据质量取决于研究设计,而不是结果是否惊人;抽样、分配、盲法、对照、结果定义、缺失资料、不确定性、多重比较、重复验证与发表历程都会影响推论。
证据与可重复方法
从方案到结论审核研究:重建预设假设,统计实际分析人数,核实谁被设盲,重算评分与区间,检查排除项,并寻找独立重复研究。
实例与反例
在星盘匹配试验中,占星师从多个盲化档案中选择一项;凭证记录机会水平、揭盲前评分、置信区间、退出情况,以及是否有其他团队复制方案。
小型非盲见证调查无法回答盲法区分试验的问题;把两者都笼统称为“研究”,会掩盖期待效应、自我选择、弹性评分与缺失对照。
差异与争议
探索性分析可生成假设,验证性分析检验预设假设;只要如实标注,两者都有用途,但探索后发现的模式不能继承验证性确定度。
限制与安全使用
单一实验很少能裁决整个传统;结果受准确任务、样本、实施方式与不确定性限制,阳性或空结果都不能授权医疗、法律、财务或安全用途。
来源与编辑依据
- Nature: A Double-Blind Test of AstrologyNature 318 (1985), pages 419–425, abstract, “Double-blind procedures”, results, and discussion1985年的本命盘双盲配对研究;引用时必须交代具体设计、检验主张、样本、结果及后续方法争论,不能只当口号。
- Forer (1949): The Fallacy of Personal ValidationForer (1949), Journal of Abnormal and Social Psychology 44(1), pages 118–123, method and personal-validation ratings福勒效应或巴纳姆效应的原始研究,用于说明宽泛且讨喜的描述为何容易让人觉得高度贴合。