占星學對照實驗與證據品質:來源審核指南
證據品質取決於研究設計,而不是結果是否驚人;抽樣、分配、盲法、對照、結果定義、遺漏資料、不確定性、多重比較、重複驗證與發表歷程都會影響推論。適用範圍與限制均清楚列出。
概覽
公平評估必須說明檢驗主張、預設結果、樣本、對照條件、盲法、評分、不確定性、重複驗證狀態與推論限制。本頁說明應核對什麼、如何重複方法、近似反例錯在哪裡、哪些差異會改變結果,以及證據不能成立的範圍。
概念速覽
- 直接範圍
- 審核結論:證據品質取決於研究設計,而不是結果是否驚人;抽樣、分配、盲法、對照、結果定義、遺漏資料、不確定性、多重比較、重複驗證與發表歷程都會影響推論。
- 應核對證據
- 方法檢查:從方案到結論審核研究:重建預設假設,統計實際分析人數,核實誰被設盲,重算評分與區間,檢查排除項,並尋找獨立重複研究。
- 可重複方法
- 範例結果:在星盤配對試驗中,占星師從多個盲化檔案中選擇一項;憑證記錄機會水準、揭盲前評分、信賴區間、退出情況,以及是否有其他團隊複製方案。
- 範例
- 失敗條件:小型非盲見證調查無法回答盲法區辨試驗的問題;把兩者都籠統稱為「研究」,會掩蓋期待效應、自我選擇、彈性評分與缺少對照。
- 反例
- 紀錄差異:探索性分析可生成假設,驗證性分析檢驗預設假設;只要如實標示,兩者都有用途,但探索後發現的模式不能繼承驗證性確定度。
- 限制與安全
- 使用界線:單一實驗很少能裁決整個傳統;結果受精確任務、樣本、實施方式與不確定性限制,陽性或虛無結果都不能授權醫療、法律、財務或安全用途。
定義與範圍
公平評估必須說明檢驗主張、預設結果、樣本、對照條件、盲法、評分、不確定性、重複驗證狀態與推論限制。
證據品質取決於研究設計,而不是結果是否驚人;抽樣、分配、盲法、對照、結果定義、遺漏資料、不確定性、多重比較、重複驗證與發表歷程都會影響推論。
證據與可重複方法
從方案到結論審核研究:重建預設假設,統計實際分析人數,核實誰被設盲,重算評分與區間,檢查排除項,並尋找獨立重複研究。
範例與反例
在星盤配對試驗中,占星師從多個盲化檔案中選擇一項;憑證記錄機會水準、揭盲前評分、信賴區間、退出情況,以及是否有其他團隊複製方案。
小型非盲見證調查無法回答盲法區辨試驗的問題;把兩者都籠統稱為「研究」,會掩蓋期待效應、自我選擇、彈性評分與缺少對照。
差異與爭議
探索性分析可生成假設,驗證性分析檢驗預設假設;只要如實標示,兩者都有用途,但探索後發現的模式不能繼承驗證性確定度。
限制與安全使用
單一實驗很少能裁決整個傳統;結果受精確任務、樣本、實施方式與不確定性限制,陽性或虛無結果都不能授權醫療、法律、財務或安全用途。
來源與編輯依據
- Nature: A Double-Blind Test of AstrologyNature 318 (1985), pages 419–425, abstract, “Double-blind procedures”, results, and discussion1985年的本命星盤雙盲配對研究;引用時必須交代具體設計、檢驗主張、樣本、結果及後續方法爭論,不能只當口號。
- Forer (1949): The Fallacy of Personal ValidationForer (1949), Journal of Abnormal and Social Psychology 44(1), pages 118–123, method and personal-validation ratings佛瑞效應或巴納姆效應的原始研究,用於說明寬泛且討喜的描述為何容易讓人覺得高度貼合。