|
任何 人 知道 該 如何是好 。 根據 我們 的 認知 , 醫學 研究 中 從未 有 人 考量 過 這 個 問題 。 為了 能 檢驗 自己 的 結果 為 肯定 , 敘達維安 的 釣客 只 需 從 水 中 釣起 魚兒 便 可 立即 知道 自己 釣到 什麼 。 診斷 時 必須 理性 地 重複 進行 陽性 的 檢驗 , 藉由 其他 檢驗 和 研究 的 補充 才 能 查證 結果 。 醫學 研究 中 同樣 需要 此 種 理性 的 處理 方式 , 一 項 研究 也 需 反覆 進行 , 但 這 種 要求 卻 常 面臨 許多 阻礙 。 道德 思維 的 要求 : 如果 甲 治療 方法 經 證實 後 確認為 較 佳 時 , 不可 在 第二 階段 研究 中 以 甲 法 治療 某些 病患 , 卻 又 以 乙 法 治療 其他 的 病患 。 試想 您 第一 階段 的 研究 已 證實 了 上述 結果 , 而 您 卻 剝奪 了 乙 治療 方法 的 病患 接受 最好 治療 的 機會 。 研究 推廣 的 立場 : 針對 曾經 進行 過 的 研究 項目 , 不 願 撥款 支持 雙重 研究 。 雜誌 發行人 的 看法 : 我 該 發行 這 研究 結果 嗎 ? 這 是 什麼 新鮮 的 玩意兒 ? 這 我們 早 就 報導 過 了 。 自我 虛榮心 的 作祟 : 是否 該 炒作 別人 的 研究 ? 儘管 我 自己 有 足夠 有利 的 想法 , 或 甚至 我 的 研究 應 可 推翻 之前 的 結果 , 我 也 只 能 得到 別人 說 我 某 部分 做錯 的 評語 。 敘達維安 釣魚 診斷 檢驗 臨床 研究 最初 的 機率 可 口魚 的 頻率 生病 的 頻率 研究 成果 確實 較 佳 的 機率 錯誤 肯定 的 結果 一 條 臭味魚 上鉤 。 將 一 名 健康 者 視為 病患 。 第一 類 錯誤 。 雖 無 差異 , 卻 能 證實 其 存在 ( 指標 水準 : 犯下 此 種 錯誤 的 機率 ) 。 錯誤 否定 的 結果 無 此 情形 , 因為 所有 可 口魚 皆 上鉤 ( 效力 等於 百分 至之百 ) 。 將 一 名 病患 視為 健康 者 。 第二 類 錯誤 。 雖 有 差異 , 卻 不能 證實 其 存在 ( 效力 : 不會 犯下 此 種 錯誤 的 機率 ) 。 檢驗 一 項 肯定 結果 將 魚 從 水 中 釣起 。 重複 進行 檢驗 及 / 或 後續 檢查 。 反覆 研究 ! ! ? ? 沒 人 願意 提供 經費 , 沒 人 有 興趣 發表 研究 結果 , 更何況 還 存在 道德 的 缺失 。 錯誤 肯定 結果 的 可能 推論 乾 麵包 取代 魚 。 需 將 臭味魚 處理掉 。 可能 損失 一 個 魚餌 。 病患 需 忍受 後續 檢查 , 這 可能 導致 副作用 。 一 個 經 證實 的 治療 方法 由 另 一 個 較 不 為 人 知 者 所 取代 。 帶給 某些 甚至 許多 病患 在 生命 與 健康 上 的 負面 影響 。 表格 五十 : 托馬斯 想法 的 一 覽表 。 基本 上 , 醫學 研究 人員 不會 檢查 自己 遇到 何 種 陷阱 。 當 他 獲得 和 插圖 十四一樣 的 結果 並 從 某 位 統計學家 的 認可 ( p≦ 0.05 ) 時 , 他 會 自然而然 地 認為 自己 釣到 的 是 一 條 可口魚 。 於是 一切 不再 礙手礙腳 的 , 未來 他 只 需 以 「 經 證實 後 確認為 較 佳 」 的 方法 治療 病患 。 一如 我們 現在 所 知 但 至今 未 能 回答 的 失誤率 問題 , 醫學家 ( 並非 只有 他 ) 稱 它 為 p-值 又 將 它 視為 失誤率 。 其實 教科書 對 p-值 的 命名 有 誤導 的 情形 , 這 種 誤解 使得 p-值 在 國際 文獻 中 佔有 一席之地 , 事實 上 它 本身 並 無 任何 價值 。 研究 的 比例 研究 結果 為 肯定 的 比例 研究 結果 為 否定 的 比例 新 治療法 確實 較 佳 ( 有利 的 想法 ) 10% 10% x 0.80 = 8% 10% x 0.20 = 2% 新 治療法 確實 並 未 較 佳 ( 無益 的 想法 ) 90% 90% x 0.025 = 2.25% 90% x 0.975 = 87.75% 總計 100% 10.25% 89.75% 研究 結果 為 肯定 時 , 新治療法 確實 較 佳 的 機率 : 8/10.25 = 0.78 或 78% 表格 五十一:一 項 臨床 研究 的 可能 結果 , 考量 每 第二 個 重大 結果 才 是 錯誤 肯定 結果 的 事實 。 假設 : 指標 水準 是 百分之五 , 效力 是 百分之八十 , 而 有利 想法 的 機率 是 百分之十 。 表格 四十九 中 仍 存在 一 個 思考 上 的 小 缺點 , 它 稍微 誇大 了 這 個 問題 。 假設 所有 研究 的 結果 皆 恰巧 證實 了 一 項 重大 發現 , 即 新 治療法 的 療效 較 佳 ; 或 其中 一半 的 情形 證實 新 治療法 恰巧 較 差 , 這時 當然 就 不會 有 人 認為 新 治療法 比較 好 。 因此 需 將 表格 四十九 修改成 表格 五十一 。 整體 而言 , 研究 結果 中 有 百分之十二點五 的 情形 顯示 : 「 新治療法 較 佳 」 , 但 其中 只 有 百分之八 的 情形 確實 如此 , 所以 失誤率 為 百分之二十二 ( 2.25 / 10.25 = 0.22 ) 。 這 機率 雖然 低於 之前 計算出 的 百分之三十六 , 但 儘管 如此 還是 不能 對 這 問題 視若無睹 。 在 表格 五十二 中 托馬斯 思索 著 , 有利 想法 的 機率 究竟 該 多 高 , 才 能 在 一般 條件 下 ( 指標 水準 是 百分之五 , 效力 是 百分之八十 ) 計算出 差不多 大小 的 實際 失誤率 , 就 像 一般 受到 指標 水準 操縱 的 情形 相同 。 慈悲 的 研究 人員 認為 有利 想法 的 機率 該 為 百分之四十 , 果真如此 他們 將 能 滿足 上述 的 要求 。 研究 的 比例 研究 結果 為 肯定 的 比例 研究 結果 為 否定 的 比例 新 治療法 確實 較 佳 ( 有利 的 想法 ) 40% 40% x 0.80 = 32% 40% x 0.20 = 8% 新 治療法 確實 並 未 較 佳 ( 無益 的 想法 ) 60% 60% x 0.025 = 1.5% 60% x 0.975 = 58.5% 總計 100% 33.5% 66.5% 研究 結果 為 肯定 時 , 新治療法 確實 較 佳 的 機率 : 32/33.5 = 0.955 或 95.5% 表格 五十二:一 項 臨床 研究 的 可能 結果 , 考量 每 第二 個 重大 結果 才 是 錯誤 肯定 結果 的 事實 。 假設 : 指標 水準 是 百分之五 , 效力 是 百分之八十 , 而 有利 想法 的 機率 是 百分之四十 。 如果 機率 確實 為 百分之四十 , 那麼 我們 的 好 日子 就 將 降臨 了 。 若 每 位 充滿 夢想 的 研究 人員 引發 的 失誤率 ( 等於 無益 想法 的 機率 ) 為 百分之六十 , 六 位 相同 的 研究 人員 同時 發生 失誤 的 機率 則 為 百分之四點六 , 0.6 x 0.6 x 0.6 x 0.6 x 0.6 x 0.6 = 0.046 。 結果 低於 百分之五 。 如果 六 人 皆 一致 認同 某 研究 中 的 甲藥 優於 乙藥 , 結果 即為 重大 的 發現 , 而 不需 再 進行 研究 。 「 如果 那些 專家 真 有
|