|
測量 的 分數 範圍 是 從 11 ( 低度 孤寂感 ) 到 55 ( 高度 孤寂感 ) 。 樣本 __UNDEF__ Gerson __UNDEF__ 與 Perlman __UNDEF__ 對 加拿大 Manitoba 大學 的 300 名 女 大學生 進行 了 甄別 , 從中 找出 66 名 女性 作為 他們 的 研究 對象 。 Shaver __UNDEF__ 等 人 研究 了 Denver __UNDEF__ 大學 的 400 名 新生 , 但是 在 他們 的 狀態 - 特質 研究 中 只 分析 了 166 名 完成 了 全部 四 次 問卷 調查 的 學生 。 信度 1. 內部 一致性 信度 Gerson __UNDEF__ 與 Perlman __UNDEF__ 沒有 報告 其 量表 的 α 係數 , 但是 既然 UCLA 量表 本身 有 內在 的 一致性 ( α >.90 ) , 那麼 由 它 改編 的 量表 也 理應 如此 。 Shaver __UNDEF__ 等 人 的 量表 曾 在 九 個 月 中 施測 四 次 , 其 α 係數 都 在 .88 以上 。 2 .
再 測 信度 __UNDEF__ Gerson __UNDEF__ 與 Perlman __UNDEF__ 沒有 評鑑 再 測 信度 。 如果 研究 者 要 比較 不同 群體 的 受測 者 的 主觀 幸福感 與 一 段 時間 後 主觀 幸福感 的 總體 變化 , 重要 的 不僅僅 是 要 測量 主觀 幸福感 本身 , 而且 要 測量 可能 影響 主觀 幸福感 改變 的 其它 有關 因素 ( 抱負 水平 、 意識到 的 成就 、 各 種 社會 心理 因素 等 ) 。 2 .
實踐 上 的 考慮 除了 上面 討論到 的 理論 上 的 考慮 外 , 實踐 上 的 考慮 也 將 影響 實徵 研究 的 設計 , 包括 研究 者 所 選 的 測量 主觀 幸福感 的 工具 。 人們 廣泛 使用 單一 測題 的 主觀 幸福感 測量 主要 是 在於 它 的 經濟性 : 施測 它們 比 施測 那些 有 10 項 、 20 項 或 40 項 測題 的 量表 所 耗費 的 時間 少 。 儘管 大家 都 承認 單一 測題 的 主觀 幸福感 測量 沒有 多 題 量表 那麼 準確 , 但 這 一 個 問題 是否 重要 取決 於 個別 研究 的 目的 。 如果 為 了 作 相關 分析 或 對 某人 進行 預測 或 保薦 , 那麼 , 個人 水平 的 準確性 就 是 重要 的 。 如果 主要 目的 只是 報告 一 個 群體 相對於 另 一 個 群體 主觀 幸福感 的 平均 水平 或 檢測 該 群體 在 一 段 時間 內 主觀 幸福感 的 變化 , 個人 水平 的 準確性 就 不 太 重要 。 研究 者 還 必須 考慮 受測 者 的 性質 。 上面 提到 的 一些 主觀 幸福感 的 測量 因為 是 專 為 老年人 設計 的 ( PGC 士氣 量表 , LSIA , LSIZ ) , 就 不 適用 於 一般 群體 。 如果 要 用於 一般 群體 的話 , 就 需要 對 其 進行 修改 。 另 一 個 實踐 上 的 考慮 是 對 從 過去 研究 中 取得 可 比較 資料 的 相對 重要性 。 如果 一 個 人 要 將 自己 的 新 結果 與 從 許多 國家 或 一 個 國家 中 的 某些 群體 的 「 常模 」 進行 比較 , 就 應該 選擇 過去 曾 用於 那 一 類 群體 的 主觀 幸福 量表 。 本 章 前面 的 論述 可 幫助 讀者 找到 有關 研究 的 參考 資料 。 在 一 篇 總結 了 快樂感 文獻 的 論文 之後 , Veenhoven __UNDEF__ ( 1984 a ) 提出 四 個 提高 快樂感 資料 質量 的 「 工作 原則 」 ( 這些 原則 或許 也 適用 於 研究 幸福感 的 其它 方面 ) : (1) 自我 評定 比 他人 評定 受 歡迎 ; (2) 匿名 問卷 比 個人 訪談 效果 好 ; (3) 問題 應該 明確 地 集中 於 整體 生活 的 評定 ; (4) 問題 中 應該 留有 回答 「 不 知道 」 或 「 沒有 答案 」 的 答案 選擇 。 本 文 作者 自己 設計 主觀 幸福感 測量 的 體會 , 總的來說 , 與 Veenhoven __UNDEF__ 的 大致 相同 , 但 我們 認為 第三 個 原則 ( 注意 整體 生活 ) 只有 在 研究 者 對 整體 水平 感興趣 時 才 適用 ; 測量 更 具體 的 生活 領域 時 目前 的 具體 測量 工具 也 常 得到 很 好 的 結果 。 3 .
心理 計量 上 的 考慮 ( 1) 效度 -- 一 個 測量 的 效度 是 指 其 對 所 要 反映 的 概念 的 真實 反映 程度 。 任何 一 個 測量 都 需要 有 可靠 的 效度 。 然而 , 評鑑 包括 主觀 幸福感 在 內 的 態度 測量 的 效度 卻 會 遇到 幾 個 困難 。 問題 在於 根本 找 不 到 獨立 的 「 外部 」 效標 以 與 之 比較 。 有 一 篇 文章 的 標題 簡要 又 充分 地 道出 了 這 個 困難 : 「 如果 您 想 知道 我 多麼 快樂 , 您 只有 來 問 我 」 ( __UNDEF__ Irwin , Kammann & Dixon __UNDEF__ ,1979 ) 。 評鑑 主觀 幸福感 測量 的 效度 時 , 研究 者 一直 遵循 幾 個 基本 的 策略 。 其中 之 一 後來 被 放棄 了 , 就是 試圖 顯示 主觀 幸福感 與 幸福 的 許多 「 客觀 」 效標 間 有 很 強 的 共變性 。 但 研究 者 發現 所 找到 的 共變性 通常 很 弱 。 例如 , 對 住房 的 滿足感 並 不 明顯 地 隨 住房 面積 和 其 佈置 優雅 程度 的 變化 而 變化 ; 對 住處 的 安全 的 滿足感 與 犯罪率 也 沒有 很 高 相關 , 等等 。 一般人 認為 這 種 相關 不 高 並 不 是 由於 主觀 幸福感 測量 有 大 問題 , 而是 由於 它們 所 測量 的 東西 與 「 客觀 」 效標 所 代表 的 東西 不同 ( 更 詳細 的 討論 可 參見 Andrews __UNDEF__ ,1981 ) ; 主觀 幸福感 所 反映 的 內容 與 抱負 水平 有關 , 這 一 點 在 本 章 前面 已 討論 過 。 第二 種 策略 就 是 從 主觀 幸福感 測量 之間 彼此 的 高 相關 及 在 短期 內 有 高 穩定性 這 兩 個 意義 上 來 說明 主觀 幸福感 測量 的 效度 是 比較 好 的 。 這些 其實 都 是 信度 指標 ( 下面 要 討論 的 ) , 並 不 直接 涉及 效度 問題 。 第三 種 策略 就 是 去 探看 當 人們 在 遇到 生活 中 的 某些 變故 , 因而 幸福感 應該 有所 下降 時 , 量表 得分 是否 相應 有 下降 。 例如 : 有 嚴重 健康 問題 的 病人 中 「 應該 」 , 至少 在 短期 內 , 對 自己 的 健康 較 不 滿意 。 一些 相當 好 的 分析 ( 例如 Atkinson ,1982 ; __UNDEF__ Headey , Holstrom & Wearing ,1984 b ; Martinson , Willeening & Linn ,1985 ) 都 顯示 像 上述 這 種 預期 的 幸福感 變化 的確 常常 發生 , 從而 驗證 了 主觀 幸福感 測量 的 效度 。 正 如 __UNDEF__ Robinson __UNDEF__ (1969) 所 指出 的 , 社會 中 滿足感 或 快樂感 最 低 的 群體 往往 也 是 那些 自殺率 最 高 或 具有 其它 「 逃避 」 行為 ( 如 吸毒 ) 最多 的 群體 。 這些 預測 的 被 驗證 , 均 可 增加 測量 工具 的 效度 。 第四 種 策略 是 運用 多 方法 - 多 特質 ( multimethod-multitrait ) 的 資料 來 建立 一 個 潛在 變量 因果 模式 ( latent-variable causal modeling __UNDEF__ ) 用以 直接 評估 構念 效度 。 這裡 的 邏輯 在於 , 潛在 變量 代表 了 個人 主觀 幸福感 的 「 實質 」 水平 , 或 代表 了 可 確認 的 隨機 或 有 相關 的 測量 誤差 。 並且 , 在 一 組 測量 中 所 觀察到 的 關係 可以 用 潛在 變量 之間 的 關係 , 及 它們 對 所 觀察到 的 測量 的 因果 效應 強度 來 概括 。 Andrews __UNDEF__ 與 Crandall __UNDEF__ ( Andrews & Withey __UNDEF__ ,1976 ) 用 這 種 統計 模式 評估 了 35 個 主觀 幸福感 測量 , 發現 較 好 的 量表 構念 效度 估計值 在 .7 到 .8 之間 。 ( 也就是說 , 一 個 量表 總體 變異 的 一半 到 三分之二 反映 了 要 測量 的 概念 ) 。 「 較 好 」 的 測驗 包括 本 章 前面 提到 的 幾 個 量表 , 七 點 的 「 欣喜 - 敗壞 」 評尺 。 Campbell __UNDEF__ 等 ( 1976) 採用 的 「 七 點 滿足感 評尺 」 ( __UNDEF__ Satis faction Scale ) 、 臉形 評尺 以及 梯形 評尺 。 這些 效度 結果 與 大量 其它 出現 於 調查 研究 中 的 測量 ( survey-based measures ) 的 效度 估計值 相 吻合 , 它們 的 效度值 中數 約為 .7 ( Andrews __UNDEF__ , 1984 ) 。 ( 2) 信度 -- 信度 是 指 測量 同 一 概念 的 兩 個 或 兩 個 以上 的 工具 彼此 一致 的 程度 。 信度 是 測驗 的 質量 指標 。 通常 認為 如果 測量 同 一 概念 的 兩 個 工具 彼此 相關 很 高 , 是 因為 兩 個 量表 都 足夠 可靠 地 反映 了 所 要 測量 的 概念 。 雖然 , 通常 情況 下 這 個 想法 是 對 的 , 但 量表 間 的 一致 也 可能 是 由於 它們 同時 反映 了 另 一 個 並非 所 要 測量 的 概念 ( 亦即 , 來自 有 相關 的 誤差 ) 。 在 這 種 情況 下 , 信度 可能 高 , 但 效度 卻 低 。 在 評價 主觀 幸福感 測量 時 常 用 的 兩 種 信度 指標 是 : 同 質 信度 和 穩定 信度 。 同質 信度 是 指 兩 個 或 兩 個
|