|
1985 ; Gibbs & Norwich __UNDEF__ ,1985 ) 。 這些 因素 中 沒有 一 個 與 自尊 有 直接 關係 。 整 個 量表 與 Rosenberg __UNDEF__ 的 SES 相關 為 .55 , 與 Janis-Field 的 FIS 的 相關 為 .72 , 與 Tennessee __UNDEF__ 自我 概念 量表 的 相關 為 .77 ( Demo __UNDEF__ , 1985 ; Van Tuinen & Ramanaiah __UNDEF__ , 1979 ) 。 Texas 社交 行為 調查 量表 ( TSBI ; __UNDEF__ Helmreich __UNDEF__ , Stapp __UNDEF__ & Ervin __UNDEF__ , 1974 ) 是 想 根據 人際 交往 來 評鑑 自我 價值感 。 人際 交往 主要 包括 以下 四 方面 : 社交 信心 、 支配慾 、 社交 能力 和 與 權威 人物 的 關係 。 儘管 它 不 像 其它 測驗 那樣 是 對 自尊 的 整體 測量 , 但是 , 一般 來 講 「 社交 」 自尊 很 可能 是 整體 自尊 的 一 個 重要 決定 因素 。 TSBI 的 一 個 顯著 優點 是 , 它 有 兩 套 均 包括 16 個 測題 的 相配 測驗 ( __UNDEF__ Helmreich __UNDEF__ & Stapp __UNDEF__ , 1974 ) , 兩 者 與 原始 包括 32 個 測題 的 測驗 , 以及 其 簡本 之間 均 有 較 高 的 相關 , 相關 係數 分別 為 .97 和 .87 。 因而 兩 套 測驗 可以 分別 施測 ( 如 : 用於 一 測 和 再 測 , 或 用於 前 測 和 後 測 ) 來 作 效度 檢驗 , 由於 它 不 是 同 一 測題 施測 兩 次 , 所以 無須 擔心 敏感化 效應 ( sensitization effect __UNDEF__ ) 。 Ziller __UNDEF__ 、 __UNDEF__ Hagey __UNDEF__ 、 Smith __UNDEF__ 與 __UNDEF__ Long __UNDEF__ ( 1969) 的 社交 自尊 ( SSE ) 也 是 基於 自我 價值 在 人際 情境 中 具有 無以倫比 的 重要性 這 一 假設 而 編製 的 。 SSE 採用 幾何 圖形 的 格式 , 在 此 格式 裡 , 受測 者 將 自己 及 他人 依 兩 者 的 相對 關係 擺放 其中 。 從而 來 確定 自尊 的 水平 ( 見 下面 量表 描述 部分 ) 。 由於 此 一 量表 在 確定 代表 自我 或 他人 的 位置 時 , 是 受 無 意識 過程 支配 的 , 因而 其 對 自尊 的 評鑑 可以 比較 不 受 社會 期許 效應 或 作答 偏差 效應 的 影響 。 但是 , 當 用 Likert __UNDEF__ 式 ( 要求 受測 者 在 一 量尺 上 表 答 同意 或 不 同意 一 個 測題 的 程度 ) 來 作答 時 , 卻 出現 了 八 個 因素 。 因此 , 即使 是 基於 題 間 相關 顯著性 來 建構 的 量表 , 也 不能 保證 一定 會 得到 單維 的 量表 。 不過 , 至少 用 這 個 方法 , 量表 編製 者 可以 把 他們 自製 的 一 盤 水果 雜碎 中 的 蘋果 、 橘子 及 香蕉 分開來 。 最後 要 提醒 大家 : 我們 只要 將 同 一 測題 以 各 種 不同 的 說法 寫出來 , 就 可以 得到 很 高 的 內部 一致性 。 顯然 地 , 像 這樣 的 一 個 量表 只 測量 了 一 個 極端 狹窄 的 方面 。 因此 , 對 內部 一致性 的 分析 結果 也 不要 盲目 信從 , 對 一 個 量表 的 評鑑 還 必須 要 靠 綜合 多 方面 的 資料 才 行 。 內部 一致性 分析 誠然 是 一 個 很 好 的 評標 , 但 它 仍 須 與 概念 的 涵蓋 程度 、 適當 的 常模 及 嚴謹 的 效度 考驗 相 配合 , 才 能 發揮 其 作用 。 5 .
眾知 群體 的 效度 ( known groups validity __UNDEF__ ) 對於 一 個 量表 的 價值 而言 , 效度 是 一 個 更為 關鍵 的 指標 。 雖然 如此 , 在 考驗 效度 時 , 一 個 量表 是否 有 區辨 不同 群體 的 能力 往往 並 不一定 是 考驗 的 主要 重點 及 難點 。 例如 , 要 編製 一 個 「 自由 主義 / 保守 主義 」 量表 使 之 能 分辨 美國 保守 的 The Heritage __UNDEF__ Foundation __UNDEF__ 成員 與 開放 的 American Civil Liberties Union __UNDEF__ 成員 之 不同 並 不 是 太 難 。 同樣地 , 要 編製 一 個 宗教 態度 量表 , 使 之 能 區辨 摩門教徒 、 猶太教徒 、 或是 神學院 學生 等 與 工程師 的 不同 也 很 容易 。 這 主要 因為 這些 群體 的 思想 態度 是 眾所周知 地 差別 很 大 。 通常 我們 稱 這 類 群體 為 「 周知 樣本 」 , 而 用 周知 樣本 所 作 的 效度 考驗 是 最 起碼 的 效度 考驗 。 比較 難 達到 的 效度 標準 是 要求 一 個 量表 的 得分 能 在 異質性 高 的 樣本 內 , 很 可靠 地 分辨出 快樂 及 不 快樂 、 開放 及 保守 、 反 宗教 與 信教 的 人 , 或者 預測 那些 人 會 表現 與 態度 一致 或 不 一致 的 行為 。 6 .
聚歛 效度 ( convergent validity __UNDEF__ ) 它 是 指 依 理論 作 預測 的 效度 考驗 。 更 常見 的 一 種 效度 考驗 就 是 探測 量表 結果 是否 與 研究 者 的 理論 預測 一致 的 聚歛 效度 , 又 稱 建構 效度 ( construct validity ) 。 例如 , 某 研究者 依據 一些 理論 預測 或 預期 較 年長 及 教育 程度 較 好 的 人 , 或 功課 較 好 的 學生 在 他 的 量表 上 得分 應該 較 高 , 而 結果 確實 如此 。 研究者 也 可能 預期 量表 得分 較 高 者 會 表現出 某 種 行為 ( 例如 , 會 加入 某 種 團體 或 會 捐贈 金錢 ) , 或 表現出 某 種 特別 的 態度 。 聚歛 效度 考驗 就 是 去 看看 這些 預測 是否 真 會 出現 。 這 種 聚歛 或 建構 效度 考驗 的 說服力 當然 會 有賴 研究 者 理論 本身 的 全面性 及 合理性 , 以及 其 與 外在 因素 ( 根據 理論 推測 出來 ) 的 相關 的 大小 。 更 正式 的 考驗 建構 效度 的 方法 則 是 透過 設立 因果 模型 ( causal modeling __UNDEF__ ) 來 做 分析 ( 例如 Andrews __UNDEF__ , 1984 ) 。 7 .
交叉 效度 考驗 ( cross-validiation __UNDEF__ ) 考驗 交叉 效度 需要 兩 個 不同 的 獨立 樣本 , 及 對 考驗 樣本 所 訂下 的 一些 效標 的 測量 。 這 種 考驗 要 回答 的 問題 是 , 如果 在 A 樣本 中 發現 某 一些 測題 得分 之 組合 與 效標 的 相關 最 大 , 那麼 , 在 B 樣本 中 是否 這 種 關係 也 同樣 會 出現 。 同樣地 , 在 B 樣本 中 最 有效度 的 測題 組合 , 在 A 樣本 中 是否 也 會 出現 。 請 注意 這 個 考驗 程序 的 關鍵 在於 , 首先 在 A 樣本 中 找出 與 效標 相關 最 大 的 測題 組合 , 然後 再 獨立 地 用 B 樣本 去 考驗 這 個 組合 是否 同樣 地 與 效標 有 高 相關 。 8 .
區辨 效度 考驗 ( discriminant validation __UNDEF__ ) 更為 精密 也 更為 有力 的 方法 來 做 效度 考驗 是 用 Campbell 與 Fiske __UNDEF__ (1959) 所 提出 的 「 多 特質 - 多 方法 矩陣 」 ( multitrait-multimethod matrix ) 。 這 個 方法 需要 對 所 要 測量 的 數 個 概念 ( 例如 x , y , z ) 中 的 每 一 個 都 用 幾 種 不同 的 方法 做 測量 , 方法 越 多 越 好 。 同時 最好 也 包括 像 對 智力 及 作答 定式 等 控制 變量 的 測量 。 因為 這些 變量 也 同樣 地 可能 用來 解釋 區辨 分析 中 所 得到 的 結果 。 在 最後 所 形成 的 相關 矩陣 中 , 用以 測量 同 一 個 概念 ( 例如 x ) 所 作 的 不同 測量 得分 , 彼此 之間 首先 必須 具有 高 的 相關 。 其次 , 這些 相關 必須 要 高於 它們 與 用以 測量 其他 概念 ( 例如 y , z ) 的 各 種 指標 的 相關 , 也 要 高於 與 任何 控制 變量 的 相關 。 這樣 的 結果 可以 顯示 用於 測量 同 一 概念 的 這些 方法 可以 與 用以 測量 其他 不同 概念 的 工具 區分開來 。 無庸置言 , 這 只是 對 Campbell __UNDEF__ 與 Fiske __UNDEF__ 評標 的 粗略 介紹 , 有 興趣 的 讀者 可以 嘗試 在 做 比較 分析 前 , 去 找 原 作者 的 論文 來 閱讀 一下 。 在 Campbell __UNDEF__ 與 Fiske __UNDEF__ 撰寫 該 論文 時 , 他們 發現 只有 少數 性格 量表 具備 符合 他們 分析 之 所 需 資料 。 最近 新 發展出來 的 , 比較 符合 他們 的 條件 的 一 個 態度 量表 是 Andrews __UNDEF__ 與 Crandall __UNDEF__ ( 1976) 的 生活 品質 量表 。 在 我們 早 一 版本 的 幾 個 章 裡 , 我們 曾 因 包括 了 相當 多 的 量表 , 以致 有 必要 將 它們 做 比較 分析 。 我們 當時 曾 依 類似 在 本 章 中 所 列 的 評標 , 對 那些 量表 進行 一 次 級別 評定 。 當時 所 用 的 級別 種類 及 評定 之 標準 等 資料 經過 一 番 修改 後 分別 列 於 表 一 。 讀者 可以 考慮 利用 此 表 所 列 的 這 個 分級 體系 來 評鑑 他們 所 欲 使用 的 測量 工具 。 讀者 也 請 參考 美國 心理 學會 ( American Psychological Association __UNDEF__ , 1985 ) 、 Heise __UNDEF__ 與 Bohrnstedt
|