信度(reliability):
- 定義-重複測量一穩定特質時,所得結果之一致程度(level of agreement)與穩定性(stability)。信度越高,表示其結果越不受評估情境或評估人員的改變而影響(隨機評估誤差(random measurement error)越小),使得每次施測都能產生相似的結果。
- 分類-
項目
|
定義
|
統計指標
|
判讀標準
|
再測信度(test-retest reliability)
|
同一種測驗在兩個不同時間點重複評估受測者(特質不變),其前後測驗結果的一致程度。
|
組內相關Intra-Class Correlation(ICC)
Cohen’s
Kappa/Weighted Kappa
|
ICC:>0.7:良;0.9-0.95:優
Cohen’s Kappa:0.61-0.81:良;0.81-1.00:優
|
施測者間信度(inter-rater reliability)
|
兩個或兩個以上的施測者在同一時間對同一受測者評估結果的一致程度。
|
||
內部一致性(internal consistency)
|
檢定一個量表中,測驗項目間的相關性及整體量表的相關性,用以了解項目的同質性。
|
Cronbach’s
α
Kuder-Richardson statistic
|
>0.7:良;>0.9:優
|
效度(validity):
- 定義-評估工具真正測量到欲評估特質或建構的程度。效度越高,表示越能正確測量出欲評估的特質。
- 分類-
項目
|
定義
|
統計指標
|
判讀標準
| |
內容效度(content validity)
|
評估工具內容的適當性-
*欲評估的特質及理論建構是否包含在測驗項目中。
*項目分配是否適當。
|
相關專家主觀判定
|
80%的專家同意內容的適當性
| |
效標關聯效度(criterion-related validity)
|
評估工具與效標的相關程度。
*效標-公認可測量出欲評估特質的評估工具。
|
相關係數(correlation coefficient)-
Pearson’s γ /Spearman’s ρ
|
≧0.75:良
0.40-0.74:中等
≦0.4:差
| |
同時效度(concurrent validity)
|
同時施測欲驗證的評估工具與公認的黃金效標,判斷兩者的相關程度。
| |||
預測效度(predictive validity)
|
測驗結果與未來相關特質(外在校標)間的關連程度=欲驗證的評估工具與之後評估的外在效標,兩者相關程度。
| |||
建構效度(construct validity)
|
能測量到理論上的概念、結構或特質的程度。
*建構-抽象而屬假設性的概念,難以直接觀察獲得。
|
因素分析(Factor analysis)
相關係數(correlation coefficient)
| ≧0.75:良
0.40-0.74:中等
≦0.4:差
| |
收斂效度(convergent validity)
|
欲評估的特質與理論上相關特質之關連程度=施測欲驗證的評估工具以及相關特質的評估工具,以了解兩者間相關程度。
| |||
*內容效度通常以描述的方式來說明(http://www.doc88.com/p-63043480084.html):
REFERENCE
- 範例一:本研究問卷係以理論為基礎,參考多數學者的問卷內容及衡量項目,並針對研究對象的特性加以修改,並經由相關專業人員與學者對其內容審慎檢視,繼而進行預試及修正,因此本研究所使用之衡量工具應能符合內容效度的要求。
- 範例二:在內容效度方面,主要是根據文獻探討及專家研究者的經驗。然因本研究問卷設計之初,考量目前相關的文獻中,尚未對本研究議題提出實證性問卷,故只能自行設計量表,對於內容效度是否達成,尚有疑慮。
- 範例三:本研究之各研究變項皆經先前學者之實證,衡量工具內容均能足夠地涵蓋欲探討的研究主題。另外,本研究於正式施測前,亦針對問卷之各題項與相關領域的學者、專家進行內容適切度之討論,因此,研究採用之衡量工具應具內容效度。
*建構效度驗證方法多樣,如無法理解內容,則可記錄有疑問處,之後再行討論。
信度和效度間的關係:
REFERENCE
薛漪平(2011)。生理疾病職能治療學I.評估理論與技巧。台北市:禾楓。
姚開屏(民85)。從心理計量的觀點看測量工具的發展。職能治療學會雜誌,14(1)。

沒有留言:
張貼留言