返回
摘要
En 中文
kappa统计量经常用于测试评分者之间的可靠性。评分者可靠性的重要性在于,它代表了研究中收集的数据在多大程度上是所测量变量的正确表示。衡量数据收集者 (评分者) 对同一变量分配相同分数的程度称为评分者间可靠性。虽然有多种方法可以衡量评分者之间的可靠性,但传统上它是用一致性百分比来衡量的,计算方法是一致性分数除以总分。在1960,Jacob Cohen批评了百分比协议的使用,因为它无法解释机会协议。他介绍了Cohen's kappa,它的开发是为了解释评分者实际上由于不确定性而猜测至少一些变量的可能性。像大多数相关统计一样,kappa的范围可以从-1到1。虽然kappa是测试评分者间可靠性最常用的统计数据之一,但它有局限性。对健康研究应接受的kappa水平的判断提出了质疑。科恩建议的解释对于健康相关的研究可能过于宽松,因为它意味着低至0.41的分数可能是可以接受的。比较Kappa和百分比一致性,并建议在医疗保健研究中要求的kappa和百分比一致性水平。
Keyword:
kappa
reliability
rater
interrater

