測驗等化
外表
等化,粵拼:dang2 faa3,係教育上講到嘅一種統計程序,用嚟判定同一個考試或測驗嘅唔同版本之間,啲分數要點樣先至算對等。搵等值嘅過程,可以係單靠實際得分,但亦可以用到題目反應理論[1]。
基本概念
[編輯]睇埋:出貓
想像依家有兩個人,阿明同阿珍,佢哋都要去考某執業試,目的係想得到做牙醫嘅專業資格。呢個考試一合格就可以執業,所以應考者有誘因作弊。於是監管考試嘅機構決定出兩份唔同嘅題目,考緊嘅係相同嘅內容,畀應考者做,用意係令到作弊嘅難度提高。
設阿明做卷一而阿珍則做卷二,兩份卷都係 100 分做滿分,最後結果係阿明攞 60 分而阿珍攞 70 分。係咪可以百分百肯定,阿珍對牙醫嘅專業知識掌握得好過阿明?一般認為係唔可以,因為有一種可能性,係卷一難過卷二。因此,監考機構唔可以直接比較兩者嘅分數,要做測驗等化嘅工作:佢哋要透過統計學方法,將唔同版本嘅卷嘅分數對齊,對落去某個標準尺度上,確保得出嘅分數盡可能公平。[2]
簡單做法
[編輯]睇埋:常態分佈
平均數等化[註 1]純粹係調整分數嘅頻率分佈,將組嘅分數整體上移或者下移,等其中一個卷本嘅平均分數可以同另一個卷本嘅平均數對齊,互相比較。好多人都中意用平均數等值,因為夠簡單,但呢種方法被指係缺乏彈性—特別係佢無法考慮到唔同卷本之間喺分數嘅標準差上可能存在差異[1]。
如果兩份卷之間未至於完全唔同,某啲題目係兩份卷都有嘅,噉分析者可以觀察兩組之間喺嗰啲共同題目上有冇差異,例如卷一組喺共同題目上攞 30 分,而卷二組喺呢啲題目上則攞到 32 分,噉就有證據顯示卷二組能力真係稍高[2]。呢啲共同嘅題目就係所謂嘅定錨題目[註 2]。
統計模型
[編輯]呢節要加長。 |
睇埋:題目反應理論
睇埋
[編輯]註釋
[編輯]引述
[編輯]- 1 2 Kolen, M.J.; Brennan, R.L. (1995). Test Equating. New York: Spring. doi:10.1007/978-1-4757-2412-7. ISBN 978-0-387-94486-9.
- 1 2 Test Score Equating and Linking