Please enable JavaScript.
Coggle requires JavaScript to display documents.
第十二章 試題反應理論(IRT) - Coggle Diagram
第十二章 試題反應理論(IRT)
與古典測驗理論的比較
模式特性
針對單一試題的作答反應的數學模式
考量受測者能力與試題特性對答題率的影響
以試題為基礎
直接描述作答行為的模式
測量精準度
以訊息量表示
訊息量I=測量誤差平方開根號的倒數
測量誤差越低,對此人的測量就越精準,訊息量就越高
相同題目不同受測者的訊息量不同
能力與分數量尺特性
IRT的能力(程度)值是根據IRT模式與概似函數所估計出來的>>與試題難易度是共用一個量尺>>能力高低可以直接參照題目難易度、描述句來解釋
Rasch(單參數)模式>>能力值具有等距量尺的特性,單位距離相同
受測者能力的估計不會被試題特性影響
應用與整體評估
適性測驗>>IRT的單向度假定與受測者能力估計的不變性,讓接受不同測試的人可以比較能力,所以可以讓大家依照自己的能力接受測試
發展題庫>>試題參數不受受測者能力影響
能力值等化>>能力值不受試題參數影響
根據測驗目的選擇測驗題目,不用被測驗或量表編製侷限
IRT理論架構嚴謹、應用層面廣泛>>以後會越來越普及
試題參數特性
試題參數:難易度、鑑別度、猜對率......
IRT中題目參數的估計不會被受測者的能力影響
受測者是否具有代表性不重要,只要人數夠多(單參數200up;三參數1000up),讓能力、程度值不過度集中,就可估計穩定的試題參數
發展與應用
發展電腦化適性測驗
根據受測者的答題反應立刻選出符合其程度的題目給受測者
組合測驗
根據測驗目標或受測者的程度決定
建立題庫
將題目、試題特性、試題參數建立在同個資料庫
測驗連結或等化
把接受不同測驗的人,得到的程度值放在同個量尺上比較
編製測驗(量表)
根據兩藥發展的測驗類型與評分方式選擇適合的IRT
在測驗分析的功能
估計受測者的年在特質(能力)
篩選or修改試題
了解試題對不同程度特質(能力)者的誤差
了解試題特徵
發展測驗的量尺(等距量尺or測驗後考量誤差,將受測者能力轉換成相對的量尺分數)
基本概念
不是單一模式,是許多模式的統稱
用來描述受測者的能力(or能力特質)、試題特性(難度、鑑別度、猜測度)與作答反應的數學模式
分類
試題參數個數
單參數的Rasch模式(能力與難易度)
二參數模式(難易度、鑑別度)
三參數模式(難易度、鑑別度、猜測度)
計分型態
二元計分
多元計分
作答方式
評定量尺模式(rating scale)
部分計分模式(partial credit)
名義量尺(nominal scale)
常見的IRT模式
二元計分模式
Rasch模式
每題的鑑別度都是1.0;猜對率併入能力因此為0:試題要求
題目難易度+能力,就可以算出答對機率
試題的特徵曲線:單調遞增
二參數模式
與實際資料的分析結果較為接近<<題目允許有不同鑑別度
難易度+鑑別度+能力去算答對機率
三參數模式
針對可以被猜對的題目(選擇、是非)
難易度+鑑別度+猜對率+能力去算答對機率
比二參數更符合實際作答
所得到的能力值接近實際能力水準
只有答對跟答錯,依試題參數個數分為:
多元計分模式
答題結果不只一種(計算、簡答、申論、李克特量表
部分計分模式
評定量尺模式
李克特量表<<適用在量表中所有的題目都有相同的計分方式
基本假設
單向度
所有題目主要都測量相同的某一特質
局部獨立性
相同能力水準的受測者在各個題目上的答對機率是互相獨立