Skip to article frontmatterSkip to article content
Site not loading correctly?

This may be due to an incorrect BASE_URL configuration. See the MyST Documentation for reference.

正規累積モデル

正規累積モデル(normal ogive model) は基本的なIRTの考え方を示すモデル。正規累積モデルは概念上のわかり易さがある一方で、計算量の問題もあり、伝統的にはロジスティック・シグモイド関数により近似したロジスティックモデルが活用されてきた。そのため実際のところ最も基本的なIRTモデルはロジスティックモデルだが、そのベースになるのが正規累積モデル。

モデルの考え方

ii番目の被験者のjj番目の項目の値yijy_{ij}が二値yij∈{0,1}y_{ij}\in\{0, 1\}であるとする(例えば正解・不正解だったり、アンケートの「あてはまる」「あてはまらない」という2件法など)。

yijy_{ij}の背後には潜在的な能力の連続量θi∈R\theta_i \in \mathbb{R}が存在し、θi\theta_iが閾値bjb_jを超えていたら1、超えていなければ0が観測されるとする。つまりyijy_{ij}が以下のように決まるとする。

yij={0 if θi<bj1 if θi≥bjy_{ij} = \begin{cases} 0 & \text{ if } \theta_i < b_j\\ 1 & \text{ if } \theta_i \geq b_j\\ \end{cases}

しかし、実際には被験者iiの体調や運(たまたま正解できた)などにより、常にこのようにきれいに正解・不正解が決まるわけではないと考えられる。こうした誤差を表すパラメータεij∼N(0,σε2)\varepsilon_{ij} \sim N(0, \sigma^2_{\varepsilon})も追加して

yij={0 if (θi−εij)<bj1 if (θi−εij)≥bjy_{ij} = \begin{cases} 0 & \text{ if } (\theta_i - \varepsilon_{ij}) < b_j\\ 1 & \text{ if } (\theta_i - \varepsilon_{ij}) \geq b_j\\ \end{cases}

とする。誤差が確率変数のため、yijy_{ij}のとる値も確率変数として考えることができるようになる。bjb_jを移項すると

yij={0 if (θi−εij−bj)<01 if (θi−εij−bj)≥0y_{ij} = \begin{cases} 0 & \text{ if } (\theta_i - \varepsilon_{ij} - b_j) < 0\\ 1 & \text{ if } (\theta_i - \varepsilon_{ij} - b_j) \geq 0\\ \end{cases}

となる。θi−εij−bj∼N(θi−bj,σε2)\theta_i - \varepsilon_{ij} - b_j \sim N(\theta_i - b_j, \sigma^2_{\varepsilon})である。 εij\varepsilon_{ij}を移項すれば

yij={0 if (θi−bj)<εij1 if (θi−bj)≥εijy_{ij} = \begin{cases} 0 & \text{ if } (\theta_i - b_j) < \varepsilon_{ij}\\ 1 & \text{ if } (\theta_i - b_j) \geq \varepsilon_{ij}\\ \end{cases}

でもあるので「yij=1y_{ij}=1となるのは誤差εij\varepsilon_{ij}がθi−bj\theta_i - b_j以下のとき」とわかる。

Source
<Figure size 400x200 with 1 Axes>

1パラメータ正規累積モデル

仮にεij\varepsilon_{ij}が標準正規分布(σε2=1\sigma^2_{\varepsilon} = 1の正規分布)に従うならば、特性値θi\theta_iの人が項目jjに当てはまると回答する確率は

P(yij=1)=P(εij≤θi−bj)=∫−∞(θi−bj)12πexp⁡(−z22)dz\begin{aligned} P(y_{ij} = 1) &= P(\varepsilon_{ij} \leq \theta_i - b_j)\\ &= \int_{-\infty}^{\left(\theta_i-b_j\right)} \frac{1}{\sqrt{2 \pi}} \exp \left(-\frac{z^2}{2}\right) d z \end{aligned}

となる(最後のは、εij\varepsilon_{ij}が従う標準正規分布のうち −∞-\infty から θi−bj\theta_i-b_j までの範囲の面積がP(εij≤θi−bj)P(\varepsilon_{ij} \leq \theta_i - b_j)ということ)。

Source
<Figure size 400x200 with 1 Axes>

2パラメータ正規累積モデル

σε2\sigma^2_{\varepsilon}が項目ごとに異なる場合を考える。σε2=1/aj\sigma^2_{\varepsilon}=1/a_jとすると、誤差の確率分布は

εij∼N(0,1aj)\varepsilon_{ij} \sim N\left(0, \frac{1}{a_j}\right)

となる。両辺をaja_j倍すると、ajεij∼N(0,1)a_j \varepsilon_{ij} \sim N(0, 1)と表すことができ、引き続き標準正規分布を使うことができる。そのためモデルはaia_iが追加され

P(yij=1)=P(ajεij≤θi−bj)=∫−∞aj(θi−bj)12πexp⁡(−z22)dz\begin{aligned} P(y_{ij} = 1) &= P(a_j \varepsilon_{ij} \leq \theta_i - b_j)\\ &= \int_{-\infty}^{ a_j (\theta_i-b_j)} \frac{1}{\sqrt{2 \pi}} \exp \left(-\frac{z^2}{2}\right) d z \end{aligned}

となる。

Source
<Figure size 800x200 with 2 Axes>

なお横軸にθi\theta_i、縦軸にP(yij=1)P(y_{ij}=1)をとったグラフは 項目特性曲線 (item characteristic curve: ICC) と呼ばれる。

因子分析との関係