Eduentry如何工作
与PISA、GCSE和SAT使用相同科学体系的自适应评估——确保结果直接可与国际标准对标。
自适应测试:核心原理
传统测试对所有学生使用相同的题目。自适应测试会根据每位学生的表现实时调整题目选择——答对则下一题更难,答错则下一题更容易。
这使评估更高效(相同精度所需题目更少)也更准确(通过消除地板效应和天花板效应),同时对学生更公平(因为他们始终面对匹配其实际水平的题目)。
两参数逻辑模型(2PL IRT)
Eduentry使用两参数逻辑模型(2PL),这是项目反应理论(IRT)的一种形式——与PISA、GCSE和SAT使用的模型相同。
难度参数(b)
反映题目难易程度的校准值。难度高的题目可以更好地区分高能力学生;难度低的题目对评估低能力学生更有价值。
区分度参数(a)
反映题目在区分不同能力水平学生方面有效性的校准值。区分度高的题目能精确指出学生能力的分界点。
Fisher信息量
系统使用Fisher信息量选择下一道题——即在当前能力估计附近提供最大信息量的题目,从而使每次作答都最大化测量精度。
能力估计更新
每次作答后,系统更新学生的能力(θ)估计。评估越深入,估计越精确——这就是为什么完成更多题目能得到更可靠的分数。
标准化量表
Eduentry使用均值100、标准差15的标准化量表——与PISA相同的量表。这意味着:
70–84
需要帮助
85–94
低于平均
95–109
平均水平
110–119
高于平均
120–130
卓越表现
68%的学生分数在85至115之间。这一量表直接可与PISA分数、英国CAT4和大多数专业认知评估进行比较。
国际基准对标
Eduentry分数对标四个主要国际框架:
- 英国国家课程:分数对应关键阶段2、3和4的预期年级水平。
- PISA能力等级:分数对应PISA六级能力框架,直接可与OECD基准对标。
- 美国年级水平:分数对应美国常见核心标准和年级水平预期。
- IB课程:分数对应国际文凭课程的知识和技能预期。
准备开始评估了吗?
免费 · 60分钟 · 国际对标