Eduentry如何工作

与PISA、GCSE和SAT使用相同科学体系的自适应评估——确保结果直接可与国际标准对标。

自适应测试:核心原理

传统测试对所有学生使用相同的题目。自适应测试会根据每位学生的表现实时调整题目选择——答对则下一题更难,答错则下一题更容易。

这使评估更高效(相同精度所需题目更少)也更准确(通过消除地板效应和天花板效应),同时对学生更公平(因为他们始终面对匹配其实际水平的题目)。

两参数逻辑模型(2PL IRT)

Eduentry使用两参数逻辑模型(2PL),这是项目反应理论(IRT)的一种形式——与PISA、GCSE和SAT使用的模型相同。

难度参数(b)

反映题目难易程度的校准值。难度高的题目可以更好地区分高能力学生;难度低的题目对评估低能力学生更有价值。

区分度参数(a)

反映题目在区分不同能力水平学生方面有效性的校准值。区分度高的题目能精确指出学生能力的分界点。

Fisher信息量

系统使用Fisher信息量选择下一道题——即在当前能力估计附近提供最大信息量的题目,从而使每次作答都最大化测量精度。

能力估计更新

每次作答后,系统更新学生的能力(θ)估计。评估越深入,估计越精确——这就是为什么完成更多题目能得到更可靠的分数。

标准化量表

Eduentry使用均值100、标准差15的标准化量表——与PISA相同的量表。这意味着:

70–84
需要帮助
85–94
低于平均
95–109
平均水平
110–119
高于平均
120–130
卓越表现

68%的学生分数在85至115之间。这一量表直接可与PISA分数、英国CAT4和大多数专业认知评估进行比较。

国际基准对标

Eduentry分数对标四个主要国际框架:

  • 英国国家课程分数对应关键阶段2、3和4的预期年级水平。
  • PISA能力等级分数对应PISA六级能力框架,直接可与OECD基准对标。
  • 美国年级水平分数对应美国常见核心标准和年级水平预期。
  • IB课程分数对应国际文凭课程的知识和技能预期。

准备开始评估了吗?

免费 · 60分钟 · 国际对标

开始免费评估 →