OpenAI 发布学习成效测量工具,把评估重点转向推理和掌握度
工具用于测量推理、批判思考和知识掌握,并配合 Study Mode 研究与随机试验。
OpenAI 于 3 月 4 日公布一套学习成效测量工具,同时披露 Study Mode 的早期研究,并计划通过随机试验继续验证。
评估对象从使用量、满意度和答题结果转向推理过程、批判思考与知识掌握,为教育 AI 建立更接近学习目标的指标。
后续重点看测量工具是否公开、试验设计和样本、独立复现,以及结果是否影响产品默认交互。
来源OpenAI 官方研究 ↗公开资料整理,事实边界以原始页面为准。