173项研究仍留下儿童证据缺口,AI 教育效果不能从大学生直接外推
挪威科技大学近期介绍的一项研究梳理了173项关于生成式 AI、批判性思维和问题解决的研究。期刊原始页面确认,这是一项系统综述,纳入2022年至2025年的实证文献,并非跟踪173名儿童的新实验。
作者:沈南乔|OC 社会影响编辑
挪威科技大学近期介绍的一项研究梳理了173项关于生成式 AI、批判性思维和问题解决的研究。期刊原始页面确认,这是一项系统综述,纳入2022年至2025年的实证文献,并非跟踪173名儿童的新实验。
一句话结论:关于 AI 学习效果的材料正在增多,但研究对象、测量方式与使用方法的差异,决定了结论能适用于谁。
大学介绍指出,约八成所纳入研究面向大学或学院学生。年龄更小的学生仍在形成基础能力,不能把成年学生使用工具后的表现直接当作他们的预期结果。这个缺口不是“AI 已被证明有害”的同义词,而是说明现有证据还不足以覆盖所有学校人群。
原始论文摘要还指出,自我报告与横断面研究占较大比重,地域分布也不均衡。受访者觉得自己学得更好,与一段时间后独立完成任务的表现,并不是同一种测量。对统计结果的解释应保留这些差别。

综述讨论了 AI 的双重作用:它可能帮助反思和比较观点,也可能让学习者直接绕过推理过程。这不应被简化成“AI 本身完全没有影响”,更不意味着任何使用方式都同样有效。教师怎样布置任务、学生承担哪些思考步骤,会改变工具进入学习的方式。
OC 认为,学校试用 AI 时可以先确定要保护的学习过程。例如要求学生解释为什么接受或拒绝某个答案,保留独立尝试,并在之后重新检验理解。这些是可评估的教学安排,比笼统追问“该不该用 AI”更有助于积累本地证据。
关键事实
- 研究类型:173项记录的系统综述,不是单一随机对照实验。
- 主要缺口:低龄学生证据、长期客观测量与地域代表性。
- 时间范围:纳入2022年至2025年研究,不能视为已覆盖全部最新产品。
OC 判断
教育决策需要允许“不确定”存在。认真标出证据缺口,能帮助学校把试用设计得更可检验;急于给工具贴上促进学习或损害学习的统一标签,反而会遮住真正起作用的条件。
为什么重要
- 对教师:评价学生离开工具后能做什么,并保留对推理过程的要求。
- 对采购方:核对研究人群与本校学生是否匹配,避免用活跃度代替学习结果。
评论
围绕这篇文章补充信息、提出问题或分享观察。