HyperAIHyperAI

Command Palette

Search for a command to run...

AI应试能力显著提升,高校考核模式待升级

近期,伍伦贡大学研究团队针对生成式人工智能在法学考试中的表现展开新评估,结果显示模型能力实现显著跃升。研究人员选取九款主流大语言模型,在未提供专属教材仅依靠联网推理的情况下,完成刑法与侵权法期末考试。对比二零二三年的基线测试,AI平均分大幅攀升,刑法成绩平均达百分之七十六点三,超越八成以上在校生;侵权法平均百分之六十六,同样超过多数学生。值得注意的是,此前AI在复杂法律场景推理中的短板已基本弥合。尽管整体表现优异,但模型能力仍呈不均衡分布,部分文本存在引用错误与事实幻觉,尚不具备独立担任专业法律专家的水平。该结果警示,缺乏监督的考核形式已难以保障学术诚信。为此,学者提出高校应对新范式:首先保留线下监考考试以夯实独立推理基础;其次将AI协作过程纳入评分,重点考察提示工程、错误排查与逻辑修正能力;最后推行接力式考核,通过人工初稿与AI辅助的双向流程,全面检验学生的独立知识储备与AI监督素养。该研究为高等教育在生成式AI时代的考核改革提供了实证依据与实践路径。

相关链接