2026年8月24日,卡迪夫大学与墨尔本大学联合研究发现,当前生成式AI尚无法可靠替代人类教师批改本科生书面作业。研究人员用ChatGPT两版本对50篇生物科学论文按7项标准评分,并测试4种提示方式,结果AI与人工评分平均分最大偏差达16.1分,单篇最高偏差达40分。AI呈现分数向中间集中的系统性偏差,且未经学生同意使用其作业涉及伦理风险。研究指出,现阶段AI不宜用于正式学业评分。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。
2026年8月24日,卡迪夫大学与墨尔本大学联合研究发现,当前生成式AI尚无法可靠替代人类教师批改本科生书面作业。研究人员用ChatGPT两版本对50篇生物科学论文按7项标准评分,并测试4种提示方式,结果AI与人工评分平均分最大偏差达16.1分,单篇最高偏差达40分。AI呈现分数向中间集中的系统性偏差,且未经学生同意使用其作业涉及伦理风险。研究指出,现阶段AI不宜用于正式学业评分。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。