大模型批改高考满分作文,结果是什么?

四季读书网 6 0
大模型批改高考满分作文,结果是什么?
大模型批改高考满分作文,结果是什么?-第1张图片-四季读书网
大模型批改高考满分作文,结果是什么?-第2张图片-四季读书网
大模型批改高考满分作文,结果是什么?-第3张图片-四季读书网
大模型批改高考满分作文,结果是什么?-第4张图片-四季读书网
大模型批改高考满分作文,结果是什么?-第5张图片-四季读书网
大模型批改高考满分作文,结果是什么?-第6张图片-四季读书网
大模型批改高考满分作文,结果是什么?-第7张图片-四季读书网
大模型批改高考满分作文,结果是什么?
高考作文满分60分,阅卷场里,一篇作文至少经过两位老师“背对背”打分,分差过大,还要三评、仲裁——人,是这场考试最谨慎的尺子。
而大模型批改一篇作文,只需要几秒钟。
为了看清这把“机器尺子”,笔者做了一次小实验:从历年公开流传的高考满分作文中筛选十篇,逐篇投喂给多款主流大模型,请它们参照高考评分细则打分、写评语、提修改意见。
十篇满分作文,是十种关于“好”的答案。笔者想看看,大模型会怎么回答。
大模型批改高考满分作文,结果是什么?-第8张图片-四季读书网
一、大模型是怎么“读”一篇作文的
大模型批改高考满分作文,结果是什么?-第9张图片-四季读书网
大模型批改高考满分作文,结果是什么?-第10张图片-四季读书网
市面上的智能批改,通常分三步走。
第一步,找茬。错别字、语病、标点、字数、卷面,逐句扫描。这一步它又快又稳,胜过多数人眼。
第二步,拆解。判断审题是否准确、立意是否明确、结构是否完整、论据能否支撑论点。北京师范大学“北极星”基础教育大模型评测,把语文作文的机器批改维度定为五项——审题准确、内容充实、结构合理、语言表达、书写规范,基本就是这套逻辑。
第三步,评分。对照高考评分细则——全国卷作文60分,基础等级40分(内容、表达各20分),发展等级20分(深刻、丰富、有文采、有创新)——生成一份“作文体检报告”:分维度打分、全文总评、升格建议。
前两步,机器做得比人快,也未必比人差。真正的分水岭在第三步:给“好”定性。
大模型批改高考满分作文,结果是什么?-第11张图片-四季读书网
二、满分作文投喂后,笔者看到的三种反应
大模型批改高考满分作文,结果是什么?-第12张图片-四季读书网
大模型批改高考满分作文,结果是什么?-第13张图片-四季读书网
大模型批改高考满分作文,结果是什么?-第14张图片-四季读书网
反应一:分数“打折”
国内外多项研究指向同一个现象——AI倾向于压低高分、抬高低分,把分数向中间收拢。英国卡迪夫大学的研究发现,AI批改存在“收缩效应”:高分作文被压低,低分作文被抬高。满分作文投进去,大多数模型给出的分数,只在“一类文”的下沿徘徊,像面对一座陡峰,机器选择了保守。也有例外。有媒体让大模型互批高考作文,最“心软”的一个模型,给另一篇记叙文打了满分,评语却四平八稳:“审题完全扣题,结构清晰层进……语言流畅有表现力。”满分给得轻易,理由给得泛泛。
大模型批改高考满分作文,结果是什么?-第15张图片-四季读书网
反应二:评语“失真”
一篇写宠物离世的学生作文,字里行间都是难过,AI给出的评语依然是“本文情感真挚……建议强化段落间逻辑关联”。孩子看完,闷闷不乐。上海一位语文特级教师道破症结:批改作文不只是反馈学习成果的路径,更是一种情感沟通。而机器擅长的是“合规性检查”,不是“共情”。
大模型批改高考满分作文,结果是什么?-第16张图片-四季读书网
反应三:标准“漂移”
同一篇作文,换一个批改平台,分差普遍在8到15分,个别超过20分;同一个平台,上午下午分别提交,分数也会浮动。这不是哪家产品的问题,而是生成式模型的本性——它的判断是概率,不是定理。
笔者最深的感受是:大模型对满分作文,认得出“好”,却说不出“为什么好”。它对“深刻、丰富、有文采、有创新”的回应,往往是把这十二个字再念一遍。
大模型批改高考满分作文,结果是什么?-第17张图片-四季读书网
三、一把好用的尺子,不等于一个懂作文的人
大模型批改高考满分作文,结果是什么?-第18张图片-四季读书网
大模型批改高考满分作文,结果是什么?-第19张图片-四季读书网
这些发现,教研一线早有警觉。AI评分体系自带模板偏好,青睐结构规整、用词规范的文本,质朴真诚的表达反而常被误判;一些孩子摸清套路后,用万能开头、华丽排比批量生产“流水线范文”,反而拿到机器高分。这正是“为AI写作”的异化——写作本应是自由表达,评价标准一旦被算法框定,作文就容易失去真情底色。
2025年11月,教育部教师队伍建设专家指导委员会发布《教师生成式人工智能应用指引(第一版)》,划出一条红线:教师不得将生成式人工智能对作文等的自动批改结果,作为学生最终评价直接使用。
大模型批改高考满分作文,结果是什么?-第20张图片-四季读书网
结语
大模型批改高考满分作文,结果是什么?-第21张图片-四季读书网
大模型批改高考满分作文,结果是什么?-第22张图片-四季读书网
大模型是一把好用的尺子,也是一把失明的尺子。
它看得见字正腔圆,看得见起承转合,看得见结构是否完整、逻辑是否闭合;它甚至能给出比许多匆忙的人工批改更规范的建议。
但它看不见一个孩子为什么要把“父亲”写进第三段,看不见那句看似离题的话里藏着的犹豫,看不见一篇文章背后尚未成型的世界观。
它测量的是作文,而教师辨认的,是情感。
技术的价值,是让教师节省出时间,让他看见那个正在学习表达的人。
AI负责高效,教师负责看见。最好的批改,不是给出一个分数,而是让一个孩子确信:自己的文字,被人认真读过了。
资料来源说明:本文实验观察与数据,综合参考:澎湃新闻2026年6月九款大模型上海卷作文盲评;南方产业智库全国I卷作文测评(界面新闻转载);钛媒体2026年6月大模型互评高考作文实测;人民网2026年7月《AI批改作文,什么评分标准?》六平台横评报道;《中国教师报》AI批量评语案例(中国经济网转载);英国卡迪夫大学AI批改“收缩效应”研究(IT之家报道);北京师范大学“北极星”基础教育大模型评测(2025年7月);《教师生成式人工智能应用指引(第一版)》(教育部教师队伍建设专家指导委员会,2025年11月)。
大模型批改高考满分作文,结果是什么?-第23张图片-四季读书网
END
国育未来教育科学(深圳)研究院

国育未来教育科学(深圳)研究院是国内未来教育领域的专业研究机构和实践创新的高端聚合平台,由教育部有关部门与北京普瑞未来教育科技集团共同发起成立。国育研究院汇聚了一批教育界知名专家学者,协同国内顶级教育学术机构,以未来教育作为研究方向,聚焦人工智能与教育的融合创新,链接政府及产业资源,整合国内外专业的教育智库力量与教育创新成果,推动构建未来教育创新生态体系。

我们不仅要成为未来教育的思想库,更是成为推动人工智能教育发展的行动者,致力于打通人工智能技术与教育场景应用的“最后一公里”,构建一个集“科研转化、产品孵化、资本赋能、生态共建”四位一体的新型教育研究、科技创新与应用的平台,为实现中国教育现代化贡献力量。

三连一下,了解更多内容
原创 | 本文原创,转载请标明公众号来源
撰稿 | 胡哲 编辑 | 胡哲 
审核 | 李志强

抱歉,评论功能暂时关闭!