上周去一所学校听课,看到孩子们在台上展示科学实验——水火箭、编程机器人,场面热热闹闹。台下老师拿着评分表打分。同行的朋友说:看,这就是表现性评价。我愣了一下。真的吗?
热闹归热闹,可如果老师手里那张表只有“优、良、中、差”,或者评分靠直觉——那和三十年前的手工课打分有什么区别?❗所谓的表现性评价,核心根本不在“表现”,而在“评价”。而且这个评价,必须扎根于真实的任务、清晰的评分规则,以及对学生高阶思维的观察。不然,它就是一场披着“创新”外衣的老把戏。
表现性评价,究竟在评什么?
简单说,表现性评价是让学生做一件事,展示他们理解了什么、能做什么,而不仅仅是知道什么。比如:设计一份社区微更新方案、模拟联合国辩论、完成一个科学探究并撰写报告。这些任务——我们常称为表现性任务——没有标准答案,但有好坏之分。区分好坏的工具就是评分规则(rubric),它得说清楚:什么样的论证算“优秀”,什么样的协作算“达标”。

说实话,刚接触这个概念的老师经常犯怵:这比出一张卷子难多了。没错。设计一个能激发深层思考的任务,还要配出靠谱的评分规则,简直要脱一层皮。但,值。因为你一旦用上,就会发现学生眼里开始有光了——那种“这道题选C”的模式无法点燃的光。💡
别掉进“假表现性评价”的坑
我见过太多走偏的案例:让学生做个PPT,讲一遍课本内容,最后按“台风好不好”打分。这哪有真实性?真正的表现性评价应该模拟——或直接融入——真实世界的情境。真实世界会让我们背年份事件吗?它要求我们解决一个复杂的、信息不全的问题,还要跟人协作、调整策略。所以,任务不能是“复述辛亥革命”,而应该是“如果穿越回1911年,你会如何向不同群体宣传革命理念?请制作不同媒介的宣传材料并说明理由”。看到差别没?后者才指向核心素养,才能在过程中看见学生的批判性思维、创意和沟通能力。
还有一个坑:评分规则写得像飞花令。什么“内容充实、结构清晰、表达流利”——这些话学生根本看不懂。好的评分规则要用学生能理解的语言,描述不同水平的具体表现。比如:“优秀”水平是“能引用两个以上一手史料佐证观点”,“合格”水平是“能给出至少一个具体例子,但史料来源单一”。这样,评价才不是玄学。

老师们最纠结的几个问题
问:表现性评价是不是完全不要纸笔考试了?
答:怎么可能。它和传统考试不是非此即彼。就像你不能天天吃火锅,也不能天天啃干粮。有些基础知识的扎实度,纸笔测试效率更高。但检验学生能否综合运用知识、是否具备合作和创新能力,表现性评价几乎是唯一解。现在很多学校在做“混合式评价”,比如单元教学里穿插一两个大型表现性任务,期末再辅以纸笔测试——这种节奏,听着就靠谱。
问:设计一个完整的表现性评价流程太费时间了,怎么办?
答:这吐槽太真实了!首先,别单干。拉着年级组一起设计,分摊工作量,还能碰撞出更好的任务。其次,别追求一步到位。可以从改造现有作业开始,比如把一道应用题改成项目式问题,先试水一个简化的评分规则。再者,很多机构现在有现成的任务库(比如斯坦福的SCALE),可以借用再改编。不过话说回来,教育本就是个慢工细活,对吧?设计得好,学生一堂课的成长可能超过十节刷题课。
让表现性评价“活”起来的关键细节
别以为任务发了、评分规则给了,就万事大吉。真正见功夫的,是实施过程。学生做任务时,你得像个人类学家一样观察、记录——不是站着看,而是看他们怎么讨论、怎么失败、怎么调整。这些过程性证据,比最终那个完美作品更珍贵。有条件的,搞个简单的档案袋评价,把草稿、互评反馈、反思日志都收进去。最后你会发现,有些孩子虽然最终产品不惊艳,但思维进步巨大——这正是表现性评价的慈悲,也是它超越一张考卷的地方。✅
还有,别忘了让学生参与评价。让他们用评分规则自评、互评。刚开始肯定乱成一团,但坚持几次,他们的元认知能力会让你吃惊——有时候自己就能说出“我这个论证缺证据,应该打‘合格’”。这不就是我们最想要的自主学习吗?
最近看到不少学校开始把表现性评价融入综合素质评价,甚至和新高考的综合评价录取挂钩。虽说还有很长的路要走,但至少方向是对的。我们不再用一把尺子量所有孩子,而是看他们在真实场景里如何解决问题、如何成为独特的人。
当然,挑战一箩筐。比如教师培训跟不上,评分一致性难保证,家长还在问“这能提分吗?”……但说到底,如果教育只盯着提分,那永远不会有勇气去碰这种“麻烦”的评价方式。而一旦你碰了,就会发现——值得。因为你能看见分数之外的那个活生生的人。而这,才是教育本来的样子啊。