传统评分:伟大的推动者

我使用规格等级评分的时间越长,与未使用精通等级评分的大学课程相比,使用非熟练等级评分的大学课程与学生的体验差异就越大,我相信对等级评分方法的改革是迫切的道德要求。

几年前,我从传统的,基于分数的无修订等级转为规范等级,因为我有强烈的感觉,不仅传统等级没有信息意义(大量错误肯定和错误否定,而且等级之间也没有明确的联系)以及学生可以做什么),但以多种方式对许多学生造成积极伤害,其中最大的动机之一就是动机 。 当我使用传统的评分方法时,学生似乎始终不是出于学习该学科的希望,而是出于以正确的方式获得足够分数来获得他们所需要的成绩的内在游戏—否则他们根本没有动力。

传统的评分方法无用的这种直觉就是:一种直觉。 但是我最近遇到的一项研究给出了有关传统评分对动机的实际影响的结果。

Chamberlin,K.,Yasué,M.,&Chiang,ICA(2018)。 成绩对学生动机的影响。 高等教育中的主动学习,1469787418819728。

链接到论文: https : //journals.sagepub.com/doi/pdf/10.1177/1469787418819728

与“叙事评估”相比,本研究的作者调查了“多间隔”成绩(阅读:A / B / C / D / F系统)如何影响学生的基本心理需求和学习动机。学生的口头反馈既可以替代,也可以作为多区间评分。

该研究的理论基础是自决理论(SDT)。 这个框架是我们获得外部和内在动机的概念的地方,人们被激励通过外部奖励或出于任务本身的动机来完成任务。 (有关更多背景知识,我在这篇文章中写了关于SDT和翻转学习的文章。)根据SDT的介绍,学习者在参与学习过程中存在三个基本的心理需求: 能力 (需要良好或至少感到自己在所学的知识上是优秀的), 自主权 (具有选择和代理能力)以及联系或“关联性”(在执行任务时在心理上与他人联系)。 本质上,在学习过程中满足这三个需求的次数越多,学习者将体验到更多的内在动力。 缺乏对这些需求的满足会导致内在动机减少,无论是外在动机还是根本没有动机。

他们研究了三所不同大学的394名学生。 其中一所大学在其班级中仅给予多间隔等级成绩; 另一个在制度上避免了多区间等级,并且在课程中仅使用叙述性评估 。 在这里,学生将获得关于他们所做的事情和需要做的事情的口头反馈(诚实,详细,建设性和可行的),而不是成绩。 第三部分结合了叙事评价和字母等级。 对学生进行了两次关于学习动机的调查,并对其中一部分进行了半结构化访谈以进行更深入的研究。

结果是对传统分级的一种发人深省的起诉。 这里只有少数脱颖而出。

除其他事项外,还询问学生有关他们从年级获得的信息(如果有),年级是否影响他们决定上什么课的决定以及自高中以来与年级的关系是否发生了变化。 普遍的意见是,成绩没有传达可用于改进的“能力提升反馈”; 大多数学生无法给出任何有关如何使用成绩来改善学习的示例。 更糟糕的是,成绩确实给学生提供的信息往往是对学生自我价值的负面信号。 高成就的学生承受着获得高分的压力; 成绩差的学生感到自己的成绩低落。 所有学生将“压力”一词与年级联系起来的频率比任何其他概念都高。

此外,传统的年级积极地削弱了学生的自主意识,因为他们所获得的年级与所学的许多次似乎无关。 正如一位学生所说:

实际上,这非常令人沮丧,因为即使在我真正接触到内容并且非常努力地学习的班级里,我仍然感觉自己像是B +。 在我不关心也不很努力的课程中,我仍然获得了B +。

成绩也不利于相关性,一些学生表示,当他们的成绩差时,他们与父母的关系会受到怎样的影响。

作者还指出,在讨论传统成绩时,学生很容易采用资本主义风格的商业语言,例如在描述他们如何上课时指的是“成本效益分析”和“收益”。 这就是战略学习和外在动力扎根。

经历过叙事评估的学生的结果几乎与多间隔分级的结果完全相反。 每位接受采访的“叙事评估”学生都表示,叙事评估为他们提供了有关其能力的有用信息,并且比多间隔等级更有用。 该研究发现叙事评估与增强的能力,自主权和联系能力之间存在密切的联系,而且许多学生评论说叙事评估如何建立学生与教师之间的信任 ,即使反馈在很大程度上是负面的。

这些结果不仅来自访谈,还来自调查的定量结果,在传统评分背景和叙事背景的学生之间发现的学术动机测量值在统计上有显着差异(叙事评分会导致更高的动机指标)。 该大学的学生使用混合评分方法体验了叙事评估的一些好处,但也体验了传统评分的一些障碍–尽管该研究并未直接说明这一点,但在我看来,出现这种障碍是因为字母等级。 (如果您将学生置于“混合”环境中,并给他们良好的叙述评价,然后再给其“ B +”成绩,那么您猜该学生将倾向于关注什么?)

那么我们该怎么办? 对我来说,行动方针很明确: 我们需要摆脱传统的分级 -我不仅要包括多间隔字母等级,还应包括基于统计点累积的等级。 我们已经看够了。 成绩对学生的健康有害; 他们没有为雇主,学术课程甚至学生本身提供准确的信息; 他们将学生的动机恰好引导到了我们不希望这些动机去的地方。 没有什么连贯的论据可以证明,从最适合学生的角度来看,传统评分是评估学生工作的最佳方法。 如果我们重视学生,我们将开始变得富有创造力和勇气,用更好的东西取代传统的评分。

提示有关由于转移信用问题,无法进行大规模的非传统分级等原因而无法执行此操作的异议。在某种意义上,此举是一长串小步骤,因此我部分同意。 这里的文章同样务实,并给出了一些好的建议:

很少有大学可以取消分数。 但是,大学应质疑多区间成绩的常规用法,并考虑其在不同系,学习年限,课程和学习者类型中的优缺点。 例如,可能存在特定的课程或计划[…],其中,与向外部受众进行标准化的表演交流相比,培养深度学习和动机可能更为重要。 对于此类课程,可能需要更多地使用叙事评估(而不是多间隔等级)。 另外,在成绩前几天隐瞒学生的成绩或提供叙事/书面反馈可能会帮助学生专注于与精通相关的学习目标,而不是外在的奖励。

我将添加以下我从使用规范等级中学到的知识,并了解其他人如何使用此等级和其他形式的精通等级:

  • 可以保留A / B / C / D / F系统来报告学期成绩,但可以使用叙事评估和精通评分代替分数和统计来确定学生的成绩。 这是一个例子。
  • 根据文章的建议,在叙事评估和精通等级最有意义的课程中,开始将您的评分方式更改为不太关注字母和分数,这是研究生课程,研讨会,面向证明的高级数学课程,荣誉课程部分,等等。
  • 我认为您也可以提出一个很好的理由,即入门课程也是尝试叙述性评估和/或精通等级的沃土,因为这是学生学习动机往往处于最低点的地方。
  • 像对待日记本一样对待学生的工作(尽可能多)。 当我们的学者向期刊(或权属组合等)提交文章时,我们不会获得积分值或字母等级。 我们得到口头反馈,并附有简短摘要:“接受”,“拒绝”,“主要修订”,“次要修订”等,然后附上详细信息。 然后,根据学生能够完成多少可接受的工作,分配课程等级(如果必须)。

这里有一些无法解决的实际问题,例如(尤其是)大型部分。 缩放问题是一个棘手的问题,但并非不可能。 根据我的规范评分经验,叙述性评估每名学生所花费的时间不会比传统评分多(传统评分需要无休止的头发分解才能给出多少分),所以我认为没有理由相信非传统评分无法扩大规模。

摆脱传统的评分可能是那些帕累托原理的概念之一,在该概念中专心于这一想法可能会在学生学习的许多其他领域带来巨大的进步。 我认为这可能是高等教育全面变革甚至革命性变革的支点。 试一试吧。