一件作品的五个分数是 82、84、83、85、96。前四个相近,最后一个明显高一些。工作人员很容易想:“是不是把 86 输成了 96?”
这只是一个可能原因。分差也可能来自专家对创新性、证据充分程度或应用价值的不同判断。上述分数是模拟例子,不能仅凭差距就删掉其中一项。
先查有没有评错对象
复核的第一步可以很朴素:作品编号是否对应,评委看的是否是同一份报告,输入框有没有填错行。
如果材料在多个渠道流转,还要检查版本。有的专家看了补交后的报告,有的仍在评旧文件,分数不同就不难理解。此时需要处理的是评审材料不一致,不能简单要求某位专家“往平均分靠一靠”。
对于疑似录入错误,应请评分人确认,再走事先约定的更正程序。原始分数、确认说明和处理结果应当保留下来。

再看评分标准有没有说清楚
“创新性好,给高分”还不足以形成一致口径。新颖的选题、独立完成的实验和扎实的数据,各占多大比重?展示做得漂亮,但关键结论缺少证据,应该如何评价?
组织方可在正式评审前用模拟材料讨论标准,让专家了解分项含义和评分尺度。讨论的目标是澄清规则,不是要求大家给出相同分数。
如果评审已经开始,发现某条标准存在歧义,应由组织方统一解释,并评估是否影响其他作品。只对被发现的那一件临时调整,可能制造新的不一致。
分差提醒适合做入口,不能自动判错
可以把较大的分差列为待核对事项,但提醒阈值需要结合评分范围、评委数量和本届规则确定。不存在一个适合所有比赛的固定分差。
一位专家对多件作品都偏高,也不一定意味着错误。需要结合他评阅的作品范围和评分依据判断。不同专家如果看的是不同批次,直接比较他们的平均分更容易产生误解。
同样,不要在比赛中途突然增加去最高分、去最低分的算法。算法一改,所有作品的成绩口径都可能变化。

管理员要留下处理记录
复核表可以记录作品编号、触发原因、核查材料、评分人说明、处理结论和确认时间。没有发现操作错误,也应该写清“维持原分”及其依据。
如果使用在线系统,应提前确认提交锁定之后怎样受理更正,以及能导出哪些记录。质释数据资料中的评分监控和独立打分可以支持查看进度,但不应被表述成系统能自动判断专家是否评分公正。
让每一次复核有依据、有记录,比分数看起来整齐更有价值。
