一件作品的五个分数是 82、84、83、85、96。前四个相近,最后一个明显高一些。工作人员很容易想:“是不是把 86 输成了 96?”

这只是一个可能原因。分差也可能来自专家对创新性、证据充分程度或应用价值的不同判断。上述分数是模拟例子,不能仅凭差距就删掉其中一项。

先查有没有评错对象

复核的第一步可以很朴素:作品编号是否对应,评委看的是否是同一份报告,输入框有没有填错行。

如果材料在多个渠道流转,还要检查版本。有的专家看了补交后的报告,有的仍在评旧文件,分数不同就不难理解。此时需要处理的是评审材料不一致,不能简单要求某位专家“往平均分靠一靠”。

对于疑似录入错误,应请评分人确认,再走事先约定的更正程序。原始分数、确认说明和处理结果应当保留下来。

03_正文流程.png

再看评分标准有没有说清楚

“创新性好,给高分”还不足以形成一致口径。新颖的选题、独立完成的实验和扎实的数据,各占多大比重?展示做得漂亮,但关键结论缺少证据,应该如何评价?

组织方可在正式评审前用模拟材料讨论标准,让专家了解分项含义和评分尺度。讨论的目标是澄清规则,不是要求大家给出相同分数。

如果评审已经开始,发现某条标准存在歧义,应由组织方统一解释,并评估是否影响其他作品。只对被发现的那一件临时调整,可能制造新的不一致。

分差提醒适合做入口,不能自动判错

可以把较大的分差列为待核对事项,但提醒阈值需要结合评分范围、评委数量和本届规则确定。不存在一个适合所有比赛的固定分差。

一位专家对多件作品都偏高,也不一定意味着错误。需要结合他评阅的作品范围和评分依据判断。不同专家如果看的是不同批次,直接比较他们的平均分更容易产生误解。

同样,不要在比赛中途突然增加去最高分、去最低分的算法。算法一改,所有作品的成绩口径都可能变化。

04_正文清单.png

管理员要留下处理记录

复核表可以记录作品编号、触发原因、核查材料、评分人说明、处理结论和确认时间。没有发现操作错误,也应该写清“维持原分”及其依据。

如果使用在线系统,应提前确认提交锁定之后怎样受理更正,以及能导出哪些记录。质释数据资料中的评分监控和独立打分可以支持查看进度,但不应被表述成系统能自动判断专家是否评分公正。

让每一次复核有依据、有记录,比分数看起来整齐更有价值。