当前位置:首页 > 科研成果库

综合绩效评价:别再数论文了,科研成果到底该怎么“称重”?

2026-08-07 22:01:29小研科研成果库16

从“数数”的泥潭里爬出来

那天,老张在课题组例会上发火了。真的,摔了笔记本那种。起因很简单——他花了三年做的一个农业物联网项目,实打实帮周边农户增产了12%,但因为没有发出“高水平SCI”,在年度考核里竟然排在全组倒数第二。倒数第二啊!一个能下地、能创收的成果,比不上几页曲线图配漂亮数据的文章?老张吼出这句话时,会议室静得能听见空调的嗡鸣。我突然意识到,我们是不是被某种简单粗暴的量化指标给绑架了?就像超市里给蔬菜贴价签,不管你是不是有机的、是不是刚从地里拔的,只看个头大小。这不对。

这些年,科研圈没少吐槽“四唯”——唯论文、唯职称、唯学历、唯奖项。文件发了一摞又一摞,可一到评项目、评人才,很多人还是下意识地伸手去数:几篇SCI?影响因子多少?被引次数呢?仿佛科研成果的价值,只能用冷冰冰的数字丈量,而数字之外那些鲜活的社会影响、技术突破、甚至是对思维方式的革新,都成了看不见的重量。所以,当“综合绩效评价”这个词频繁出现在新政策里,说实话,我第一反应是——早该这样了!但第二反应是,怎么落地?怎么防止变成另一种花样的“数数”?

科研人员面对一摞论文和评价表格焦虑地揉太阳穴科研人员面对一摞论文和评价表格焦虑地揉太阳穴

评什么:不是所有“贡献”都能写在纸上

去年参加一个同行的评审会,碰到某大学一位做古生物研究的老师。他的团队在野外挖了八年,发现了一个新的恐龙化石群,填补了白垩纪某个时期的空白。但你要是看他的论文清单,简直寒酸——只有三篇。因为大量的时间花在了野外勘测、标本修复、甚至当地科普馆的建设上。可就是这么一个成果,被当地政府看作是打造特色旅游的钥匙,撬动了区域经济。这贡献,怎么算?按老标准,他可能连副教授的门槛都摸不着。但用综合绩效评价的眼光看,新发现带来的科学认知突破、对社会经济文化的拉动、以及人才培养(他带出了好几个野外考古能手),都得计入权重。这就引出一个核心问题——科研成果的“绩”和“效”究竟指什么?

现在主流提法是“五大价值”:科学价值、技术价值、经济价值、社会价值、文化价值。听上去比单纯数论文周全多了,对吧?但操作起来照样一地鸡毛。科学价值还好说,同行判断;技术价值也能通过专利、标准来体现;可经济价值呢?很多基础研究根本没法短期内变现,非要套上“市场前景”的帽子,那不是逼着科学家说谎吗?还有社会价值——比如改善生态环境,那可能要十年甚至更久才能看到效果,你让一个三年的项目怎么证明?所以,综合绩效评价的关键,在于分类。基础研究和应用研究不能一个尺子量。国家去年出台的《关于完善科技成果评价机制的指导意见》就明确提出了要建立差别化的评价体系,就是这个意思。不能让搞纯数学的和搞疫苗研发的、画油画的去挤同一条跑道。

科研成果五大价值评估维度示意图科研成果五大价值评估维度示意图

怎么评:告别“一言堂”,让证据说话

几年前我参加一个国际学术会议,茶歇时跟一位德国教授聊起评价的事。他说他们那边有个做法挺有意思——代表作制度加上“叙事性简历”。啥意思?就是申请职位或项目时,只允许提交不超过5件代表作,并且每件作品要附上一段“故事”,讲清楚你在其中的真实贡献,以及它为什么重要。评委看的不是清单的长度,而是故事的厚度。我当时就觉得,这招有点狠。直接砍掉了靠挂名、靠灌水刷存在感的可能。但这极其考验评委的眼光和良心。没有小同行的深度参与,故事编得再花哨也会漏馅。

国内现在很多顶尖高校和科研院所也开始试水代表作制度,甚至有配以“负面清单”的,规定哪些论文不算数,比如发在水刊上的、引用异常的。可上有政策下有对策,有人就开始琢磨怎么把一篇大文章拆成“香肠片”来报奖。所以,光靠制度设计还不够,还得有工具。大数据技术正在悄悄入场——通过分析引文网络、合作者图谱、成果转化链条,给每个成果画一个“社会关系图”,看看它究竟触动了哪些领域、产生了怎样的涟漪。这比单看影响因子要立体得多。当然,这又引发了隐私和数据安全的争论……不过那是另一个话题了。

我个人最欣赏的,还是同行评议的回归,但必须是严格的小同行。不是那种大帽子院士扫一眼摘要就打分,而是真正懂你这块细分的、甚至能对你的实验设计提出质疑的人。只有他们,才能读出你那份技术报告背后的血汗和巧思。去年我参与评审的一个农业机械项目,负责人是个老工人出身的土专家,没发过几篇文章,但设计的小型收割机在山地灵活得像只山羊。我反复看了田间测试的视频,又向当地农民打电话核实,才敢在“技术创新性”一栏打了高分。这种体验,是坐在办公室看电子表永远得不到的。

小同行专家在田间地头考察农业机械设备小同行专家在田间地头考察农业机械设备

谁来评:打开大门,让“用户”进来

谁来评:打开大门,让“用户”进来谁来评:打开大门,让“用户”进来

还记得开头提到的老张吗?后来发生了戏剧性的一幕——年底,学校试行新的评价办法,引入了“社会评价”环节,邀请了当地农业部门、合作社的代表来打分。老张的项目因为实实在在提高了产量和农户收入,直接被评为了“标志性成果”,奖励翻倍。他在庆功宴上喝得满脸通红,说:“比发十篇论文都痛快,因为被种地的农民认了,值!” 你看,评价主体一变,风向立刻不同。

综合绩效评价的一个重大转向,就是评价主体的多元化。以前是学术圈内自说自话,顶多政府科技管理部门插一脚。现在越来越多地引入第三方专业机构、行业协会、甚至最终用户。比如一个治疗罕见病的药物,最应该听的是病友组织的反馈;一项环境治理技术,当地居民的感受至关重要。不过,这也带来新问题:外行怎么准确判断技术含量?会不会被忽悠?所以需要建立一种“协调机制”——科学家拿出客观证据,用户提供使用体验,第三方机构进行技术检验,最后综合裁决。这听起来像是一场多方参与的“戏”,但导演必须是具有公信力的组织。

还有一个趋势不容忽视:国际评价。尤其是那些需要全球合作的大科学计划,比如人类基因组、空间站实验,必须由多国专家共同评估。这里面的博弈就很微妙了——标准谁定?数据共享到哪一步?政治因素会不会干扰?说实话,没个定论。但有一点是肯定的,好的成果经得起多角度的审视。

写到这儿,我突然想起科技部去年废止了一批旧的评价办法文件,新出台的系列指导意见里反复强调“破立并举”。破的是数字崇拜,立的是质量贡献。但“立”比“破”要难一百倍。因为它需要整个学术文化的转变,需要每个评价环节的人——从管理者到科学家——都拿出勇气和良心。不过,至少,我们已经在路上了,对吧?