当科研成果开始被“算账”:社会效益评估的困局与野望
张教授盯着屏幕上的表格,鼠标滚轮滚了三圈,没找到‘论文数量’那一栏。取而代之的,是‘社会效益’、‘成果转化’、‘政策影响’……他愣了三秒,心想:我一个搞理论物理的,社会效益?难道要我写一篇文章说明弦理论如何让大妈买菜更便宜?
这不是段子。过去十年,国内高校和科研院所的评价体系,正在经历一场剧烈的‘地震’。核心就一句话:唯论文,不行了。那行什么?大家吵来吵去,最后把目光投向了那个听起来很正确、做起来很抓狂的词——社会效益评估。
科研人员对着电脑填写社会效益评估表格,一脸困惑
说实话,这个转变来得不意外。论文灌水、专利注水的问题闹了这么多年,上头也烦了。2018年那场‘破四唯’的疾风骤雨,直接把‘唯论文、唯职称、唯学历、唯奖项’的牌子给砸了。砸完之后呢?总得立点什么吧。于是,‘分类评价’、‘代表作制度’、‘同行评议’这些词开始高密度刷屏。但最让学术圈心里打鼓的,就是社会效益评估——它意味着,你的研究成果,不再只是印在期刊上的铅字,还得拿出去‘晒一晒’,让外行人评评理:这玩意儿,到底对国家、对社会、对老百姓有啥用?
从‘数论文’到‘讲故事’,科研评价的艰难转身
你可能不知道,这股风其实吹了很久。早在上世纪90年代,英国就搞了个‘研究卓越框架’(REF),其中‘研究影响’(reach and significance of impacts)占到总分值的20%-25%。注意,不是可选项,是必答题。一个搞古生物的教授,得跟评审委员会掰扯清楚,他的恐龙化石研究,到底怎么提升了公众的科学素养、或者带动了当地博物馆的经济。听着挺扯的,是吧?但人家一板一眼,做了二十多年。澳大利亚、荷兰、美国,也都在搞类似的东西。
回过头看咱们。我们的问题是什么?步子是迈出去了,但不少人还在用老脑筋想新问题。一提到社会效益,很多老师的第一反应是:要写个‘科普文章’?或者,我得证明我的成果卖了多少专利费?这其实是对社会效益的粗暴窄化。社会效益远不止经济转化,它应该包括——比如,影响了公共政策、提升了行业标准、解决了某个环境或公共卫生隐患、甚至只是改变了某个群体的认知偏见。但这些软性的东西,怎么量化?怎么填进那个该死的Excel表?2021年国务院办公厅发布的《关于完善科技成果评价机制的指导意见》就明确提出,要‘坚决破解科技成果评价中的唯论文、唯职称、唯学历、唯奖项问题’,并强调‘经济社会效益’作为重要评价指标。但政策落地总是磕磕绊绊。我问过一个在科研处工作的师兄,他说现在评审专家库里的评委,大部分还是擅长看论文,一提到社会效益,大家面面相觑,最后只能看‘新闻联播里有没有播过’‘有没有获得省部级领导批示’。这算不算另一种‘唯上’?所以他戏称,社会效益评估快变成‘抬轿子效益’了——你得找到足够高的人给你抬轿子。这话虽糙,但戳中痛点。
科研社会效益评估多元指标雷达图,包含经济、政策、文化等维度
我见过一份某985高校的社会效益填报模板,里面要求填写‘成果服务对象’、‘受益范围’、‘转化金额’、‘媒体报道链接’……像极了互联网公司的OKR。有位文科教授苦笑:我的著作十年卖了三千册,按这个标准,效益还不如楼下奶茶店一个季度的流水。可那本书,可能启发了立法者,改写了某个领域的司法解释——这种‘杠杆效益’,表格根本装不下啊。
效益评估的‘薛定谔困境’:量化容易,质化难
这就引出了最核心的矛盾。社会效益评估,本质上是一个反‘熵’的过程。你想,科研本身充满了不确定性,一个基础发现可能要等二十年才能开花结果。而效益评估,偏偏要求你在结题那刻,就给出一个确定性的、可视化的‘效益清单’。这简直像逼着一个母亲在婴儿刚出生时,就填表预测他将来能赚多少钱、当多大官。荒谬不荒谬?可现实是,基金委、科技部的项目指南里,‘预期社会效益’那栏越来越长,还越来越重。去年科技部搞的一个评估试点,要求每个项目填报‘服务国家重大需求’的实际案例。结果,有的项目填‘成果被用于神舟飞船’,另一个填‘成果被用于新冠疫苗研发’,都挺牛,但评审时问:你怎么证明是你那项成果起了作用?对方支支吾吾。这种‘搭便车’现象,让评估的公信力大打折扣。
于是,上有政策,下有对策。聪明人开始玩文字游戏了。‘本研究成果具有重大的潜在社会效益,预计将在未来五年内对行业产生深远影响……’——这模板我都能背出来。评估材料越来越厚,装帧越来越精美,但水分也越拧越多。评审专家又不是神仙,对着几页PPT,他怎么判断‘深远影响’是不是画大饼?最后,还是看谁的头衔大、谁的故事讲得圆。这不又绕回去了吗?
不过话说回来,也不能一杆子打翻一船人。我确实见过一些做得特别扎实的案例。清华有个团队,搞智能交通的,他们的算法在北京几个路口试点后,通行效率提升了15%,实实在在的数据,交警队感谢信都寄过来了。这种效益,理直气壮。还有中国农大的科技小院,学生住进村里,帮农民解决了无数种植难题,增产又增收,这不就是最鲜活的社会效益?关键在于,评估能不能从这些‘毛细血管’级的真实案例里,提炼出可推广、可比较的框架,而不是逼着所有人都去编‘大动脉’的宏大叙事。
中国农业大学科技小院学生与农民在田间地头交流
数字背后的人:谁为那些看不见的价值买单?
数字背后的人:谁为那些看不见的价值买单?
聊到这儿,我想起一个更扎心的问题。社会效益评估,最终由谁来评?现在的操作,大多是单位内部先填,然后请几位同行专家评阅,或者再加点第三方机构的数据佐证。但真正的受益者——那些老百姓、企业、NGO——很少有机会发声。你一个针对乡村教育的成果,最有资格打分的,不是城里的教授,而是村小的老师和学生。可他们的评价,怎么规范?怎么防止刷好评?想一想,脑袋就大。现在有些高校开始尝试‘数字素养+社会影响’的综合画像,比如浙江大学利用大数据分析教授的社会网络传播度,但争议也大——这不成网红评选了?所以,得平衡。
还有个隐藏的雷:评估成本。去年,我和一位在评估机构工作的朋友吃饭,她吐槽说,接了一个大项目的社会效益评估,前前后后花了大半年,调查问卷收了两千份,最后报告写了三百页。委托方付了三十万评估费。三十万啊!这个钱,要是直接投给研究团队,说不定都能再发两篇顶刊了。我们不禁要问:当评估本身消耗的资源,可能超过它试图衡量的价值时,这个事还值不值得干?而且,这种重成本的评估,天然有利于那些有钱、有资源的‘大团队’,对于穷得叮当响的基础学科,或者没人脉的青椒,简直就是雪上加霜。
所以,该怎么办?说实话,我没有标准答案。这个领域,全世界都在摸索。但有些方向,我觉得是共识:第一,做减法。别一上来就要求‘全面效益’,抓住一两个最核心的维度,深挖下去。比如,基础研究就看学术贡献和人才培育,应用研究就看技术落地和产业带动。第二,拥抱叙事。好的社会效益评估,应该是一个精彩的故事,有数据支撑,更有人物、有冲突、有转折、有改变。强生公司有个‘社会影响力报告’,就是用大量照片、视频、患者访谈来呈现一个产品的社会价值,远比干巴巴的数字动人。第三,让子弹飞一会儿。给予长周期评估和回溯性评估的空间。允许研究者说‘我现在不知道有什么用,但请十年后再来看’。这不是偷懒,是对未知的敬畏。
最后,讲个小事收尾。去年我去拜访一位退休的老科学家,他的成果——一种特殊的材料,被用在了国产航母的甲板上。但这个东西,他生前不能说,项目是保密的。直到他去世后,讣告里只写了一句话:‘长期从事国防科研工作。’没有专利,没有论文奖励,没有报奖。你说,他的社会效益怎么评估?或许,有些价值,本就不该被评估。