当前位置:首页 > 科研成果库

技术成熟度评价:别让TRL变成一场自欺欺人的打分游戏

2026-08-05 09:22:57小研科研成果库21

刚从会议室出来,头还是懵的。一个项目,非得让我给技术成熟度打分,从1到9,精确到小数点后一位。说实话,我当时特别想问——这玩意儿,真能这么精确?

但我不敢。满屋子专家,个个正襟危坐,我要是这么说,显得太不专业。可心里实在憋得慌。技术成熟度评价,本来就是一把尺子,结果现在这把尺子被玩成了万花筒,谁都能拧出一个自己想要的图案。

对吧?

这就让我想起NASA当年搞出TRL(Technology Readiness Level)那会儿。80年代,人家是真为了登月、航天飞机这种硬核工程,才不得不弄出一套量化标准,判断某个技术敢不敢往天上送。人命关天,不量化不行。可到了咱们这儿,尤其是基础科研、软科学甚至某些数字化转型项目,也要套TRL,我就有点看不懂了。

TRL,到底是个什么神仙标准?

TRL一共9级,从1到9,大体可以这么理解:1级是“我有个好点子”,2级是“我大概知道这路子能走”,3级是“实验室里关键功能跑通了”,然后一步步到9级“任务成功,实际运行没问题”。简单粗暴,对吧?但这里头有个前提——它是为硬件系统设计的。导弹、芯片、火箭发动机,这类东西。

NASA技术就绪水平TRL九级示意图NASA技术就绪水平TRL九级示意图

结果呢?现在啥项目都往上靠。上周我审一个管理信息系统,申报书上赫然写着“TRL 7级:已通过示范验证”。我一琢磨,这系统连原型都没在真实用户手里跑过,就敢说7级?一问才知道,他们在内部兄弟单位试了试,没出大Bug,就算“示范验证”了。唉。这不叫评价,这叫贴金。

更让我无语的,是有些评价体系里,居然把TRL当成了唯一的决策依据。“这个技术TRL才4,不给投”,一句话就把一个可能突破的方向否了。但技术的本质是什么?是探索未知啊。未知阶段,本来就没法精确度量,硬要用一个机械的刻度去卡,那不等于是让婴儿去跑百米吗?

好好的经,怎么就念歪了?

我承认,TRL是个好工具,尤其对于工程化集成、重大装备制造这类场景。可一旦它变成一种行政评审的通行证,味道就变了。项目申报要写TRL,中期检查要提TRL,结题验收更要证明TRL提升了多少。于是你就能看到各种神奇的描述——“通过本课题研究,关键技术成熟度由原来的3.2级提升至5.7级”。3.2?这是怎么算出来的?0.1级又代表什么?是焊接强度提高了10%,还是代码bug率降低了?

说实话,没有人能回答。大家心照不宣:你填你的数字,我看我的需求,只要别太离谱,评审会总能过去。久而久之,技术成熟度评价成了一场心领神会的数字游戏。专家们懒得较真,申报方也懒得诚实,反正——你懂的。

科研成果转化技术成熟度评价流程图科研成果转化技术成熟度评价流程图

更讽刺的是,有些机构还把这套逻辑输出成了“标准化服务”,到处帮别人写材料、做评估。我见过一份报告,厚得能当砖头,里面各种曲线、雷达图,最后结论是“该技术TRL已达6.9,预计一年内突破8”。我给团队负责人发消息:老兄,你们那技术,实验室样机都还三天两头烧电容呢,怎么就这么自信?他回了个笑脸:“没办法,现在不包装,连入门券都拿不到。”

得,问题不只在评价方,也在整个生态。当资源分配过度依赖这种量化指标时,诚实的人会吃亏,夸大的人反而受益。这不就是逆向淘汰吗?

真金不怕火炼,但火候得自己掌控

那怎么办呢?扔了TRL不用?显然不现实。我的看法是——回归场景,把评价权还给懂行的人。对于验证型、工程型项目,TRL依然管用,但要细到具体技术点,而不是笼统一锅炖。比如无人驾驶的感知算法和底盘线控,成熟度能一样吗?可很多报告里就是一个数字,代表整个系统。这不搞笑嘛。

对于那些探索性基础研究、前沿交叉领域,就别硬套TRL了,换个逻辑。我曾参与过一个量子计算的项目评审,人家直接说“我们当前TRL大概2,但年进步率是指数级的”。这多真实,多有说服力。可惜当时有些专家还是摇头:“那风险太高了。” 你看,连指数级突破的机会都不敢赌,非要等到别人做成9级了再去跟风,那还创个什么新?

说到底,技术成熟度评价的核心不是打分的动作,而是对技术发展规律的真实敬畏。有些技术就是得在3级呆很久,有些从6级到9级可能踩个坑就掉回4级。这些动态、非线性的过程,一张静态量表怎么可能刻画得清楚?我们需要的是更多元、更敏捷的评估手段,比如里程碑式跟踪、关键假设验证、专家经验迭代,而不是死守一个五十年前的标准。

唉,吐槽了这么多,其实我也知道,大环境改起来难。但我还是希望,下一次填TRL的时候,我们能多问问自己:这数字,自己信吗?如果连自己都不信,那这张表,交上去又有何意义?

算了,不想了。明天还有个会,材料里还得编TRL。也许,这就是人生吧。