拆解数字中国技术架构:不是搭积木,是织一张活的网
没人说透的:数字中国技术架构到底搭了个啥
很多人第一反应是,国家要做一个统一的大系统,把所有东西都装进去。错得离谱。它不是一块一块拼出来的死积木,是分层长出来的活网络。
最底层是全国一体化算力网络,这是整个架构的骨架。你现在刷短视频不卡,缴社保不用跑线下,甚至AI大模型能随便用,根源都在这个骨架上。东数西算不是随便搞的工程,把东部的大量非实时计算任务放到西部能耗低的机房,既省电,又把东部的算力腾出来给低延迟的实时业务,对吧?
数字中国算力网络骨干架构拓扑图
中间那层,是数据要素流通的技术体系。别以为这就是建几个大数据中心存数据。不是的,这层是做管道和规则的——怎么让数据从各个部门、各个企业流出来,怎么保证流的过程中不泄密,怎么算清楚谁拥有数据、用了多少次、该分多少钱,这都是这层要解决的事。
最上面那层,就是百花齐放的应用场景。政务服务、工业制造、乡村振兴、智慧城市,所有你能摸到的数字化服务,都是长在这个架构上面的应用。
之前我刚入行的时候,搞反了顺序,以为是先做应用再补底层,折腾了大半年才明白,数字中国的架构是从下往上扎根本,根扎得越深,上面的应用长得越好。
现在最卡脖子的环节在哪?说点圈内真话
架子搭起来了,不代表没有坑。我跑过十几个省市的数字化项目,最大的感受就是,卡脖子的从来不是没有技术,是标准不对联,机制没跟上。
就说数据共享吧,你去一个地级市做项目,要调公安的人口数据,还要调工商的企业数据,还要调环保的排污数据,每个部门用的标准不一样,接口不一样,甚至数据格式都不统一。光协调对接,就能耗掉你项目一半的时间。太扯了。
还有数据要素流通那块,现在全国几十家数据交易所,挂牌的数据不少,真正成交的没多少。核心问题在哪?技术上还没做到全链路可信。你买了一批数据用,怎么保证我买了之后你不会再卖给别人?怎么保证原始数据不会在流转过程中泄露?现在很多方案都还在试点,没完全跑通。
数据要素全链路流转追踪技术示意图
不过话说回来,这两年的变化真的超出预期。去年我还在跟同行吐槽标准不统一,今年已经有三个试点省份出了统一的地方数据标准,跨部门调数据现在几天就能搞定,放在之前想都不敢想。
还有隐私计算的落地,去年还是展会里的展示品,今年很多新上的政务平台已经把它当标配了,不动原始数据就能做计算,一下子解决了很多不敢流通的问题。
接下来三年,数字中国技术架构会往哪走?
接下来三年,数字中国技术架构会往哪走?
我跟几个中科院的朋友聊过,大家共识挺一致的,三个方向变化最快。
第一个,就是云网边端一体化彻底落地。现在很多边缘的算力,比如工厂里的边缘节点,县城里的本地机房,都是零散的,没接入大网。接下来三年,这些节点都会连进全国一体化算力网络,你哪怕是乡镇的小加工厂,要做工业仿真,需要大算力,直接从网上调度贵州或者内蒙古的闲时算力就行,成本比自己买机器低一半还多。
第二个,安全架构从“外挂”变成“原生”。以前做系统,都是先做功能,最后加个防火墙就算安全了。现在数字中国的架构,从底层硬件开始就嵌安全,每一层都有对应的安全模块,从硬件的可信执行环境,到数据流转的密码认证,到应用层的访问控制,安全是长在每一个地方的,不是补上去的。毕竟这么大一张网,出一点问题都是牵一发动全身,容不得马虎。
第三个,技术架构会越来越往普惠走。以前很多高端算力、大数据能力,只有大公司用得起,以后架构铺下去,中小微企业甚至个人,都能以很低的成本用到。就像当年电网铺到村里,家家户户都能用电灯,现在算力网铺下去,家家户户都能用得起高端数字化能力。
上次在乌镇看算力调度的演示,北京的用户调用贵州机房的算力,做AI模型推理,延迟才18毫秒。我当时站在展台前,真的挺震撼的。五年前,谁能想到跨一千多公里调算力,能这么快?
数字中国不是什么遥不可及的概念,就是一张慢慢织起来的网,把算力、数据、服务,一点一点织进我们生活的每一个角落。现在还有坑,还有没通的地方,但是你往近处看,变化真的一天天在发生。