30万项公共数据,都谁在用?
2026-09-03 21:59:59
  • 0
  • 0
  • 0

“国家公共数据资源登记平台30万+项,覆盖国民经济97个大类,但数据有了≠数据被用了。

2026年8月25日,国家数据局公布最新进展:截至当天,国家公共数据资源登记平台已登记数据资源、产品和服务超过30万项,覆盖全部国民经济97个大类。31个省(区、市)和新疆生产建设兵团,都已开展公共数据资源登记业务。

同一场新闻发布会还公布另一个数字:国家数据局组织开展的公共数据"跑起来"示范场景建设,自2024年10月启动以来,已累计发布五批共150个示范场景,其中第五批收到申报方案731份,最终遴选50个,通过率约6.8%。

把这两个数字放在一起读,会发现一个奇怪的反差:数据供给过剩(30万项)+场景申报过载(731选50)。一方面数据多得登记不完,另一方面场景多得遴选不过来,但真正产生经济社会效益的案例有多少?

扒国家数据局公布的100个前四批示范场景,会发现一个反事实:大多数场景是政策指标,少数是真正产生效益的产业应用。

本文基于国家数据局公告、上海公共数据开放平台实际调用数据、第五批50个示范场景清单等多源交叉核实,回答一个问题:中国有30万项公共数据,但谁在用?用了多少?真有用吗?

数据供给规模
国家平台三层叠加

先把"30万项"放在更广的视野里看。中国公共数据供给是国家、省、市三层叠加:

表1·国家公共数据三层平台规模(截至2026-08)

三个数字加起来,中国公共数据的"供给家底"已经超过78万项。这是国家战略级判断,2026年"十五五"规划首次提出"建设开放共享安全的全国一体化数据市场",数据被列为第五大生产要素。

但供给规模大不等于被有效利用。30万项数据里,有多少真正被调用、被使用、被产业化?这才是真正的问题。

上海明星数据集调用次数差500倍

要看"数据是不是被用了",最直接的指标是调用次数。扒上海公共数据开放平台(data.sh.gov.cn)公布的"最热数据接口"和"最热数据产品"调用次数,会发现一个扎心的反差:

表2·上海公共数据开放平台明星数据集调用次数对比

这个对比揭示了一个真相:数据有了≠数据被用了。同样是政府数据,"全市地铁进出客流量"被调用1.56亿次,因为它是商业价值高的数据,金融、出行、商业分析都用得上。但"青浦区市民健身苑点信息"只下载了17万次,它是民生服务数据,没有商业驱动力,没人主动用。

30万项公共数据里,真正的"明星数据集"是少数。商业价值高的(交通、金融、企业信用、知识产权)被反复调用,民生服务类(健身苑点、社区商业、绿化)几乎没人主动用。数据开放不缺数据,缺的是商业驱动力。

这不是上海独有的现象,是全国的共性问题。政府大力开放数据,但市场用得冷热不均,有商业价值的被反复调用,没商业价值的就算开放了也没人用。

150个示范场景:申报731选50,但有几个真有用?

国家数据局自2024年10月启动公共数据"跑起来"示范场景建设。截至2026-08-25,已累计发布五批共150个示范场景。

第五批(2026-08-25发布)收到申报方案731份,遴选50个,通过率约6.8%。第五批首次有12个部委参与(中宣部、民政部、住建部等),意味着数据要素从"信息技术部门"扩散到"全政府"。

表3·公共数据"跑起来"示范场景五批演化

但150个场景里,真正产生经济社会效益的有几个?扒前四批100个场景里公开的"硬数据"案例,能筛出来的只有少数:

文旅部免证购票场景:在福建13处5A级景区推广,入园超3万人次,这是小场景,3万人次规模

海关总署跨境贸易数据协同金融助力中小微融资:通过优化大数据模型降低中小微企业融资成本,这是产业级,但官方未公布具体金额

第五批海关统计数据赋能宏观经济分析:海关总署统计分析司牵头,全国海关信息中心参与,产业级潜力

第五批"以高质量数据集赋能金融大模型精准滴灌民营企业":福建泉州,金融场景落地

对比下来会发现:有公开"硬数据"效益的场景不到10%,大部分场景只是政策指标,公布名单时只有"场景名+牵头单位+参与单位",没有"产生了多少经济价值"的量化指标。

这是扎心证据:数据开放不缺数据,也不缺场景申报,缺的是真正产生经济社会效益的产业化应用。

第五批50个场景
哪些是真信号?

扒国家数据局公布的第五批50个场景清单,可以发现一个有意思的结构,有商业驱动力的产业场景vs政策指标场景:

表4·第五批50个场景类型分类

扒清单看到的关键判断:产业级场景才有真商业驱动力。海关数据赋能宏观经济、海洋大数据助力海水养殖保险、黄芪全产业链,这些都是有金融+产业联动、能算经济账的场景。

治理级场景(困境儿童保障、大理民宿治理)虽然有价值,但公益属性强,没有商业回报,不会被市场主动用。

另一个有意思的发现:第五批首次12个部委参与(中宣部、民政部、住建部等),意味着数据要素从"信息技术部门"扩散到"全政府"。中宣部牵头"国家出版发行公共数据赋能行业应用",这是出版业数据要素化。民政部牵头"困境儿童精准保障",是社会救助数据要素化。数据要素正从IT部门走向全政府,这是2026年的新动向。

区域差异:东中部产业,西部资源

扒第五批50个场景的区域分布,能看到清晰的东西部分工:

  • 东中部聚焦民营经济、低空经济、海洋经济等前沿领域,杭州停车充电、上海大型文体旅交通保障、山东海洋大数据保险、葫芦岛低空海洋监测、泉州金融大模型滴灌民营
  • 西部立足特色农业、沿边贸易、矿产勘探等资源优势,甘肃陇西黄芪全产业链、新疆林果宝、宁夏地质大数据找矿、云南地震数据防震减灾、广西"三医"协同
  • 跨区域协作首次出现,通武廊(京津冀)交通运输数据要素一体化、西部陆海新通道(重庆)

这是个有意思的判断:东中部押产业升级,西部押资源禀赋。这不是优劣之分,是分工不同。但反过来想,西部用数据要素做差异化探索,可能比东部同质化竞争更有独家角度。甘肃陇西的"黄芪全产业链数据"是全国独一份,杭州停车充电全国都有人在做。

数据要素区域发展不是"东强西弱",而是"东产业+西资源"的差异化分工。

数据开放不缺数据,缺场景

回看30万项公共数据+150个示范场景+731选50的供给过剩,真正的问题不在数据供给,在场景驱动力。

中国公共数据开放不缺数据(30万项+48万有效数据集),不缺场景申报(第五批731份选50个),缺的是真正产生经济社会效益的产业化应用。供给过剩+申报过载≠真效益。前四批100个场景里有公开"硬数据"效益的不到10%。

判断中国公共数据开放的真实进度,不能只看供给规模(30万、48万这些数字),要看:

1.调用次数分布:明星数据集vs长尾数据集差几个数量级(上海地铁客流1.56亿次vs健身苑点17万次)

2.场景真效益:150个场景里有量化经济价值的不到10%

3.商业驱动力:产业级场景(海关+金融、海洋+保险)才有真商业回报,治理级场景(困境儿童、民宿治理)公益属性强但商业化弱

这不是说政府数据开放失败,相反,供给端的成功恰恰暴露了需求端的短板。政府把数据开放了,但市场还没想清楚怎么把数据变成生意。

下一阶段的真问题不是"再开放多少数据",而是"怎么让已有数据被市场用起来"。可能的突破方向:

  • 商业驱动场景:聚焦金融+产业联动场景(海关+中小微融资、海洋+保险、中药材+全产业链),不是民生服务
  • 授权运营落地:把"运营机构+合伙人"模式真正跑通,让第三方有利润驱动去开发数据产品
  • 定价机制明确:福建/江苏/贵州已先行出台收费标准,其他省份要跟进,价格不明确,市场不敢用

30万项公共数据,目前真正在用的,可能不到1%。这不是失败,是起点。从"开放"到"被用",中国数据要素市场还有2-3年的路要走,但方向是对的,缺的是时间和场景。

下次再看到"中国公共数据开放超X万项"的数字,多问一句:被用了多少?谁在用?产生了多少经济社会效益?,这才是数据要素市场的真问题。

文:随风 / 数据猿

责编:月满西楼 / 数据猿

 
最新文章
相关阅读