国家绿色数据中心试点政策 DID 数据(地级市 + 上市公司双层面,2000-2025)
数据中心是能耗大户,也是"双碳"研究里绕不开的政策对象。2015 年,工业和信息化部等部门启动"国家绿色数据中心"试点工作,通过评价认定绿色数据中心,引导行业向高效、低碳、集约化方向发展。这批分批公布的试点名单,构成了一个典型的准自然实验——刘传明和朱凯(2025)等研究即以"国家绿色数据中心建设"作为绿色算力基础设施建设的有效代理变量开展因果识别。
这份整理好的数据集把各批次试点名单转换成了地级市与上市公司两个层面的 DID 明细数据,覆盖 2000-2025 年,拿来即可回归。
DID 变量构造规则
两个层面的处理组赋值逻辑一致,均为标准的政策冲击虚拟变量:
•地级市层面:若某地级市属于国家绿色数据中心政策试点城市,则自其入选年份及以后赋值为 1,否则为 0;
•上市公司层面:若上市公司注册地所在城市属于政策试点城市,则自该城市入选年份及以后赋值为 1,否则为 0。
由于各批次试点时间不同,两组数据天然构成多期 DID(渐进 DID)结构,处理组在不同年份分批进入政策状态。
数据规格
字段说明
地级市层面:年份、省份、城市、省份代码、城市代码、所属地域、胡焕庸线、最早试点年份、是否试点城市、DID。
其中"胡焕庸线"字段可用于做东西部差异或地理分界相关的异质性分析,是一个比较贴心的设计。
上市公司层面:id、年份、股票代码、公司简称、行业、行业代码、省份、城市、区县、省份代码、城市代码、区县代码、试点年份、是否试点城市、DID。
公司层面同时提供行业与区县代码,方便直接匹配行业层面控制变量或做区县尺度的稳健性检验。
各批次国家绿色数据中心试点名单示例
地级市层面 DID 明细数据示例
上市公司层面 DID 明细数据示例
适用研究方向
结合已有文献,这套数据至少可以支撑三类题目:
1. 绿色低碳效应评估
参照裴馨(2025)的思路,考察绿色数据中心试点对碳减排、能源效率的影响;地级市面板可与城市碳排放、能耗数据匹配。
2. 企业行为响应
参照侯普光(2026)的研究,检验试点政策对企业绿色创新(包括绿色创新泡沫的治理)的作用;上市公司面板已含行业与注册地信息,便于直接对接企业专利、年报文本数据。
3. 绿色算力与区域发展
参照刘传明、朱凯(2026)的做法,把试点作为绿色算力基础设施的代理变量,研究其对包容性绿色发展效率等宏观指标的影响。
使用提示:政策于 2015 年启动、分批推开,属于典型的多期 DID 场景。建议在基准回归之外补充平行趋势检验,并使用异质性稳健估计量(如 Callaway & Sant'Anna、Sun & Abraham 或堆叠 DID)应对传统双向固定分定效应估计的潜在负权重问题;上市公司层面还可将注册地非试点城市的企业作为控制组做 PSM-DID 稳健性检验。
参考文献
[1] 刘传明, 朱凯. 绿色算力基础设施建设对包容性绿色发展效率的影响[J]. 中国农村经济, 2026(5): 161-184.
[2] 侯普光. 国家绿色数据中心建设对企业绿色创新泡沫的治理效应研究[J]. 软科学, 2026, 40(5): 44-51.
[3] 裴馨. 国家绿色数据中心的碳减排效应:理论分析与经验证据[J]. 中国人口·资源与环境, 2025, 35(11): 37-47.
数据来源:工业和信息化部等国家部委发布的国家绿色数据中心各批次试点名单
引用格式:[1]刘传明,朱凯.绿色算力基础设施建设对包容性绿色发展效率的影响[J].中国农村经济,2026,(5):161-184. [2]侯普光.国家绿色数据中心建设对企业绿色创新泡沫的治理效应研究[J].软科学,2026,40(5):44-51. [3]裴馨.国家绿色数据中心的碳减排效应:理论分析与经验证据[J].中国人口·资源与环境,2025,35(11):37-47.
顶部专栏分享更多内容
专栏合集:经管社科数据集合与整理
来源: Paper 数据分析