中国地市级与县域级极端天气数据集(2008—2026):覆盖四类极端事件的多维气候风险量化框架
一、为什么我们需要一套细到县级的极端天气数据?
入伏之后,“热”再次成为公共话题。但在学术和产业研究中,体感温度只是冰山一角——真正具有研究价值的,是覆盖城市与县域、跨越近二十年、能够同时刻画强度、持续时间与发生频率的极端天气量化指标。
单一的气温或降水序列,无法揭示区域之间、产业之间、城乡之间在气候冲击下的差异化反应。能够反映“风险暴露”的多维指标体系,是连接气候变化与微观经济行为、宏观区域发展、企业供应链稳定性的关键桥梁。
本文整理的“地市级、县域级极端天气数据指标(2008—2026)”正是在这一背景下推出的——它把分散在气象观测站中的高频数据,转化为可直接用于面板回归、双重差分、断点回归等实证方法结构化的年度指标。
二、数据能做哪些研究?
围绕这套指标,可开展的研究方向至少包括以下几条主线:
•气候风险与企业行为:检验极端天气事件对企业生产效率、供应链稳定性、经营绩效与投资决策的因果效应,识别气候冲击的微观经济传导路径。
•气候冲击与宏观发展:分析极端高温、低温、暴雨、干旱对地区经济增长、农业生产、能源消费与公共财政支出的影响,揭示气候变化在区域发展层面的作用机制。
•异质性与适应政策:在东中西部、南北方、农工服务业等不同地理与产业结构分组下,考察气候冲击的非对称性,为差异化气候适应政策与防灾减灾规划提供实证支撑。
•区域韧性评估:把极端天气总天数与总占比作为综合“风险指数”,与基础设施密度、医疗教育资源分布等指标结合,构建城市与县域层面的气候韧性评估体系。
三、指标体系如何构建?
本数据集基于地级市气候数据集与区县域气候数据集的原始气象观测,按年度汇总后参照中国气象局官方标准识别极端天气事件,最终形成四个维度、十一项年度指标的完整体系。
3.1 极端事件的判定标准
•极端高温:日最高气温 ≥ 35℃
•极端低温:日最低气温 ≤ -10℃
•极端暴雨:日降雨量 ≥ 50 毫米
•极端干旱:连续 15 天及以上无降雨
只要当日满足上述任意一种条件,即被标记为“极端天气日”。
3.2 十一项年度指标
这套指标体系同时覆盖了强度(极值温度与降雨量)、持续时间(最长连续无降雨天数)与发生频率(各类极端天数与占比)三个角度,是少有的、可直接进入计量模型的细颗粒度气候风险变量。
四、数据规格一览
五、字段说明
5.1 地市级字段
• 年份
• 省级名称 / 省级代码
• 城市名称 / 城市代码
• 年度总观测天数
• 年度极端高温天数 / 年度极端最高温度
• 年度极端低温天数 / 年度极端最低温度
• 年度极端暴雨天数 / 年度最大日降雨量
• 年度极端干旱天数 / 年度最长连续无降雨天数
• 年度极端天气总天数 / 年度极端天气总占比 (%)
图 1 北京市 2008—2026 年地市级极端天气指标预览(节选)
5.2 县域级字段
在 5.1 字段基础上,进一步细分为以下区县级变量:
• 区县名称 / 区县代码
• 其余 11 项指标与地市级完全一致,便于跨层级嵌套分析
图 2 北京市 2020—2021 年县域级极端天气指标预览(节选)
六、使用建议
在拿到这份数据之后,有几个值得注意的细节,会直接影响后续实证研究的质量:
1.匹配行政区划代码:数据中保留省级 / 市级 / 区县级的 6 位或 12 位行政区划代码,可与上市公司注册地、统计年鉴中的地级市与区县数据精准匹配,避免手工对齐带来的误差。
2.关注总观测天数:不同地区因站点建设时间差异、年内缺测等原因,年度总观测天数可能并不等于 365。建议在计算“极端天气总占比”时,使用数据集中提供的 年度总观测天数 字段作为分母,而不要直接除以 365。
3.面板结构选择:城市级与区县级面板同时存在。对于需要大样本、低异方差的宏观研究,可使用地市级面板;对于考察城乡差异、行政边界内部传导机制的研究,建议使用区县面板。
4.与气象灾害事件交叉:极端天气日只是“气象层面的极端”,可以与应急管理部公布的灾害事件库、保险公司理赔数据等进一步交叉,得到更完整的“气象—灾害—经济损失”链条。
顶部专栏分享更多内容
来源:Paper数据分析