01
趋势分析
折线为年度均值
1954
5,705
1979
6,868
1988
7,750
1997
4,646
2007
4,949
2017
6,405
2026
6,931
02
样例数据
样例数据(前 10 行)
支持复制到 Excel
| 年份 | 政府工作报告总词数(词) |
|---|---|
| 1954 | 5705.0 |
| 1955 | 13702.0 |
| 1956 | 4367.0 |
| 1957 | 8054.0 |
| 1958 | 6113.0 |
| 1959 | 7354.0 |
| 1960 | 2574.0 |
| 1964 | 4594.0 |
| 1975 | 1316.0 |
| 1978 | 7881.0 |
国务院政府工作报告经jieba分词并去除标点后的词语总数。数据版本v202607。。覆盖 1 个全国、73 年连续面板,适用于面板回归、政策评估与综合评价研究。
03
指标详情
指标解释
指标定义国务院政府工作报告经jieba分词并去除标点后的词语总数。数据版本v202607。
数据类型宏观级面板数据,覆盖1个全国。
时间跨度1954-2026年,共73年连续面板数据。
应用场景
- 作为被解释变量或核心解释变量进行面板回归分析
- 结合其他指标做相关性与多元回归研究
- 分析时间趋势与区域差异
- 政策评估(DID、PSM-DID 等准自然实验)
- 构建综合评价指标体系(熵值法等)
04
技术文档
数据说明书(Data Dictionary)
数据来源
数据整理自国务院政府工作报告。经人工校验与交叉比对,确保数据准确性。
部分缺失值已通过线性插值补齐,原始数据与插值数据均可分别下载。
| 变量名 | 中文名称 | 类型 | 说明 |
|---|---|---|---|
| year | 年份 | int | 1954-2026 |
| hg-eae13c26f6d123-zhengfugongzuobaogaozongcishu-bde2fe | 政府工作报告总词数 | float | 国务院政府工作报告经jieba分词并去除标点后的词语总数。数据版本v202607。 |
数据出处
本数据来自马克集数(s.macrodatas.cn)。
引用或转载请注明来源
Stata 读取代码
下载数据后,可使用以下 Stata 代码快速读取并设定面板结构:
* 读取数据
use "hg_zhengfugongzuobaogaozongc_1954_2026.dta", clear
* 查看变量与前几行
describe
list in 1/10
* 描述性统计
summarize hg_zhengfugongzuobaogaozongc, detail
如下载的是 Excel 格式,请先在 Stata 中使用 import excel "hg-eae13c26f6d123-zhengfugongzuobaogaozongcishu-bde2fe_1954_2026.xlsx", firstrow clear 导入。
05
相关指标推荐