2007年 2007 0.0005 2008年 2008 0.0005 2009年 2009 0.0000 2010年 2010 0.0005 2011年 2011 0.0005 2012年 2012 0.0005 2013年 2013 0.0006 2014年 2014 0.0004 2015年 2015 0.0004 2016年 2016 0.0004 2017年 2017 0.0005 2018年 2018 0.0005 2019年 2019 0.0005 2020年 2020 0.0009 2021年 2021 0.0006 2022年 2022 0.0010 2023年 2023 0.0008 2024年 2024 0.0012 2025年 2025 0.0008 2026年 2026 0.0013 2007年 2007 0.0005 2008年 2008 0.0005 2009年 2009 0.0000 2010年 2010 0.0005 2011年 2011 0.0005 2012年 2012 0.0005 2013年 2013 0.0006 2014年 2014 0.0004 2015年 2015 0.0004 2016年 2016 0.0004 2017年 2017 0.0005 2018年 2018 0.0005 2019年 2019 0.0005 2020年 2020 0.0009 2021年 2021 0.0006 2022年 2022 0.0010 2023年 2023 0.0008 2024年 2024 0.0012 2025年 2025 0.0008 2026年 2026 0.0013
首页/ 中国宏观/ 核心数据库/ 政府工作报告文本/ 数据资产化/ 数据资产化词频TF-IDF最大值
Panel Dataset — 宏观级面板数据

中国宏观数据资产化词频TF-IDF最大值面板数据(1954-2026)

参考何瑛(2024)构建的数据资产化关键词词典(共221个关键词),对国务院政府工作报告进行jieba分词后,基于全语料TF-IDF模型计算词典内各关键词TF-IDF值的最大值。数据版本v202607。。数据整理自国务院政府工作报告。

VIP数据 全国 更新 2026-07-28 1954-2026 · 73年 Excel / Stata
2026
覆盖年份
1954–2026
共 73 年连续面板
有效样本
58
缺失率 0.0%
覆盖主体
1
全国数量
指标类型
VIP
支持预览与下载
01 趋势分析
0.0013 0.0010 0.0006 0.0003 0.0000 1954 1980 1992 2003 2015 2026
折线为年度均值
1954
0.0000
1979
0.0000
1988
0.0000
1997
0.0000
2007
0.0005
2017
0.0005
2026
0.0013
02 样例数据
样例数据(前 10 行) 支持复制到 Excel
年份 数据资产化词频TF-IDF最大值
1954 0.0
1955 0.0
1956 0.0
1957 0.0
1958 0.0
1959 0.0
1960 0.0
1964 0.0
1975 0.0
1978 0.0
参考何瑛(2024)构建的数据资产化关键词词典(共221个关键词),对国务院政府工作报告进行jieba分词后,基于全语料TF-IDF模型计算词典内各关键词TF-IDF值的最大值。数据版本v202607。。覆盖 1 个全国73 年连续面板,适用于面板回归、政策评估与综合评价研究。
03 指标详情

指标解释

指标定义

参考何瑛(2024)构建的数据资产化关键词词典(共221个关键词),对国务院政府工作报告进行jieba分词后,基于全语料TF-IDF模型计算词典内各关键词TF-IDF值的最大值。数据版本v202607。

数据类型

宏观级面板数据,覆盖1个全国。

时间跨度

1954-2026年,共73年连续面板数据。

应用场景

  • 作为被解释变量或核心解释变量进行面板回归分析
  • 结合其他指标做相关性与多元回归研究
  • 分析时间趋势与区域差异
  • 政策评估(DID、PSM-DID 等准自然实验)
  • 构建综合评价指标体系(熵值法等)
04 技术文档
数据说明书(Data Dictionary)
数据来源

数据整理自国务院政府工作报告。经人工校验与交叉比对,确保数据准确性。

部分缺失值已通过线性插值补齐,原始数据与插值数据均可分别下载。

变量名 中文名称 类型 说明
year 年份 int 1954-2026
hg-eae13c26f6d1236eda4b2-shujuzichanhuacipintfidfzuidazhi-a54d7a 数据资产化词频TF-IDF最大值 float 参考何瑛(2024)构建的数据资产化关键词词典(共221个关键词),对国务院政府工作报告进行jieba分词后,基于全语料TF-IDF模型计算词典内各关键词TF-IDF值的最大值。数据版本v202607。
数据出处
本数据来自马克集数(s.macrodatas.cn)。
引用或转载请注明来源
Stata 读取代码

下载数据后,可使用以下 Stata 代码快速读取并设定面板结构:

Stata 复制代码
* 读取数据
use "hg_shujuzichanhuacipintfidfz_1954_2026.dta", clear

* 查看变量与前几行
describe
list in 1/10

* 描述性统计
summarize hg_shujuzichanhuacipintfidfz, detail

如下载的是 Excel 格式,请先在 Stata 中使用 import excel "hg-eae13c26f6d1236eda4b2-shujuzichanhuacipintfidfzuidazhi-a54d7a_1954_2026.xlsx", firstrow clear 导入。

05 相关指标推荐
数据预览
加载中...