平安银行 2025 0.0048 万科A 2025 0.0020 *ST 国华 2025 0.0105 深振业A 2025 0.0011 全新好 2025 0.0017 神州高铁 2025 0.0066 中国宝安 2025 0.0012 美丽生态 2025 0.0015 深物业A 2025 0.0076 南玻A 2025 0.0027 沙河股份 2025 0.0005 深康佳A 2025 0.0069 深中华A 2025 0.0054 深粮控股 2025 0.0061 深华发A 2025 0.0015 深科技 2025 0.0083 特力A 2025 0.0045 飞亚达 2025 0.0048 深圳能源 2025 0.0013 国药一致 2025 0.0056 平安银行 2025 0.0048 万科A 2025 0.0020 *ST 国华 2025 0.0105 深振业A 2025 0.0011 全新好 2025 0.0017 神州高铁 2025 0.0066 中国宝安 2025 0.0012 美丽生态 2025 0.0015 深物业A 2025 0.0076 南玻A 2025 0.0027 沙河股份 2025 0.0005 深康佳A 2025 0.0069 深中华A 2025 0.0054 深粮控股 2025 0.0061 深华发A 2025 0.0015 深科技 2025 0.0083 特力A 2025 0.0045 飞亚达 2025 0.0048 深圳能源 2025 0.0013 国药一致 2025 0.0056
首页/ 企业数据/ 核心数据库/ 新质生产力/ 数据要素/ 数据要素MD&A词频和占总词数比例
Panel Dataset — 企业级面板数据

中国企业数据要素MD&A词频和占总词数比例面板数据(2001-2025)

参考戴魁早(2024)构建的数据要素关键词词典(共56个关键词),对上市公司年报"管理层讨论与分析"(MD&A)部分进行jieba分词后,统计词典内关键词出现的总次数并除以该文本的总词数。数据版本v202607。。数据整理自上市公司年报-管理层讨论与分析。

精选数据 上市公司 更新 2026-07-28 2001-2025 · 25年 Excel / Stata
2025
覆盖年份
2001–2025
共 25 年连续面板
有效样本
69,772
缺失率 2.0%
覆盖主体
2,791
上市公司数量
指标类型
精选
支持预览与下载
01 趋势分析
0.0055 0.0043 0.0030 0.0018 0.0006 2001 2006 2011 2015 2020 2025
折线为年度均值
2001
0.0012
2005
0.0008
2009
0.0008
2013
0.0016
2017
0.0033
2021
0.0048
2025
0.0052
02 样例数据
样例数据(前 10 行) 支持复制到 Excel
年份 股票代码 股票简称 行业名称 城市 数据要素MD&A词频和占总词数比例
2001 000005 世纪星源 综合 深圳市 0.0024
2001 000006 深振业A 房地产业 深圳市 0.0
2001 000007 ST 达声 房地产业 深圳市 0.0
2001 000013 深石化A 批发业 深圳市 0.0
2001 000016 深康佳A 计算机、通信和其他电子设备制造业 深圳市 0.0044
2001 000018 深中冠A股 纺织业 深圳市 0.0015
2001 000019 深深宝A 酒、饮料和精制茶制造业 深圳市 0.0
2001 000024 招商局A 房地产业 深圳市 0.0013
2001 000026 飞亚达A 专用设备制造业 深圳市 0.0015
2001 000028 一致药业 医药制造业 深圳市 0.0
参考戴魁早(2024)构建的数据要素关键词词典(共56个关键词),对上市公司年报"管理层讨论与分析"(MD&A)部分进行jieba分词后,统计词典内关键词出现的总次数并除以该文本的总词数。数据版本v202607。。覆盖 2,791 个上市公司25 年连续面板,适用于面板回归、政策评估与综合评价研究。
03 指标详情

指标解释

指标定义

参考戴魁早(2024)构建的数据要素关键词词典(共56个关键词),对上市公司年报"管理层讨论与分析"(MD&A)部分进行jieba分词后,统计词典内关键词出现的总次数并除以该文本的总词数。数据版本v202607。

数据类型

企业级面板数据,覆盖2,791个上市公司。

时间跨度

2001-2025年,共25年连续面板数据。

应用场景

  • 作为被解释变量或核心解释变量进行面板回归分析
  • 结合其他指标做相关性与多元回归研究
  • 分析时间趋势与区域差异
  • 政策评估(DID、PSM-DID 等准自然实验)
  • 构建综合评价指标体系(熵值法等)
04 技术文档
数据说明书(Data Dictionary)
数据来源

数据整理自上市公司年报-管理层讨论与分析。经人工校验与交叉比对,确保数据准确性。

部分缺失值已通过线性插值补齐,原始数据与插值数据均可分别下载。

变量名 中文名称 类型 说明
year 年份 int 2001-2025
stock_code 股票代码 string 编码
stock_name 股票简称 string 股票简称
industry_name 行业名称 string 所属行业
city 城市 string 地级市名称
firm-2c57091b719b5486853d3-shujuyaosumdacipinhezhanzongcishubili-7fd8c5 数据要素MD&A词频和占总词数比例 float 参考戴魁早(2024)构建的数据要素关键词词典(共56个关键词),对上市公司年报"管理层讨论与分析"(MD&A)部分进行jieba分词后,统计词典内关键词出现的总次数并除以该文本的总词数。数据版本v202607。
数据出处
本数据来自马克集数(s.macrodatas.cn)。
引用或转载请注明来源
Stata 读取代码

下载数据后,可使用以下 Stata 代码快速读取并设定面板结构:

Stata 复制代码
* 读取数据
use "firm_shujuyaosumdacipinhezha_2001_2025.dta", clear

* 查看变量与前几行
describe
list in 1/10

* 编码企业变量(如尚未编码)
encode stock_code, gen(firm_id)

* 设定面板数据结构
xtset firm_id year

* 描述性统计
summarize firm_shujuyaosumdacipinhezha, detail

* 简单面板回归示例
xtreg firm_shujuyaosumdacipinhezha x1 x2, fe
estimates store fe_model

如下载的是 Excel 格式,请先在 Stata 中使用 import excel "firm-2c57091b719b5486853d3-shujuyaosumdacipinhezhanzongcishubili-7fd8c5_2001_2025.xlsx", firstrow clear 导入。

05 相关指标推荐
数据预览
加载中...