← 上一章📖 目录下一章 →

第七章 数智分析在应用统计中的应用


章首:统计学没有过时,它只是换了个舞台

数字化转型指数平台上,两家公司的得分并排陈列:一家6.22,一家37.74。大多数来访者会问"谁更高",少数人会追问"这个数字是怎么算出来的"。本章打算认真对待后一个问题——因为一个无法解释来源的数字,与一个拍脑袋的评分,在统计学的尺子下并没有区别。判断一个数可信不可信,需要一套标准:描述是否准确、推断是否可靠、指标是否合理。这套标准,正是统计学两百年来积攒下来的家当。

这个追问在统计学的历史上并不新鲜。两百年前,天文学家面对一堆观测值,追问"哪一个是真值";一百年前,生物统计学家面对一列测量数据,追问"差异来自处理还是来自偶然";今天,面对AI吐出的一个指数,问题变成了"这个数可信吗、可复现吗、怎么来的"。问题换了马甲,追问的结构始终如一:把"感觉"变成"证据",把"说法"变成可检验的判断。

也常有人问:有了大模型和零代码平台,统计学是不是可以退休了?答案恰恰相反——大模型越强大,统计学越重要。AI生成的分析结论是否可信,最终要靠统计学的尺子去量;平台负责算,你负责懂,而"懂"的根基在统计。统计学的角色已经变化:从"手工计算"升级为"判断标准",从幕后走到台前。

这段历史的起点,可以追溯到1901年:Pearson在《哲学杂志》上提出用"最接近的直线与平面"拟合数据点云,奠定了主成分分析的思想雏形[1];1933年,Hotelling给出了完整的数学框架,把"找方差最大的投影方向"变成可计算的算法[2];一个世纪后,Jolliffe将其系统化为现代统计教科书的标准内容[3]。与PCA几乎同步成长的,是面板数据分析——Hsiao等将其发展为计量经济学的支柱方法[4]。这些方法在数智时代重获关注,是因为它们正在回答真实的经济问题:吴非等(2021)用上市公司年报文本的词频构建数字化转型指标,发现数字化转型显著改善了股票流动性、提升了资本市场表现[5];流动性的度量传统,可追溯至Amihud与Mendelson对买卖价差的经典研究[6];数字金融的兴起则为这条链条注入新的变量,唐松等(2020)发现数字金融通过缓解融资约束促进企业技术创新[7]

本章把统计学放回数智分析的舞台中央,分两幕展开。第一幕是描述统计与推断分析:71907条企业-年份面板数据的描述性统计、全量计算与抽样推断的对比验证——回答"数据长什么样、结论是否可靠";第二幕是多元统计实战:用主成分分析把33个词频指标压缩成一个数字化转型指数——回答"多维指标如何合成一个数"。两幕共用一条主线:第5、6章加工的全量面板与年报词频库。你会看到,描述统计、抽样推断、PCA这些经典方法,如何在零代码平台上"一键运行",而判断的分量,依然压在人的肩上。统计学没有过时,它只是换了个舞台。


第一节 描述性统计与推断分析

这一节的核心主张:描述统计回答"数据长什么样",推断统计回答"结论可不可信"——数智平台让两者从"手算"变成"一键",但判断仍然在人。

数智分析对统计实验设计的迭代升级

传统统计实验设计的流程是:提出假设→设计问卷或实验→收集样本→手工或软件分析。这条流程本身没有问题,问题出在它的"供给侧":样本难找、周期漫长、数据一锤定音,改口径就要重来。数智平台把这条流程升级为:数据服务在线(随时取数)→面板数据就绪(跨年跨行业)→一键生成统计摘要(描述+推断)→对比验证(全量vs抽样)。以本书的数字化转型指数数据为例:1999—2025年的71907行×33列全量面板已经入库,任何一次统计检验都可以在秒级完成,任何一次口径调整都可以推倒重算。传统流程还有一个代价:样本的"一次性"——问卷发出去、实验做完,数据用完即弃,结论难以复核。数智平台的面板数据常驻在线,同一批数据可以被不同的人、用不同的方法反复检验——可复现性,正是统计结论可信度的第一道防线。

统计实验设计最大的变化,在于"实验"与"数据"的次序:过去先设计再采集,数据是一次性的;现在数据常驻在线,实验可以反复设计——同一个面板,今天验证这个假设,明天验证那个假设,口径一致,结果可复现。升级发生在统计的"供给侧"——数据更多、更快、更全,统计原理本身原封不动。这个区分很重要:平台没有发明新的均值公式,它让均值"算得起";平台也没有改写置信区间的定义,它让区间"看得见"。数智化改变的是统计的规模与速度,统计的判断逻辑依然是那套百年老规矩。 理解这一点,才不会在工具的便利中丢掉方法的根基。对学习者而言,这场升级还有一个额外的红利:统计概念第一次可以"亲手摸到"。教科书里的大数定律、中心极限定理、置信区间,过去要靠纸笔演算才能体会;现在,改变一个抽样参数、点一次运行,规律就直观地呈现在眼前。工具的升级让抽象的概念获得可触摸的形态——这或许是数智平台带给统计教学最深的变化。

描述性统计:三组指标读懂数据全貌

描述统计用少数指标概括一组数据的全貌,指标家族可以按功能分成三组,每一组回答一个不同的问题。对71907行的面板而言,描述统计还是所有后续分析的"安检口":先看均值与标准差,再决定是否进入相关分析、PCA——跳过这一步直接建模,往往要回头补课。

集中趋势回答"数据大致在什么位置":均值(易受极端值影响)、中位数(稳健)、众数(分类数据适用)。词频分布通常右偏——少数公司大谈特谈数字化,多数公司寥寥数语——此时中位数比均值更能代表"典型公司",而均值会被那几家高频公司拉高。在词频库里,少数头部公司动辄数百次的词频,会把均值"抬高"到多数公司够不着的位置;中位数给出的,才是多数公司的常态。三者的取舍取决于数据类型与分布形态:分类数据没有均值可言,众数是唯一选择;偏斜分布里,中位数比均值稳健;对称分布里,三者趋于一致。一个值得养成的习惯是同时报告均值与中位数——两者差距越大,分布越偏斜,"平均值"的误导性就越强。

离散程度回答"数据波动有多大":标准差(数据围绕均值的波动)、四分位距IQR(稳健的离散度量,第6章异常值检测的基础)、极差(最粗糙的离散度量)。使用要点只有一条:报告均值时务必同时报告标准差——只说"平均词频0.32"而不说波动,等于只说了一半事实。2025年报口径下,邮政行业数字化转型指数均值37.74、软件行业36.85,两者相差不到1分;若只看均值,会以为两个行业的转型程度几乎相同。标准差会告诉你真相:一个行业内部齐整、一个行业两极分化,均值相近的两个行业,背后的结构可能截然不同。极差只取最大值与最小值之差,两个极端值就能把它完全决定,因此仅作粗略参考;四分位距取第75与第25百分位之差,不受极端值影响,第6章的异常值检测正是以这类稳健度量为基础的。

分布形态回答"数据长什么样":偏度(分布是否对称)、峰度(分布是否尖峭)。它揭示的是被均值"掩盖"的极端结构:偏度为正说明右尾拖长,峰度偏高说明极端值比正态分布预期得更频繁——这两条信息,均值与标准差都给不了。以词频为例:若偏度为正,说明少数公司把分布右尾拖得很长——头部公司的高词频是"拉高均值"的主力;若峰度偏高,说明极端值出现的频率高于正态预期,"异常高频"的公司比想象中更多。这两条信息,直接关系到第6章异常值检测的阈值设置。三组指标合在一起,才构成数据的完整画像。

描述统计的价值在于"压缩":把几千行的表压成几个数。压缩必然有损——它牺牲了细节,换来了可读性。因此统计学有一条铁律:先画图、再算数、数图互证。这条纪律由Tukey在1977年的《探索性数据分析》中确立:任何正式建模之前,先通过图形探索数据[8]。它最著名的实证支撑来自Anscombe在1973年构造的经典例子——四组数据的均值、方差、相关系数与回归线几乎完全相同,画出来却是直线、抛物线、带离群点与被单点拉动四种截然不同的形态[9]。只看统计量,四个数据集无法区分;只有看图,真相才浮现。描述统计的边界就在这里:它告诉你数据"大致如何",而图形告诉你数据"究竟如何"。

推断统计的数智化实现

描述统计解决"数据长什么样",推断统计解决"结论可不可信"。推断统计回答两个具体问题:总体参数大概在什么范围(置信区间),差异是否统计显著(假设检验)。两者的机制都建立在"抽样分布"这个中间概念上:总体参数是固定的,样本统计量是随机的,统计量的分布就是抽样分布。置信区间与假设检验,正是围绕抽样分布展开的两种问法——前者问"参数可能在哪",后者问"假设还站得住吗"。

置信区间把点估计(一个数)换成区间估计(一个范围):在给定置信水平下,总体参数的可能范围。同样一个均值,"0.32"与"0.32±0.03"承载的信息量完全不同——前者是孤证,后者带着不确定性的刻度。95%置信区间的频率解释值得记住:重复抽样100次,约95个区间会覆盖总体参数。这个"重复抽样"的视角,是理解置信区间的钥匙——它承认不确定性,并把不确定性量化。把这一套放到行业对比上:邮政与软件行业的指数均值存在差异,这个差值本身是一个点估计;若再给出它的置信区间,你才知道这个差值有多"稳"——区间越窄,结论越可靠;区间若跨越0,差异是否真实存在就要打上问号。读懂AI输出的"±0.03",意味着你理解了抽样误差的存在与大小。置信区间与假设检验本是一枚硬币的两面:若总体参数的95%置信区间不包含某个假设值,则对应的检验在5%显著性水平下会拒绝原假设——两种问法,共用同一套抽样分布。

假设检验是一套标准的裁判流程:提出原假设(如"两行业均值无差异")与备择假设→计算检验统计量→得到p值→与显著性水平α比较(如图7-1所示)。p值的含义需要反复澄清:它是在原假设为真的前提下,观察到当前或更极端结果的概率。p值小,说明"原假设为真"这个前提与数据不太相容——仅此而已。以"邮政与软件行业均值是否有差异"为例:原假设是"两行业均值无差异",检验统计量由样本数据算出,p值回答"如果两行业真的无差异,出现当前这种差距的概率有多大"。p值小于0.05,我们就有理由拒绝原假设——注意措辞,是"有理由拒绝","证明了两行业有差异"的说法过于绝对。p值并不度量效应的大小,也不度量结论的实际重要性:样本量足够大时,任何微小差异都可能"统计显著",而"统计显著"与"实际重要"之间,隔着人的判断。

p < αp α

提出原假设H0
与备择假设H1

计算检验统计量

得到p值

p 与显著性水平 α 比较

拒绝原假设
差异统计显著

不能拒绝原假设
差异统计不显著

图7-1 假设检验的标准流程

裁判流程也会判错:原假设为真却被拒绝,是第一类错误,概率由α控制;原假设为假却未拒绝,是第二类错误。显著性水平α,就是人为设定的第一类错误上限——选0.05还是0.01,取决于你愿意为"冤枉"一个好结论承担多大风险。把p值当"真理概率"、把显著性当"重要性",是统计学课堂上最常见的两种误读。误读的根源,在于把一套概率裁判流程当成了终审判决。推断统计的全部价值,在于把"我觉得有差异"翻译成"数据显示有差异,且出错概率可控"——它保证结论可检验、可复现、可质疑。

全量vs抽样:把大数定律变成看得见的实验

推断统计的诞生,源于一个不得已:总体太大,只能抽样。数智时代出现了一个微妙的反转——当平台可以全量计算时,抽样从"替代全量"的权宜之计,变成了"验证理解"的教学工具。本书的全量vs抽样对比实验,正是这一反转的直观呈现:同一指标,先算全量71907条面板的均值,再随机抽样5000条计算均值,比较两者差异(如图7-2所示)。

抽样推断全量计算

71907条企业-年份面板
1999—2025

直接计算总体参数

均值 · 标准差 · 指数
结果唯一且确定

随机抽样5000条

由样本估计总体

置信区间 · p值
结果带不确定性

对比验证

样本量越大
抽样结果越接近全量

图7-2 全量计算与抽样推断的对比实验

这个实验背后的两条定律,值得单独拿出来思辨。大数定律:样本量越大,样本均值越接近总体均值——实验里"样本量越大越接近全量"的肉眼可见规律,就是它的通俗形态。中心极限定理:无论总体分布如何,样本均值的抽样分布都近似正态——词频分布明明右偏,抽样均值的分布却会"长成"钟形,这正是置信区间可以用正态分布近似的基础。两条定律合起来,回答了一个根本问题:为什么抽样可以用? 答案在于随机性本身有规律——单个样本不可预测,样本统计量却遵循稳定的概率分布。实验里还有一个值得动手的细节:抽样方式。最简单的随机抽样,每一条记录被抽中的概率相同;分层抽样则先按行业分组,再从每组内按比例抽取,保证小行业也有代表。两种方式抽出的5000条,均值都会向全量收敛,收敛的速度与方式却略有差异——这个差异本身,就是统计学教材里"抽样设计"一节的活教材。值得说明的是,面板的33列除了词频与指数指标,还包括年份、行业、注册地等属性字段——抽样实验可以按行业、按年份分层展开,这为"抽样设计"的讨论提供了现成的实验场。

全量vs抽样实验的教学价值,正在于把这两条定律从公式变成现象。抽样误差有多大、样本量如何影响精度、置信区间为何是那个宽度——这些原本抽象的问题,在"全量对照"下变得一目了然。更进一步,这个实验还回答了"样本量取多少合适"的实务问题:通过数据服务取数后逐步加大样本量,你会亲眼看到误差缩小的边际收益递减——从500条加到5000条收益明显,从5000条加到10000条收益趋缓。这个肉眼可见的规律,比任何公式都更能帮你理解"样本量设计"的分寸。抽样在数智时代有了新的身份:它从"没有办法的办法",变成理解数据规律的显微镜。 当平台可以全量计算时,推断统计的用武之地也随之迁移——它把"总体参数是多少"的估计问题,让位给"抽样误差有多大、样本能否代表总体"的验证性问题:全量数据之下,均值的差异是既定事实,无需推断;推断的价值,转向检验"抽样是否忠实于总体"。平台上的对比实验,正是为理解这一点而设。

在平台上验证

打开数字化转型指数平台(数字化转型指数平台),输入贵州茅台(600519),查看它的历年指数走势与统计分析:最高指数38.08、最低指数0.00、平均指数10.22、指数增长+6.22——描述统计的核心指标一览无余。行业层面的统计摘要来自数字化转型指数API:调用行业概览端点,可以取回2025年报口径的各行业指数均值(邮政业37.74、软件和信息技术服务业36.85、互联网和相关服务26.89),行业之间的离散程度一目了然。至于"全量vs抽样"实验:平台开放71907条全量面板数据,通过数据服务取回后自行抽样对比,你会直观看到——样本量越大,抽样均值越接近全量均值,这条肉眼可见的规律,就是大数定律。


第二节 多元统计分析实战:数字化转型指数构建

这一节的核心主张:指数构建的本质是"降维"——用PCA把33个词频指标压缩成一个可比较的数字化转型指数,而权重由数据自身的结构所决定,与主观赋权无关。

从文本到指数的完整链路

数字化转型指数绝非拍脑袋的分数,它是一条完整链路的产物:年报文本(第5章采集)→词频统计(33个数字化相关关键词)→词频占比(消除篇幅差异)→标准化(统一尺度)→PCA降维(提取共同因子)→指数合成(第一主成分载荷赋权)→归一化(0-100指数)(如图7-3所示)。链路的每一步都有统计学的依据。词频占比解决的是一个现实问题:年报篇幅有长有短,直接比较词频会偏向话多的公司;把绝对次数变成相对密度,篇幅差异就不再干扰比较。这一步看似朴素,却是整条链路里最容易出错的地方之一——口径不统一,后面的标准化、降维都会在错误的地基上运行。PCA则是其中最关键的枢纽:它把33个高度相关的词频指标,压缩为少数几个互不相关的主成分,再用第一主成分的得分合成指数。

年报词频库
10497行词频记录

词频统计
33个关键词

词频占比
消除篇幅差异

标准化
Z-score

PCA降维
第一主成分

指数合成
0-100

行业对比 · 年度趋势

图7-3 数字化转型指数构建链路

为什么是年报词频:一种可验证的测度

链路的起点,是"用年报词频度量数字化转型"这一判断。这个判断并非本书杜撰,它沿袭了一条成熟的学术脉络:吴非等(2021)在《管理世界》的研究中,以上市公司年报中数字化相关词汇的词频构建企业数字化转型指标,并验证了它与股票流动性、资本市场表现之间的显著正向关系[5]。该研究给出的启示是:年报里密集出现的数字化词汇,是企业实质性推进转型的"痕迹"——文本词频因此成为可验证、可复现的转型测度。

本书把这一思路落成数据产品:从2024年5467家、2025年5030家上市公司年报中统计33个数字化关键词的词频,建成10497行的词频库,覆盖人工智能、大数据、云计算、区块链、数字化应用等维度。33个关键词并非随意罗列:它们分属五个维度,既覆盖数字技术的通用词汇,也包含行业应用层面的具体表述——宽窄搭配,才能在"谈得多"与"做得深"之间取得平衡。词频数据有一个值得注意的特征:维度之间高度相关。在平台上实测五个维度与指数的相关系数:云计算0.5572、人工智能0.414、区块链0.5631、大数据0.2454、数字化应用0.5798——全部为正且多数在0.4以上,说明五个维度同声相应、同气相求,共同指向"数字化转型"这一潜在特质。这正是PCA可以施展的前提:如果变量之间毫无相关,压缩就无从谈起。

数据标准化:为什么必须做

PCA对变量的尺度极其敏感:如果"数字化转型"词频是百分位量级而"营收"是亿级,PCA会优先"照顾"方差大的变量,结果失真。因此标准化(Z-score)是PCA的前置工序——第6章"统一尺度"的原理在这里直接落地:不标准化,PCA就变成了"比谁数字大"的比赛。标准化后的每个指标,均值为0、方差为1——无论原始词频是几十还是几百,都在同一把尺子上。本书指数的33个词频指标全部标准化后进入PCA,保证每个指标在降维中"平等发言"。顺带说明,标准化与归一化(min-max缩放)常被混用:归一化把数据压到0-1区间,保留原始分布的形状;Z-score标准化把数据变为均值为0、方差为1,适合PCA这类依赖方差结构的方法。两者都消除量纲,用途不同,选择取决于方法的需要。

标准化还处理了一个更隐蔽的问题:33个关键词的使用频率基数不同。"数字化应用"这类宽泛词汇出现频次天然高于"区块链"这类具体词汇,若不消除量纲差异,PCA会把"谁说得勤"误当成"谁转型深"。标准化的要义,在于让每个指标回到同一把尺子上,再谈共同结构。

PCA:从Pearson的直线到第一主成分载荷赋权

PCA的核心思想是找方差最大的投影方向。这一思想可以追溯到1901年:Pearson提出用"最接近的直线与平面"拟合数据点云,让投影后的点尽量分散[1];1933年,Hotelling给出了完整的数学框架,把"找方差最大的投影方向"化为特征值分解问题,并命名为"主成分分析"[2];Jolliffe在2002年的专著中将其系统化为现代统计的标准工具[3]。从几何上看,第一主成分(PC1)是数据变异最大的方向;从统计上看,PC1的载荷(各指标在PC1上的系数)反映了指标间的共同结构——载荷大的指标,正是33个词频中"共同变动"的核心。第一主成分的解释方差,衡量的是这一个方向承载了多少原始信息;解释方差越高,压缩的代价越小。主成分的载荷有正有负:正载荷意味着该指标与主成分同向变动,负载荷意味着反向——在指数构建中,若某个关键词的载荷为负且绝对值可观,就需要回到词频统计环节检查口径,这一步是PCA落地时最容易被忽略的体检。第二、第三主成分同样承载信息,只是在指数构建中,第一主成分已经解释了绝大部分共同变动,后续主成分往往对应个别指标的独有波动。

本书指数用PC1的载荷作为各词频指标的权重。 这个赋权方式的统计学含义值得反复品味:专家打分,权重取决于打分者的主观判断;PCA赋权,权重由数据自身的结构所决定。权重大的指标,是数据自己"选"出来的——同涨同落最明显的词频位列前茅,评审席上的嗓门在这里没有席位。这一做法区别于主观赋权与等权平均,它让指数构建可复现、可检验:任何人拿到同样的词频库,都能算出同样的指数。

降维的必要性还有一层方法论支撑:Guyon与Elisseeff在2003年对变量与特征选择的综述中指出,去除无关与冗余变量,能显著提升模型的性能与可解释性[10]。33个高度相关的词频指标直接进入任何后续分析,都会带来冗余与噪声;PCA作为特征提取的一种,把它们压缩成一维,损失的仅是次要信息,留下的是共同结构。降维的哲学,在于承认"少即是多":一个解释得清的数,胜过三十三个说不明的数。 主成分还有一个诊断用途:解释方差的累计曲线可以帮助判断"取几个主成分"——曲线在某个位置趋于平缓,说明再往下取,增加的只是噪声。

当然,也要清醒地看到PCA赋权的边界:权重由数据决定,但"选哪33个关键词"仍然是人的判断。统计方法消解的是权重环节的主观性,它消解不了选题环节的主观性——方法让过程透明,判断仍然在人。

指数合成与归一化

得到各企业的PC1得分后,做两步收尾:指数合成——把PC1得分线性变换为0-100的指数值;归一化——保证不同年份、不同行业可比。最终,每家上市公司都得到一个"数字化转型指数":以2025年报口径为例,邮政行业均值37.74、软件行业36.85、互联网行业26.89,而贵州茅台(600519)的指数为6.22——行业之间、公司之间的差距,被压缩进同一个刻度。行业均值、TOP10、年度趋势,全部可以计算与对比。0-100的刻度还有一个好处:它让"分数"获得了直觉含义——6.22与37.74的差距,一眼就能读出量级;原始PC1得分则可以是任意实数,负值、小数,缺乏这种直观性。线性变换不改变企业之间的相对次序,只改变刻度,这是它作为"合成"手段的稳妥之处。指数的价值要在后续分析中兑现:行业均值、龙头识别、趋势追踪,都可以在数字化转型指数平台上直接查询与对比。

在平台上验证

打开数字化转型指数平台(数字化转型指数平台),输入600519,查看贵州茅台6.22的指数与年度趋势。行业对比与维度相关的统计摘要,则来自数字化转型指数API:行业概览端点给出2025年报口径各行业指数均值与排名——邮政业37.74、软件和信息技术服务业36.85、互联网和相关服务26.89;维度相关端点给出五个维度与指数的相关系数——云计算0.5572、人工智能0.414、区块链0.5631、大数据0.2454、数字化应用0.5798。你看到的是一份可追溯的排名——文本→词频→标准化→PCA→指数,每一步都有据可查。 平台背后是数字化转型指数API的12个数据端点——指数查询、行业概览、年度趋势、维度相关、ESG维度均可编程取数。指数因此既是页面上的排名,也是一份可被反复调用的数据资产。


(如图7-4所示)

图7-4 上市公司数字化转型指数查询系统页面渲染:按股票代码查询历年指数趋势与统计分析
扫码访问数字化转型指数平台扫码访问数字化转型指数平台
图7-4 数字化转型指数平台页面渲染

章末小结与追问

本章把应用统计放回数智分析的中心。第一节先讲描述统计——集中趋势、离散程度、分布形态三组指标,配合"先画图、再算数"的EDA纪律[8][9],回答"数据长什么样";再讲推断统计——置信区间、假设检验与p值,配合全量vs抽样的对比实验,把大数定律与中心极限定理变成看得见的规律,回答"结论可不可信"。第二节用PCA构建数字化转型指数:从Pearson的直线[1]到Hotelling的完整框架[2],再到Jolliffe的系统化[3],33个词频指标经标准化、降维、载荷赋权、归一化,压缩成一个可比较的指数;吴非等的年报词频测度[5]提供了实证先例,Amihud与Mendelson的流动性度量[6]、唐松等的数字金融实证[7]昭示着指数背后的资本市场图景,Guyon与Elisseeff的特征选择思想[10]为降维提供了方法论支撑,Hsiao的面板数据框架[4]让这一切可以跨年跨行业地展开。在零代码平台上,这些百年方法变成了"一键运行"的实训——但运行背后,是你要懂的判断:选什么指标、为什么标准化、载荷权重意味着什么。这一章之后,你应当建立起一个习惯:拿到任何一组数据,先问三个问题——它长什么样、结论可不可信、多维指标如何合成。平台负责算,你负责懂——这就是数智时代的统计学。

留三个问题给你想一想:

  1. 为什么"报告均值必须同时报告标准差"?只报均值会带来什么误导?用本章的行业数据举个例子。
  2. PCA的载荷权重与专家打分权重,本质区别是什么?什么场景下专家打分更合适?
  3. "全量vs抽样"实验说明了大数定律——你能设计一个自己的对比实验吗?样本量取多少,差异会小到可以忽略?

参考文献

  1. [1] Pearson K. On lines and planes of closest fit to systems of points in space[J]. The London, Edinburgh, and Dublin Philosophical Magazine and Journal of Science, 1901, 2(11): 559-572.
  2. [2] Hotelling H. Analysis of a complex of statistical variables into principal components[J]. Journal of Educational Psychology, 1933, 24(6): 417-441.
  3. [3] Jolliffe I T. Principal Component Analysis[M]. 2nd ed. New York: Springer, 2002.
  4. [4] Hsiao C. Analysis of Panel Data[M]. 2nd ed. Cambridge: Cambridge University Press, 2003.
  5. [5] 吴非, 胡慧芷, 林慧妍, 等. 企业数字化转型与资本市场表现——来自股票流动性的经验证据[J]. 管理世界, 2021, 37(7): 130-144.
  6. [6] Amihud Y, Mendelson H. Asset pricing and the bid-ask spread[J]. Journal of Financial Economics, 1986, 17: 223-249.
  7. [7] 唐松, 伍旭川, 祝佳. 数字金融与企业技术创新——结构特征、机制识别与金融监管下的效应差异[J]. 管理世界, 2020(5).
  8. [8] Tukey J W. Exploratory Data Analysis[M]. Reading: Addison-Wesley, 1977.
  9. [9] Anscombe F J. Graphs in statistical analysis[J]. The American Statistician, 1973, 27(1): 17-21.
  10. [10] Guyon I, Elisseeff A. An introduction to variable and feature selection[J]. Journal of Machine Learning Research, 2003, 3: 1157-1182.

数据与平台:本章实训绑定 zhenyuonline.cn 真实应用(数字化转型指数平台 / 数字化转型指数API)。页面渲染图均为平台实测截图。