QJE-2026-02-04
管理者对企业绩效至关重要,但如何前瞻性地识别优秀管理者一直是实证研究的难题。本文提出并验证了一种基于技能的前瞻性管理者识别方法。研究分为三个阶段:首先,作者设计了一项预注册的大规模实验室实验(n=555),通过将管理者随机分配至多个团队并在控制个体生产技能后估计管理者的因果贡献。实验采用了新颖的"协作生产任务",模拟真实团队生产环境,要求管理者执行协调、监控和激励三项核心职责。其次,作者通过LinkedIn公开数据对实验参与者的真实职业发展进行追踪(n=73)。最后,在一家南美大型零售企业的500家门店中对225名门店经理进行了实地验证。
研究发现:(1)管理者对团队绩效的因果贡献巨大——管理者质量提升一个标准差可使团队绩效提高0.22个标准差(控制全体成员生产技能后),且管理者整体质量对团队产出的贡献与所有工人的生产技能之和大致相当。(2)在自荐机制下获得管理职位的人表现显著劣于随机指派的管理者,差距约为0.1个标准差,探索性分析表明这可能与自荐管理者的过度自信有关,尤其是他们对自身社交技能的过度高估。(3)在随机指派管理者样本中,经济决策技能和流体智力是管理绩效最稳健且一致的两大预测因子;而人口统计学特征(性别、年龄、教育程度)和人格特质(大五人格、政治技能、风险态度)均无法显著预测管理绩效。(4)实验测量到的管理技能对真实职业晋升具有显著预测力——管理绩效每增加一个标准差,年晋升次数增加0.16次;优秀管理者(+1个标准差)平均每2.3年晋升一次,而其他管理者平均需5.3年。(5)实地研究通过事件分析法发现,管理者质量提升一个标准差可使门店年销售额增加410万美元(约25%的增长);经济决策技能同样是实地中经理绩效最强的预测因子(一个标准差对应0.19个标准差的绩效提升)。(6)如果企业将管理者招聘机制从自荐调整为基于经济决策技能筛选,预计可使门店年销售额提高16%(约260万美元)。(7)在机制层面,优秀管理者通过三种渠道助力团队成功:监控(避免工人做无用功)、按比较优势分配任务、以及激励工人保持努力。其中监控和激励的解释力大致相当且均强于分配作用。
本文的学术贡献主要体现在三方面:第一,发展了基于技能的前瞻性管理者评估方法,弥补了既有文献仅能从事后估计管理者效应的不足;第二,提供了关于中层管理者(区别于高阶领导人和CEO)经济价值的新证据;第三,拓展了关于管理者选拔机制及其决定因素的文献,发现经济决策技能是连接实验室与真实世界管理绩效的统一预测指标,而个性特质和自荐偏好并非有效筛选标准。
创新点 1:基于反复随机分配的前瞻性管理者识别方法
维度:方法创新
原文依据:
- 文章明确指出:"We introduce a novel method for identifying effective managers, using a large preregistered lab experiment... we causally identify managerial contributions by randomly assigning each manager to multiple teams and controlling for task-specific performance of managers and workers, which isolates management skill from productive capacity."(Section I, pp. 1583-1584)
- 在识别策略部分,作者构建了将管理者反复随机分配到四个不同团队的设计,通过残差平均化来估计管理者效应 $\hat{\alpha}_i$:"by randomly assigning managers to multiple groups we can estimate $\alpha_i$ — defined as the average causal impact manager $i$ has on group performance after controlling for individual differences in productive skill"(Section II.A, pp. 1589-1590)
- 方法细节呈现于多层次模型(方程3):$\hat{g}_i = \alpha_i + e_{gi}$,其中 $\hat{g}_i$ 是技能调整后的团队绩效向量,$\alpha_i$ 为随机管理者效应(pp. 1590)
创新程度评估:高。既有研究主要通过管理者轮换的事后固定效应估计管理者价值(Lazear, Shaw, and Stanton 2015; Fenizia 2022),而本文首次在实验中通过反复随机分配实现了对管理者个体效应的因果识别,并使得该方法可用于前瞻性(prospective)筛选,而非仅用于回顾性(retrospective)评估。作者明确指出这一差异:"Although these studies have many strengths, they cannot be used prospectively to identify strong managers."(p. 1586)
创新点 2:自荐机制 vs. 随机指派的反直觉发现
维度:结论创新
原文依据:
- 核心发现:"We find that teams with self-promoted managers perform 0.1 standard deviations less well than teams with randomly assigned managers, a gap that is roughly equivalent to being assigned a manager with a one standard deviation lower fluid IQ score."(Section I, p. 1583)
- 过自信机制探索:"People who want to be in charge were much more overconfident than people who do not have strong preferences for being a manager ($d = 0.41$ standard deviations, $p < .01$)"(Section III.B, p. 1606)
- 社交技能过度高估:"Among self-promoters we find a strong negative correlation between self-reported people skills and performance on the RMET (correlation $= -0.37$, $p < .001$)"(Section III.B, pp. 1606-1607)
- 量化比较图(Figure IV)显示自荐机制在所有六种选拔机制中表现最差,基于经济决策技能的选拔比自荐高出 0.7 个标准差(Section III.D, pp. 1609-1610)
创新程度评估:高。现有文献通常假定自荐者具有更高的领导动机和能力(如 Erkal, Gangadharan, and Xiao 2022),但本文通过随机化设计首次提供了干净的反事实因果证据,表明自荐机制可能导致逆向选择——最渴望当领导的人可能反而是最不称职的。这一发现对企业招聘实践和"玻璃天花板"研究(如 Exley and Kessler 2022)均有很强冲击力。
创新点 3:经济决策技能作为管理绩效的核心预测因子
维度:理论/结论创新
原文依据:
- 实验发现:"The two variables that are most strongly correlated with wanting to be in charge are extraversion, risk appetite, and being male"(Table II, pp. 1599),但"Only two measures clearly predict manager performance in the lottery arm: fluid intelligence (Ravens) and economic decision-making (assignment game)"(Section III.C, p. 1608)
- 实地验证:"the strongest predictor of managerial performance is economic decision-making skill... A one standard deviation increase in economic decision-making is associated with a 0.19 standard deviation improvement in the performance of retail store managers ($p = .01$)"(Section IV.B, p. 1618)
- 对比人格特质:"No other characteristics strongly predict managerial performance"——包括大五人格的政治技能、风险偏好等均不显著(Table V, pp. 1607-1608)
- 技术细节:经济决策技能采用 Caplin et al. (2024) 的 assignment game 测量,"focuses on the ability to strategically allocate scarce attention in a resource allocation task",与管理者在资源约束下做出决策的核心职能高度对应(Footnote 6, p. 1584)
创新程度评估:高。该发现颠覆了组织心理学文献中关于人格特质(尤其是外向性、尽责性)预测领导绩效的传统认知(如 Judge et al. 2002),同时将 Caplin et al. (2024) 新发展的经济决策技能概念与管理者绩效建立了跨场景(实验室—真实企业)的稳健联系。这一发现具有重要的理论重构意义。
创新点 4:实验室—实地双重验证设计
维度:方法/数据创新
原文依据:
- LinkedIn 追踪:"We use publicly available LinkedIn data on our lab experiment participants to test whether managerial performance measured in the lab corresponds to meaningful differences in actual career progression."(Section IV.A, pp. 1610-1611)
- 结果:"a one standard deviation increase in the lab measure of managerial performance is associated with 0.16 more real-world promotions per year ($p < .001$, $n = 73$)"(Section IV.A, p. 1611)
- 零售企业实地研究:"We recruit a sample of grocery store managers employed by a multibillion-dollar retail firm in South America. Each store manager completed a set of three skill assessments that matched the skills assessed before the lab experiment: economic decision-making skill, fluid intelligence, and emotional perceptiveness."(Section IV.B, pp. 1613-1614)
- 使用 AKM 模型(Abowd, Kramarz, and Margolis 1999)估计管理者固定效应,利用经理在500家门店间的轮换进行识别(Section IV.B, pp. 1614-1616)
- 实验室和实地数据在管理者的技能—绩效关联模式上高度一致:"the same vector of ex ante observable characteristics explain 20% of variation in causally identified managerial contributions"(Section IV.B, pp. 1619-1620)
创新程度评估:中高。虽然管理学文献中已有实验室和实地相结合的研究,但本文在此处的处理相当精细——实验室测量与实地测量使用相同的技能评估工具,使跨场景比较有了扎实的度量基础;LinkedIn 追踪提供了职业生涯维度的外部验证;且三种验证路径(LinkedIn 晋升、零售门店销售、技能—绩效关联模式)相互印证,构成"三角验证"。
创新点 5:中层管理者价值的准实验估计
维度:数据/结论创新
原文依据:
- 事件研究结果:"a good manager (defined as being one standard deviation better in terms of managerial fixed effect) improves annual per store sales by US$4.1 million (25%)"(Section IV.B, p. 1618);"the arrival of a good manager... increases sales by 25%... which equates to an increase in annual turnover of US$5.2 million."(Section IV.B, pp. 1617-1618)
- 与工人效应的比较:"the effect of a one standard deviation improvement in manager performance is 1.1× larger than the effect of a one standard deviation improvement in the productive skills of workers"(实验室)和"a one standard deviation increase in the quality of a manager has roughly 1.4× the impact on sales as a one standard deviation increase in the average quality of workers at the store"(实地)(Section IV.B, pp. 1618)
- 与既有文献对话:"This improvement is broadly in line with empirical estimates from other industries, which have linked a one standard deviation improvement in management quality to performance improvements of 10%–22% (Wells 2020; Fenizia 2022; Giardili, Ramdas, and Williams 2023)"(p. 1585)
- 作者强调中层管理者是一个"relatively understudied compared to senior leaders"的群体(Section I, p. 1587)
创新程度评估:中高。虽然管理者的价值已有较多估计,但此前文献主要关注 CEO、高级管理者或特定行业(如制造业),本文将分析延伸至零售业中层管理者,且提供了跨场景(实验室 vs. 实地)的可比估计,揭示了管理者质量和工人总体质量具有大致相当的经济重要性这一稳健发现。
创新点 6:管理机制的量化分解
维度:理论/结论创新
原文依据:
- 三大机制识别:"We find that good managers (i) monitor their workers to make sure bottlenecks are being addressed; (ii) match workers to the tasks that best fit their skills; and (iii) keep workers motivated."(Section I, p. 1586)
- 监控机制的量化:"the bivariate correlation between monitoring errors and manager performance is $-0.34$ ($p < .001$)";"A manager one standard deviation above average reduced the error rate from 13.3% to 7.1%."(Section V.A, pp. 1620-1621)
- 分配机制的量化:"Groups whose managers always start with the best assignment scored 0.50 standard deviations higher than groups with managers who never start with the best allocation ($p < .01$)"(Section V.B, p. 1622)
- 激励机制的量化:motivation fixed effects 与总体管理绩效的相关系数为 0.39 ($p < .001$)(Section V.C, pp. 1622-1623)
- 相对重要性:"all three mechanisms independently contribute to managerial contributions... the motivational and monitoring channels are the strongest predictors of overall manager performance"(Table VII, pp. 1623-1624)
- 实地验证补充:经济决策技能较强的经理更善于监控库存,主动避免缺货——"a one standard deviation increase in managers' assignment-game score being associated with a 0.35 percentage point reduction in stockouts... or 5.1% of the mean."(Section V.E, pp. 1624-1625)
创新程度评估:中高。既有文献较多关注管理者效应的大小,但对管理者"做什么"产生了这些效应的量化分解仍较匮乏。本文通过精巧的实验设计(弱链生产函数、动态任务分配、可见/不可见信息区别)和详细的逐轮行为数据,首次在同一实验框架内分解和比较了监控、分配、激励三大渠道的相对贡献,并部分验证至实地场景(缺货管理)。这一分析框架本身也是方法论上的贡献。
选题 1: Optimal Manager Selection Rules under Asymmetric Information about Managerial Ability
源自创新点: 创新点2(自荐 vs. 随机指派)和创新点1(前瞻性识别方法)
研究问题: What is the optimal mechanism for selecting managers when candidates have private information about their own ability but also potentially biased self-assessments? How should firms design screening mechanisms that combine self-selection, skill-based testing, and random audits to maximize expected managerial quality?
方法建议: 理论建模(mechanism design with overconfidence) + 结构估计(使用 Weidmann et al. 2026的实验数据或新设计的线上线下实验)。可构建一个信息经济学模型,其中候选人关于自身管理能力的信号同时包含真实信息和过度自信噪音,企业通过设计"菜单式"选拔程序(自荐通道 + 技能测试通道 + 随机通道)来分离不同类型的候选人。
目标期刊: American Economic Review, Econometrica, Journal of Political Economy
与原文的关系: 直接拓展原文的实验发现(自荐者表现劣于随机任命者),为其建立微观理论基 础,并将结论从"是什么"推进至"怎么办"。
选题 2: The Peter Principle Revisited — When Do Worker Skills Predict Manager Performance?
源自创新点: 创新点3(经济决策技能的预测力)和创新点6(管理机制的量化分解)
研究问题: Under what conditions does an employee's performance as a line worker predict their effectiveness as a manager? What specific skills are transferable across the worker-to-manager transition, and what skills are manager-specific? How does this depend on the nature of the managerial role (e.g., monitoring-intensive vs. motivation-intensive)?
方法建议: 利用原文实验数据 + 新设计的任务变体(在不同类型的协作生产任务中变化监控/分配/激励的权重)。也可使用多行业的人事数据(如 Lazear, Shaw, and Stanton 2015的追踪数据),对比不同行业中"工人技能→管理技能"的转化率。
目标期刊: Quarterly Journal of Economics, Review of Economic Studies, Journal of Labor Economics
与原文的关系: 原文发现经济决策技能(而非个体生产技能)预测管理绩效,且发现"按彼得原理提拔"不如随机任命。本选题深入探讨技能的可转移性和任务异质性如何调节这一结论,构成对原文的核心理论延伸。
选题 3: Economic Decision-Making Skill as a General Predictor of Job Performance — Cross-Occupational, Cross-Cultural, and Life-Cycle Evidence
源自创新点: 创新点3(经济决策技能的跨场景预测力)和创新点4(实验室—实地双重验证)
研究问题: Is economic decision-making skill (Caplin et al. 2024) a general predictor of job performance beyond managerial roles? Does its predictive power vary across occupations (e.g., managers vs. professionals vs. entrepreneurs), across institutional/cultural contexts, and across the life cycle (young vs. experienced workers)?
方法建议: 大规模跨职业调查,使用 assignment game 作为统一的技能测量工具;与 LinkedIn 或类似平台的职业档案数据链接;跨国比较(如丹麦注册数据 + 美国 + 发展中国家样本)。利用 Altonji and Pierret (2001) 的雇主学习框架检验该技能的信号价值 vs. 生产力价值随时间的变化。
目标期刊: Journal of Political Economy, American Economic Journal: Applied Economics, Journal of Human Resources
与原文的关系: 原文已在实验室(英国)和田野(南美零售企业)两个场景中验证了经济决策技能的预测力,本选题将该结论推广至更多职业类型、文化背景和生命周期阶段,极大拓展外部有效性。
选题 4: The Role of Overconfidence in Managerial Self-Selection and Its Aggregate Implications
源自创新点: 创新点2(自荐管理者的过度自信机制)
研究问题: To what extent does managerial overconfidence drive the observed underperformance of self-promoted managers? What are the aggregate implications for firm productivity, wage inequality, and the gender leadership gap? Can debiasing interventions (e.g., providing objective skill feedback before self-selection) improve the quality of self-promoted managers?
方法建议: 多臂随机实验:在自荐前随机给予部分候选人关于其真实技能的客观反馈(包括/不包括与同龄人的比较),观察其对自荐意愿和后续绩效的影响。结合结构模型,估计过度自信导致的配置效率损失总量。可考虑性别异质性(原文发现男性的过度自信更严重)。
目标期刊: American Economic Review, Econometrica, Journal of Labor Economics
与原文的关系: 原文的探索性分析发现了过度自信的初步证据(自我评估与管理绩效的残差为正;自我报告的社交技能与 RMET 实际得分负相关),但作者承认这属于探索性分析。本选题将过度自信从探索性发现升级为因果识别的核心自变量,并拓展至福利分析和政策干预设计。
选题 5: AI-Augmented Assessment of Managerial Potential — Scaling the Repeated Randomization Approach
源自创新点: 创新点1(反复随机分配方法)和创新点4(实验室—实地验证)
研究问题: Can the repeated randomization method for identifying good managers be scaled using AI agents instead of human workers? How well do AI-based assessments of managerial skill correlate with human-based assessments and real-world managerial outcomes?
方法建议: 追随 Weidmann, Xu, and Deming (2025) 的初步工作,设计 AI agent 替代人类工人进行协作生产任务。比较"人类工人评分"与"AI代理评分"的收敛效度;追踪两套评分对真实职业晋升的预测效度;分析 AI 评估的成本效率和心理测量属性(如评分者信度、练习效应)。
目标期刊: Management Science, Review of Economics and Statistics, Journal of Labor Economics
与原文的关系: 原文在结论部分明确指出了这一方向:"the costs and logistical difficulties of running in-person group-based assessments could be substantially reduced by new measurement technology... using AI agents to simulate the role of human workers in a repeated randomization design"(pp. 1626-1627)。Weidmann, Xu, and Deming (2025) 已进行了初步探索,但完整的效度验证和成本收益分析仍缺。
选题 6: What Do Managers Do? — A Meta-Analysis and Unifying Framework
源自创新点: 创新点6(管理机制的量化分解)
研究问题: Across the growing empirical literature on manager effects, what are the common behavioral channels through which managers affect team and firm productivity? Can we develop a unifying taxonomy of managerial functions (monitoring, allocation, motivation, conflict resolution, relationship management, etc.) and estimate their relative importance across industries, organizational levels, and institutional contexts?
方法建议: 系统性文献综述 + 元分析。对经济学和组织心理学中研究管理者效应的论文进行分类编码(任务类型、管理者层级、测量方式、机制分析等),使用元回归分析估计各机制的平均效应量和异质性。特别关注原文提出的三大机制(监控/分配/激励)在不同场景中的相对权重的变化规律。
目标期刊: Journal of Economic Literature, Journal of Economic Perspectives, Annual Review of Economics
与原文的关系: 原文在一个统一的实验框架中分解了三大机制,但每种机制的相对重要性可能高度依赖任务特征和环境。本选题将原文的分析框架推广至更广泛的文献和场景,提供一般性结论。
方案一:中国情境下管理者选拔机制的实验研究——自荐、任命与技能筛选的因果比较
源自创新点: 创新点2(自荐 vs. 随机任命的因果效应)和创新点1(反复随机分配方法)
目标中文期刊(梯队):
- 第一梯队:经济研究、管理世界
- 第二梯队:经济学(季刊)、中国工业经济
- 第三梯队:世界经济、南开管理评论
中国情境对接:
中国企业管理者的选拔存在独特的制度特征——国有企业高管以组织任命为主,民营企业中家族传承与公开招聘并存,互联网/科技行业则流行内部竞聘和自荐答辩。Weidmann et al. (2026) 的核心发现——自荐当选的管理者反而表现更差——如果在中国情境中得到验证,将对现行"竞聘上岗"和企业"毛遂自荐"文化产生强烈的政策冲击。此外,中国高校学生会、班干部的选举机制亦可作为实验室外场实验的场景。
研究设计:
- 可用数据:
- 在中国大学实验室复制原文的协作生产任务实验(增加"组织任命"处理臂,模拟中国国企的干部任命模式)
- 与某大型中国互联网/制造企业合作,获取内部竞聘答辩评分和后续绩效考核数据
- 针对中国 MBA/EMBA 学员开展线上版本的 assignment game 测试,并追踪其职业档案(如脉脉、LinkedIn 中国区数据)
- 识别策略:
- 实验室部分:多臂 RCT —— 随机分配管理者选拔规则(自荐臂、能力测试筛选臂、组织直接任命臂、对照组随机指派臂),估计不同选拔规则的因果效应
- 企业合作部分:利用企业内部"双通道"晋升体系(技术序列 vs. 管理序列)的截面变异,比较选择管理序列的技术骨干与留在技术序列的同僚在后续团队绩效上的差异
- 工具变量:利用企业/高校中因不可预期的人事变动导致的"意外任命"作为自然实验
政策价值:
- 直接政策含义:为中国企业(尤其是国企和大型民企)的中层管理者选拔机制改革提供因果证据支持;挑战"毛遂自荐"和"内部竞聘"作为最佳实践的普遍认知
- 政策受众:国务院国资委、各级组织部(干部选拔)、大型企业人力资源部门、MBA 教育机构
- 政策窗口:2024年国企改革深化提升行动强调"市场化选人用人机制",本研究可为"如何市场化"提供具体的技术路径——技能测试优于竞聘演讲
写作框架建议:
- 引言:Weidmann et al. (2026) 的自荐悖论 + 中国干部选拔制度的理论张力
- 理论框架:逆向选择视角下的管理者自荐模型(过度自信 + 信号发送)
- 实验设计:在中国复制的多臂 RCT,特别增加"组织任命"臂
- 实验结果与分析
- 田野验证(企业合作数据)
- 政策含义与选拔制度改革建议
方案二:经济决策技能对中国劳动力市场表现的预测力——来自全国代表性数据的证据
源自创新点: 创新点3(经济决策技能作为核心预测因子)和创新点4(实验室—实地双重验证)
目标中文期刊(梯队):
- 第一梯队:经济研究、经济学(季刊)
- 第二梯队:世界经济、劳动经济研究
- 第三梯队:中国人口科学、经济科学
中国情境对接:
中国劳动力市场呈现高学历通胀和"35岁危机"并存的独特特征——在简历信息严重同质化(大学扩招后大批量同质本科生)的背景下,传统筛选指标(学历、学校、专业)的区分力下降。Weidmann et al. (2026) 发现经济决策技能(assignment game 得分)预测管理绩效优于人格特质和人口统计特征,且 Altonji and Pierret (2001) 的雇主学习理论预测该技能的预测力将随职业生涯而增强。中国情境的特殊性在于:文凭信号的高度集中使雇主更难从传统指标中分辨质量,这反而可能使"硬技能"测试(如 assignment game)的增量预测价值较发达国家更显著。
研究设计:
- 可用数据:
- 中国家庭追踪调查(CFPS)——可在新一轮调查中加入 assignment game 模块(或简化的注意力分配任务)
- 中国劳动力动态调查(CLDS)
- 与某中国大型招聘平台(如 BOSS 直聘、智联招聘)合作,在新用户注册时嵌入 assignment game,并链接至后续求职成功率和薪资数据
- 利用中国大学毕业生追踪调查(如北京大学教育学院实施的全国毕业生调查),在毕业前测试 assignment game,追踪3-5年职业发展
- 识别策略:
- 多变量回归 + LASSO/随机森林特征重要性排序:比较经济决策技能、大五人格、认知能力(如瑞文测试)和传统人力资本变量(学历、专业、GPA)对薪资和晋升的边际预测力
- 雇主学习检验(Altonji and Pierret 2001框架):检验 assignment game 得分对薪资的解释力是否随工作经验年限而增加(而教育信号的解释力是否递减)
- 异质性分析:按职业类别(管理岗 vs. 技术岗 vs. 创业)、行业(制造业 vs. 互联网 vs. 金融)、企业所有制(国企 vs. 民企 vs. 外企)分组检验预测力的变化
政策价值:
- 直接政策含义:为教育体系中的能力培养和劳动力市场中的技能筛选提供新证据——中国高等教育是否过度强调学历信号而非"经济决策能力"这类可被客观测量的核心技能?
- 政策受众:教育部(本科教育质量评估)、人力资源和社会保障部(职业能力测评标准)、企业招聘部门
- 政策窗口:中共中央、国务院《关于深化现代职业教育体系建设改革的意见》强调"能力导向"评价体系,本研究可为"什么能力最重要"提供实证答案
写作框架建议:
- 引言:人力资本理论中的"能力测量"难题 + Weidmann et al. (2026) 的决策技能发现
- 文献综述:雇主学习理论 + 中国劳动力市场的信号问题
- 数据与测量:CFPS/合作平台数据 + assignment game 的中国本土化改编
- 经济决策技能对劳动力市场结果的预测力分析
- 雇主学习动态:经验—技能交互效应
- 异质性与机制讨论
- 结论与政策建议
方案三:管理者过度自信的识别、后果与纠偏——来自中国企业的实验证据
源自创新点: 创新点2(自荐管理者的过度自信机制)和英文选题4(过度自信的因果识别)
目标中文期刊(梯队):
- 第一梯队:管理世界、经济研究
- 第二梯队:中国工业经济、南开管理评论
- 第三梯队:管理科学学报、心理学报
中国情境对接:
中国商业文化中"自信"被高度推崇——从"毛遂自荐"到"狼性文化",从创投圈的"fake it till you make it"到企业内部晋升中频繁出现的"过度承诺"现象。然而过度自信在企业决策中的负面效应已在西方文献中反复论证(Malmendier and Tate 2015)。中国情境的特殊性在于:集体主义文化下的"面子"机制可能导致过度自信的管理者不仅在个人层面犯错,更会在团队和组织层面引发连锁效应(如下属不敢纠正上级的错误判断)。同时,中国文化中的"谦虚"规范可能与西方情境中过度自信的性别差异(男性更过度自信)产生交互,形成独特的性别—过度自信模式。
研究设计:
- 可用数据:
- 与多家中资企业合作,在其内部晋升/竞聘流程中嵌入随机化实验:随机向部分候选人提供关于其客观技能(经济决策能力、认知能力、社交感知能力)的反馈,观察其竞聘意愿和竞聘演讲内容的变化
- 利用中国上市公司高管数据(CSMAR),以 CEO 并购频率、行权行为等指标构建过度自信度量(借鉴 Malmendier and Tate 的框架),结合企业绩效面板数据
- 在 MBA/EMBA 课堂中开展管理模拟实验,记录管理者在模拟经营中的决策与实际绩效的偏差
- 识别策略:
- 田野 RCT:信息干预(客观技能反馈 vs. 无反馈)→ 自荐行为 → 后续绩效
- 断点回归:利用企业内部晋升中"刚好过线"和"刚好没过线"的候选人,比较他们的后续管理绩效和自我评估偏差
- 实验室实验:在中国版本的管理任务中随机分配反馈类型(仅告知技能排名 vs. 告知排名 + 展示与同龄人比较的校准信息),测量过度自信的降低程度和管理绩效的改善
- 差中差(DID):比较接受反馈干预前后管理者所在团队的绩效变化
政策价值:
- 直接政策含义:为国企和民企的干部选拔提供"纠偏"方案——在选拔环节加入客观技能反馈,可降低自荐者因过度自信而被不当任用的概率
- 政策受众:企业人力资源部门、组织部门(干部考察)、商学院/MBA 项目
- 政策窗口:2024年起全国推行"国企改革深化提升行动",强调"能上能下"的干部管理机制——客观技能反馈工具可成为"能下"环节的决策辅助
写作框架建议:
- 引言:过度自信的经济学理论 + 中国管理者选拔中的信息不对称
- 理论框架:过度自信下的自荐模型,以及信息干预的纠偏机制
- 实验设计:多臂信息干预 RCT
- 结果:信息干预对自荐行为、自我评估准确性和后续管理绩效的影响
- 异质性:性别、企业文化(国企/民企/外企)、行业等维度的差异
- 福利分析:过度自信驱动的管理者筛选效率损失
- 政策建议与管理实践启示
方案四:中国制造业中层管理者的生产力效应——基于管理者—工厂匹配面板的估计
源自创新点: 创新点5(中层管理者价值的准实验估计)和创新点6(管理机制的量化分解)
目标中文期刊(梯队):
- 第一梯队:经济研究、中国工业经济
- 第二梯队:经济学(季刊)、世界经济
- 第三梯队:产业经济研究、劳动经济研究
中国情境对接:
中国作为全球制造业中心,拥有规模庞大的生产一线和中层管理群体(班组长、车间主任、分厂长)。大量实证文献研究了中国制造业的 TFP 及其决定因素(Hsieh and Klenow 2009; Brandt et al. 2012),但对中层管理者个人效应的估计几乎空白。Weidmann et al. (2026) 提供了实验室—实地双重验证的范本:在南美零售业中利用 AKM 模型估计管理者固定效应。中国情境的独特优势在于:大量制造企业实行"轮岗制"——中层管理者在不同车间/产线间定期轮换(部分出于廉政考虑,部分出于技能培养),这为识别管理者效应提供了与原文零售门店轮转类似的制度基础。
研究设计:
- 可用数据:
- 与一家或多家中国大型制造企业合作(如富士康、比亚迪、格力),获取车间/产线级别的月度生产数据(产出、良品率、故障时间)+ 中层管理者人事调动记录
- 中国工业企业数据库(1998-2013)— 虽然不含管理者个人标识,但可作为宏观背景
- 上市公司(制造业)年报中的管理层讨论与分析(MD&A)+ 子公司/分部经营数据
- 如合作企业允许,可对轮岗的管理者进行 assignment game 和瑞文测试的简化版评估
- 识别策略:
- AKM 双向固定效应模型(Abowd, Kramarz, and Margolis 1999):利用管理者在不同产线/车间间的轮换识别管理者固定效应,同时控制车间固定效应和时间效应
- 事件研究法:以管理者轮换为事件,考察车间绩效在管理者变更前后的变化(平行趋势检验 + 动态效应)
- Card, Heining, and Kline (2013) 的移动对称性检验:验证管理者在各车间之间的移动模式是否满足条件均值独立假设
- 将管理者技能评估(assignment game 得分等)与估计出的管理者固定效应进行回归,检验经济决策技能在中国制造业场景中的预测力
- Andrews et al. (2008) 偏差校正和 Kline, Saggio, and Sølvsten (2020) leave-out 估计作为稳健性检验
政策价值:
- 直接政策含义:为"中国制造2025"和"高质量发展"提供微观人力资本视角——提升中层管理者质量可能是比投资新技术设备更具成本效益的生产率提升路径
- 政策受众:工业和信息化部、制造业行业协会、大型制造企业人力资源部门
- 政策窗口:中美贸易摩擦后中国加速推动制造业自主可控和产业升级,管理效率成为超越单纯技术追赶的关键变量
写作框架建议:
- 引言:中国制造业生产率的"管理差距" + Weidmann et al. (2026) 的方法框架
- 制度背景:中国制造企业的管理层级、轮岗制度和生产管理模式
- 数据与管理层流动模式描述
- 管理者效应的估计:AKM 模型与事件研究
- 管理者效应与技能评估的关联分析
- 机制分析:管理者通过监控、分配和激励渠道影响产出的分解
- 反事实模拟:基于技能筛选的管理者选拔改革对车间绩效的影响
- 结论与政策含义
方案五:从"彼得原理"到"技能匹配"——中国上市公司中层管理者晋升机制与公司绩效
源自创新点: 创新点5(中层管理者价值)和英文选题2(彼得原理的再检验)
目标中文期刊(梯队):
- 第一梯队:管理世界、经济研究
- 第二梯队:金融研究、经济学(季刊)
- 第三梯队:中国会计与财务研究、南开管理评论
中国情境对接:
Benson, Li, and Shue (2019) 提出的"彼得原理"(因技术能力强被提拔为管理者,但管理能力不足导致绩效下滑)在中国企业中具有极强的制度土壤——中国企业的"双通道"晋升体系(专业技术序列 vs. 管理序列)虽然名义上允许技术专家不走管理路线,但在现实中管理序列的社会地位和薪酬上限通常远高于技术序列,形成强烈的"技而优则管"激励。此外,中国国企普遍存在"旋转门"式的政企高管交叉任职,使得管理者来源异质性极高(技术出身、行政出身、党务出身、市场化招聘),为检验"谁更适合做管理者"提供了天然的准实验变异。
研究设计:
- 可用数据:
- CSMAR(国泰安)上市公司人物特征数据库——包含高管简历、任命路径、晋升时间
- RESSET(锐思)公司治理数据库
- 手工收集上市公司年报中披露的分部/子公司负责人变更信息
- 如能与某大型上市企业集团合作,获取内部人事档案和绩效考核数据(KPI、360度评估等)
- 中国工业企业数据库中的经理人特征(如有)和企业 TFP 估计
- 识别策略:
- 双重差分 + 匹配:比较由"技术线"提拔 vs. "管理线"提拔 vs. "外部空降"三种类型的中层管理者,在接管部门后1-3年的部门绩效(ROA、TFP、员工离职率)变化
- 工具变量法:利用前任管理者非预期离职(如突发疾病、被立案调查)导致的"意外型晋升"作为工具变量,解决晋升时的内生选择问题
- Heckman 选择模型:两步法估计——首先估计个体选择"技术线"或"管理线"的概率,然后在第二步中比较不同类型管理者的事后绩效表现
- 断点回归:利用企业内部晋升的量化评分阈值(如综合考评得分的前30%可进入管理序列),在阈值附近比较刚好进入管理序列与刚好留在技术序列的员工后续所带团队的绩效差异
- 异质性分析:国有 vs. 民营、东部沿海 vs. 中西部内陆、大型企业 vs. 中小企业
政策价值:
- 直接政策含义:(1)引导中国企业审慎评估"技而优则管"的惯例;(2)为"双通道"晋升体系提供实证评估,可能建议提高技术序列的薪酬和地位上限,以减少因地位不平等而驱动的不当技术→管理转轨;(3)为外部空降与内部提拔的争议提供因果证据
- 政策受众:国务院国资委(央企干部管理)、证监会(上市公司治理准则)、企业董事会薪酬委员会
- 政策窗口:2024年《公司法》修订实施,对董事和高级管理人员的"忠实义务和勤勉义务"提出了更高要求,合格的经理人筛选属于公司治理合规的组成部分
写作框架建议:
- 引言:彼得原理的中国版本 + Benson, Li, and Shue (2019) 与 Weidmann et al. (2026) 的启示
- 制度背景:中国企业的晋升体系(双通道、党组织考察、市场化招聘)及其对管理者质量的影响
- 理论框架:一个简单的管理者质量—晋升路径匹配模型
- 数据、样本与变量定义
- 识别策略与实证结果
- 异质性与稳健性检验
- 政策模拟:反事实改革方案下的公司绩效预测
- 结论与政策建议