REACTOR
B09 Multitask Agency 定律与形式 · REV.3

SELF-TEST OK · REACTOR v3 · LOADING [ B09 ]…

多任务代理

教师为什么拿固定工资:一条定理。

Kerr 点破了组织的通病:希望教学好,却只奖励发表(B06)。自然的反应是:那就把靶子挂对,把教学也考核起来,问题不就解决了?这个直觉是错的。1991 年,经济学家 Bengt Holmström 与 Paul Milgrom 用数学证明:只要重要的事情测不准,把可测的事情考核得越起劲,测不准的那部分就被抽干得越快。顺着这条逻辑推到极端,结论只有一个:某些情况下,最好的合同是干脆一分钱绩效都不发,付固定工资。老师拿固定工资不是懒政遗留,是精确的最优解。这条定理后来成了 Holmström 2016 年拿诺贝尔经济学奖的核心贡献之一。

先讲一个生活版。你请装修队刷墙,按平方米计价。平方米很好量,于是墙刷得飞快;边角处理、底漆遍数这些决定墙面寿命的细节没法按米计价,于是全被省掉。你没有雇到懒人,你雇到的是对价格表反应灵敏的聪明人:他把一天里有限的力气,全部搬到了能换钱的维度上。多任务模型讲的就是这台搬运机器的原理。

FIG.01 多任务模型:一条关于固定工资的定理 EXPLORABLE

把模型的骨架说穿,其实只有一条承重假设:人的力气是一个总量。多干这件事,就少干那件事,经济学叫「努力在任务间互为替代」。一旦接受这条,结论就顺流而下。

奖金在这个世界里有两个功能,多数人只看到第一个。功能一是油门:奖得多,人就整体更卖力。功能二是方向盘:奖在哪个任务上,力气就流向哪个任务。原文第 25 页把话挑明,激励工资不只配置风险、激发努力,还引导人在各项职责之间分配注意力。麻烦在于,方向盘只认「可测」。一个任务测不了,它的边际奖励就成了零。边际奖励一旦归零,力气自然会从它那里流走。

教师案例(第 32 至 33 页)把机制推到底。教基础技能,考试测得出;教独立思考,测不出。想让老师在「测不出」的那部分多花力气,只剩一个办法:把「测得出」那部分的奖励压低,降低挖走注意力的机会成本。顺着这条逻辑走到头,就是第 34 页的 Proposition 1:当重要任务完全不可测时,最优合同是付固定工资、零激励,哪怕老师根本不怕收入波动。这句「哪怕风险中性」是全文的锋刃:以前经济学解释弱激励,靠的是「人怕风险,所以少用提成」;这条定理说,就算没人怕风险,指错方向的方向盘也不如没有方向盘。

核心结果因此可以背下来(第 26 页):一个任务该不该给强激励,不取决于它自己好不好测,取决于它的邻居们好不好测。你考核的从来不是一个任务,是一个人的整张时间表。

定理带出一串组织学推论,每条都能在现实里对号。公务员的低强度激励是制度理性,不是官僚惰性:公共服务里最重要的维度(公正、廉洁、长期后果)恰恰最难测。计件工资在大型科层里尤其容易失灵(第 34 页原话),因为组织越大,「量」和「质」的测量鸿沟越深。反过来,最积极的推论是把岗位设计本身当激励工具:按可测性打包任务,可测的聚成一岗配强激励,难测的聚成另一岗配平薪,别让同一个人同时背两类任务;Dewatripont、Jewitt 与 Tirole 2000 年把这条处方形式化,起名 task clustering。

论文还埋着两条容易错过的线。其一是资产所有权(第 26 至 27 页):加盟店主自担盈亏拿最强激励,直营店经理拿弱激励加公司规程,两种安排各自内洽。原因在于所有权本身决定了哪些回报能被合同感知;能被感知的回报越多,激励强度就该配得越足。其二是第 27 页的论断:约束是绩效激励的替代品。当你没法用奖金引导方向时,禁止性规则(例如禁止兼职)能顶替一部分激励功能,这解释了为什么强监管与弱激励在成熟组织里总是成对出现。

这条线后来一路延伸。Gibbons 1998 年的综述把它与下一课 Baker 的扭曲模型(B10)合并成一句话:测量什么,就只会得到什么。Holmström 2017 年的诺奖讲座亲自收束:激励设计的核心不是多测多奖,而是让整个激励组合与真实目标对齐。Bénabou 与 Tirole 2016 年再往市场层面推一步:当行业靠高薪抢人,对可测维度的过度投入会被竞争进一步放大。放大到全行业范围,「重量轻质」就成了整个行业的均衡。在这个均衡下,金融与科技业的 KPI 军备竞赛不是个体失范,是均衡结果。2024 年之后的一批新工作还在提示:当被考核者互相看得见彼此的指标时,同侪比较会把挤出效应放得更大。

留一个问题:定理的承重假设是努力互为替代,人的一天只有二十四小时,这条假设对人显然成立。对一个参数量固定的模型,训练算力与表征容量在各能力维度之间,是否以同样的方式互相挤占?Y02 的挤占证据说方向为真,但「模型的总努力」该怎么定义、替代弹性有多大,还没有 Holmström 式的定理。

一句话带走:奖金不只是油门,还是方向盘;当重要的事测不准,弱激励甚至零激励才是最优设计。

来源 / 延伸阅读
  • Holmström, B. & Milgrom, P. (1991). "Multitask Principal-Agent Analyses." JLEO 7:24–52(Proposition 1 p.34;核心引文 p.25–26、32–33)。
  • Milgrom, P. & Roberts, J. (1992). Economics, Organization and Management(equal compensation principle 命名)。
  • Dewatripont, Jewitt & Tirole (2000). European Economic Review 44(task clustering)。
  • Gibbons, R. (1998). JEP 12(4)(综述);Holmström, B. (2017). AER 107(7)(诺奖讲座收束);Bénabou & Tirole (2016). JPE 124(2)(bonus culture)。
  • 逐页笔记见 research/03b;深化见 research/deep/D6 §1;简报 research/12
接下来去哪