早高峰七点四十五分,海岚市东岸走廊已经堵成一条缓慢移动的队伍。开车的周宁盯着导航上不断延长的到达时间;护士林晓在公交站多等了一班车,担心交接班迟到;沿街面包店的老板则担心,若把一条机动车道改成公交专用道,送货车会不会更难靠边。市政府准备推出一套组合方案:划出连续公交专用道,在中心区高峰时段对小汽车收取拥堵费,并把一部分收入用于增加公交班次和向低收入通勤者发放出行券。
会议室里最容易出现的一句话是:“这项政策到底让社会变好了吗?”它听起来像是在找一个总分,实际上是在追问几件不同的事:谁的时间、钱、健康和选择发生了变化;这些变化是否真的由政策造成;有人受损时,社会是否愿意、也是否做到了补偿;还有,那些难以标价的尊严、信任和城市体验,是否被认真看见。福利评价的价值,不是替决策者把复杂问题压成一个数字,而是让每一种代价和每一个被影响的人都能进入判断。

接下来,我们就跟着海岚市的评估小组工作。案例中的金额和人数均为课堂推演用的假设,不对应任何真实城市或项目。你不需要先背下某个定义;先试着站到不同人的位置上,再慢慢搭起评价的尺子。
公交专用道刚提出时,支持者说“更多人会更快到达”,反对者说“开车的人一定更堵”。两句话都可能成立,却都还没有完成评价。评估小组先画的不是结论,而是一张“变化地图”:政策怎样改变行为,行为又怎样传到不同人身上。
这张图提醒我们:政策不是一颗落在统计表上的石子。把车道留给公交,首先改变的是速度和道路使用方式;随后改变的可能是通勤时间、雇主招工半径、家长接送安排、空气污染和沿街装卸秩序。评价要沿着因果链走,既不把“公交更快”自动当成“人人更好”,也不把某一类人的抱怨直接当成全部社会成本。
一个实用的起点,是把受影响者先按“政策前后的处境”分开,而非按谁的声音更大来分。林晓可能因公交提速而少迟到;周宁可能因付费或绕路而多花时间;没有开车的老人可能因班次更密而更容易去医院;小型配送员则会同时面对通行限制与更稳定的道路速度。政府部门本身也在表中,因为建设、执法、运营和补贴都要占用资源,钱若不用在这里,本可以用在别处。

此处有一个朴素但很严格的基准:如果一种改变能让至少一个人更好,同时没有任何人更差,它的社会判断最轻松。现实中的交通政策几乎不会如此干净。于是,福利评价并不等待一个“人人满意”的奇迹,而是把问题改写为:收益有多大、损失落在谁身上、是否有更少伤害的方案,以及谁有责任承担调整成本。
评估小组下一步不是急着加总,而是建立一张利益变化清单。它的作用类似体检表:先确保没有漏看器官,再讨论指标该怎样解释。清单至少要把“数量变化”和“价值变化”分开。公交乘客每人少等十分钟是数量变化;这十分钟对一位按时打卡的护士、对一位可灵活办公的白领,价值并不完全相同。
这一步也会暴露一个常见误区:把所有“钱的流动”都当成社会收益或损失。周宁缴纳的拥堵费,对他是支出;对政府是收入。若只把前者列为成本、后者又列为收益,机械相加后往往会相互抵消。真正消耗社会资源的是收费系统、执法、人们为规避收费花掉的无效时间,以及资金被使用或闲置所带来的机会成本。收费本身还会改变出行选择,因此它不能从分析中消失,但也不能被当作凭空创造的福利。

受益和受损也不能只按某个“平均市民”来写。平均值会掩盖关键差异:一条线路的平均候车时间下降,可能来自核心站点大幅改善,而边缘社区没有任何变化;平均拥堵下降,也可能以某条学校周边道路更吵为代价。把数据按收入、年龄、残障状况、居住地、出行目的和工作时间分组,不是额外装饰,而是避免把一部分人的困境埋进总平均数。
当清单逐渐完整,团队才有资格说“我们正在评价福利”,而不是只在评价车速、财政收入或民意热度中的某一个。后面所有计算,都应能回到这张清单,说明每个数字对应谁、在什么条件下发生。
数字仍然必要,因为公共资源有限。海岚市在方案比较阶段做了一份年度净收益账本。这里的金额是把可合理货币化的影响换算为同一口径后的教学示例;它不是自然界给出的真相,而是一套需要公开假设、接受质询的估计。
先做一个算题。表中小计是“九百六十加一百五十加四十,减去四百一十、二百二十、八十和六十”,即每年约三百八十万元的净收益。假如评估人员同时写入“高峰拥堵费收入一百二十万元”,你会怎么处理?在本表只计真实资源收益与成本的口径下,拥堵费付款与收入均作为边界内的转移支付,不进入净收益小计;若已在消费者损失中扣除了付款,就须相应计入收入以避免单边漏计。需要追问的是:这笔钱是否能稳定地换成公交服务、出行券或其他公共用途,管理它又要付出多少成本。
把时间、健康或安静折算成金额,并不是说它们只值钱。货币单位只是为了让原本不同的影响能在同一张表上比较。常用问题是“人们愿意放弃多少其他消费来换取这种改善”,或“损失发生后,需要多少补偿才能让处境回到原来”。在价格变化不大、收入影响较弱的情境下,消费者剩余常能提供方便的近似;当政策对家庭预算影响显著、替代选择很少时,不能把这个近似当作精确答案。

还要把时间放进账本。今天改造一条走廊,收益和维护支出会持续多年。把未来金额换算成今天可比较的价值,叫作贴现;贴现率越高,远期收益在今天的权重越低。对长期健康、气候和儿童出行机会而言,贴现率并非一个纯技术按钮,它会影响代际之间如何分担成本与享受收益。一个负责任的报告至少应展示几个合理情景,而不是只报一个看似权威的小数点。
账本小计为正,并不等于周宁、配送员和受影响商户的损失已经消失。它只说明:在当前估计下,所有可货币化收益的总量大于所有可货币化成本。经济学中有一种很有用但也容易被误用的判断——如果受益者在原则上能够补足受损者的损失,补完后仍有余量,那么该方案具有“潜在补偿”的意义。它帮助我们识别资源配置是否存在改进空间,却不是一张免除补偿责任的通行证。
请把两种说法严格区分开来:
海岚市若只说“拥堵费收入将用于公共交通”,仍不能保证周宁这样的必须驾车者得到照顾。他可能是夜间照护者、行动不便者的家属,或工作地点无法由公交到达的人。公平的补偿也不一定是发现金:改善无障碍接驳、保留医疗和紧急服务豁免、提供短期过渡方案、调整货运时窗,都可能比统一返还更贴近损失发生的机制。

补偿设计还有三道检查:
如果这些问题没有答案,“可以补偿”只能算一条数学上的可能。
这也解释了为什么现实中很少出现“没有人变差”的方案。福利评价不是借助潜在补偿把少数人的损失抹去,而是把它变成政策设计中的待办事项:谁应被看见,补偿从哪里来,怎样避免支持被错误领取,何时调整,谁可以申诉。
假设有两个方案,净收益都为三百八十万元:
方案甲:
方案乙:
虽然两者的总额持平,很多人会认为这两种方案的社会意义并不一样。这是因为一百元对不同家庭的影响不一样。如何纳入这种关切?最基本做法是分别报告不同群体的损益,而不是只给平均数。也可以用分配权重,让低收入群体的收益在总计时占比更高。还有的做法是先选效率高的方案,再用税收、补贴等解决分配。
这些方法都离不开价值判断。权重多少、如何补偿、用交通还是税收政策调节,都需要公开讨论,而不是唯一标准。好的评价报告会把这些选择和假设写清楚,并说明结论是否依赖于此。
公平还体现在程序上。例如,居民是否知情、弱势群体有没有表达渠道、规则是否可解释和复核?若决策过程只让熟悉政策的人发声,即使账本平衡也会损害信任。信任不是账本里的一个数字,而是影响合作与治理成本的基础。
有些影响很难、甚至不宜被轻率地标价。儿童能否更安全地步行到学校,老人是否因公交可靠而不再放弃复诊,居民是否因为车流绕行而睡眠变差,街道是否仍适合停留和交往——这些都与福利有关。对它们保持“未货币化”状态,不代表把它们排除;更好的做法是并列呈现证据、受影响范围和不确定性,让决策者知道账本之外还压着什么。
尤其要警惕“实施前后比较”的诱惑。若政策推出后拥堵下降,可能是专用道有效,也可能恰好遇到学校放假、油价变化或新的地铁线开通。评价不是为了证明项目负责人最初是对的,而是为了尽量接近“如果没有这项政策,会发生什么”的反事实。随机试点在有些政策中可行;更多时候,需要用相似地区对照、分批实施、行政记录、现场观察和访谈相互校验。
不确定不意味着什么都不能决定。它意味着结论应有条件地表达:在公交班次能够兑现、绕行没有明显转移到学校周边、出行券覆盖目标群体的前提下,方案可能带来正的净收益;若这些条件落空,结论就应被修订。把“停止、调整或扩大”的阈值提前写进方案,往往比事后争论谁预测失误更有用。
到这里,福利评价不应停在一份立项报告里。海岚市可以把它变成一个循环,而不是一次盖章。每一轮都要留下能被复核的假设和数据口径,这样政策改变后,公众才能看懂究竟是现实变了,还是评估方法变了。
评价的输出也应分层。一页给决策者看“净收益区间、主要受损群体、不可跨越的风险和待选方案”;附表给专业人员看计算口径和敏感性;面向居民的版本则用清楚语言回答“你可能会怎样受影响、可以获得什么支持、哪里可以提出异议”。同一套证据,不能因为读者不同就改变事实,但可以因需要不同而改变表达。
回到最初的早高峰。林晓是否准时到岗、周宁是否有可负担的替代方式、配送员能否完成订单、住在支路边的孩子能否安静入睡——这些不是账本之外的插曲,它们正是政策福利的内容。总净收益提供方向,补偿检验我们是否把损失当真,分配分析迫使我们说明谁被优先照顾,不确定性则提醒我们保留修正的空间。
因此,面对“这项政策值不值得”,更成熟的回答通常不是立刻给出“值得”或“不值得”。它可能是:在什么假设下值得;哪些人会受益、哪些人会承担代价;哪些补偿必须先到位;哪些影响不能被一笔金额代替;又要在何时用什么证据重新判断。福利评价的终点不是一条漂亮的结论,而是让公共选择更能经得起不同人的生活经验和后续事实的检验。