各种指数与排名
透明国际自一九九五年起发布的腐败感知指数,没有一丝一毫的法律效力。它不使任何人负有义务,不强制任何事,也不引起任何后果。然而各国政府却聘请顾问,为的是在它里面往上走,并且把上升当作成绩来宣布。信用评级机构是私人公司,它们对一个国家偿付能力的意见,能把这个国家的借款成本推动数十亿。
教训。 一个被系统地公布的数字,会取得谁也没有给过它的影响力。机制是:定期、可比,以及第三方的引用。
六个案例:人们毫无权限——而人们仍然要把他们算在内;以及最接近把深度与规模结合起来的两次尝试
看上去,没有权限就无法产生影响。这是不对的,实践推翻了它。下面是六个案例——四个成功的,两个失败得很有教益的。举出它们不是为了证明谁有理,而是作为对自己提出要求的来源:从中可以看出,究竟是什么使一件工具贵到不能被忽略。
透明国际自一九九五年起发布的腐败感知指数,没有一丝一毫的法律效力。它不使任何人负有义务,不强制任何事,也不引起任何后果。然而各国政府却聘请顾问,为的是在它里面往上走,并且把上升当作成绩来宣布。信用评级机构是私人公司,它们对一个国家偿付能力的意见,能把这个国家的借款成本推动数十亿。
教训。 一个被系统地公布的数字,会取得谁也没有给过它的影响力。机制是:定期、可比,以及第三方的引用。
世界银行曾经发布《营商环境报告》,评估一百九十个经济体的营商条件。它的影响力极大:各国改写立法,为的是在它里面往上走。二〇二〇年六月,银行内部报告了二〇一八年和二〇二〇年报告中存在的违规行为,此后发布被暂停,核查交由一家外部律师事务所进行。调查确定,为了改动个别国家的指标,有人对编制该指数的团队施加过压力。二〇二一年九月十六日,世界银行宣布终止这一排名。 不是暂停,是终止。它没有被恢复:接替它的 B-READY 是另行建立的,名称不同,方法也不同。
与第一条相反、而且更为重要的教训。 这类工具的全部资本就是对程序的信任。它不是一点一点花掉的,它是整个地、一次性地失去的。
政府间气候变化专门委员会根本没有任何权限:它什么也不决定,不使任何人负有义务,也不拨出一分钱。然而它的评估报告却为每一轮气候谈判确定框架——人们是在它的结论之内争论,而不是绕开它争论。
影响力从何而来?不是来自科学家的权威:有权威的科学家很多,而他们的意见彼此分歧。影响力来自编制的程序:公开的评议、公布的意见及对意见的答复、被记录下来的分歧、由各国政府参与逐行核定的最终摘要。没有什么可争的,因为过程完整可见,包括没有取得一致的那些地方。
教训。 使一段表达无法被忽略的,不是它的内容,而是取得它的程序的透明。
互联网赖以运行的标准,由 IETF 和 W3C 确立——这些联合体不由任何国家设立,自愿行事,没有丝毫权限。IETF 一九九二年确立的工作原则是这样说的:“粗略的共识与可运行的代码”。世界经济就架在这些标准上。没有人向任何人请求过许可。
教训。 如果你所产出的东西是所有人都需要、而且别处再也拿不到的,地位随后会自己到来。
爱尔兰两次依照没有任何权限的机构的工作结果修改了宪法。
二〇一二至二〇一四年的宪法大会建议允许同性婚姻——在二〇一五年五月二十二日的公民复决中,62% 的投票者予以通过。二〇一六年七月由议会设立、二〇一八年春季结束工作的公民大会建议废除第八修正案——在二〇一八年五月二十五日的公民复决中,66.4% 的人支持废除,投票率为 64.1%。
两次的成员是按不同方式遴选的,而这个差别很有教益。宪法大会的一百名成员之中,六十六人是抽签选出的公民,三十三人是现任政治家,第一百人则是任命的主席。公民大会走得更远:它的九十九名参与者无一例外全部由抽签选出,成员之中根本没有政治家,主席另行任命。两次的参与者都用若干个月研究问题,听取专家和争论双方的意见,公开讨论并且投票。
教训。 给予正当性的不是选举产生,而是透明的遴选程序和公开的讨论。随机选出、把问题弄清楚了的人,对社会来说比选出来的政治家更有说服力。
一九六六至一九六七年的越南问题罗素法庭,以及十二年之后设立的常设人民法庭,就极为沉重的问题作出过准备周密的结论。它们的成员是自我任命的,代表性没有以任何方式确立,权限则根本没有。在道义上人们尊重它们。在政治上人们完全忽略它们,而且已经这样做了几十年。
教训。 没有可核实的构成,任何一道程序,哪怕无可挑剔,也仍然是一群受尊敬的人的私人意见。
把六个案例放在一起,就得到一份不取决于任何人好恶的要求清单。
第一。工具产出别处拿不到、而又确有需要的东西。不是“重要的意见”,而是数据或者程序,缺了它们就有人没法工作。第二。程序整个可见——不只是结果,还有它是如何得出的。第三。它定期运作,并且前后可比:一次测量是新闻,一连串测量是动向,而动向是不得不算在内的。第四。各方同样地使用它:只对一方有用的工具就是武器,人们会连同那一方一起拒绝它。第五。构成可核实:已知并且可以确认,测量背后站着活着的、唯一的人,他们每一个人都只表达了一次,而且是自愿的。
前四项属性不需要发明——它们是被遵守的,因此对任何愿意接受这份纪律的人都是开放的。第五项的性质不同:它无法靠意愿去遵守,只能被建造出来。
还有第二条反对意见,它比“你们没有权限”更有力:就一个复杂问题去问数以百万计未经准备的人,并不比问一千个未经准备的人更好,它只是规模更大。这条反对意见是成立的。规模本身并不带来判断的质量,而大量考虑不周的回答,就是大量考虑不周的回答。
最接近解决它的是詹姆斯·菲什金自一九八八年起同斯坦福大学一道进行的协商式民意调查:随机抽样,研读经过校核的材料,在小组内讨论,向持相反观点的专家提问,然后再测一次。这样的试验已经做过一百五十多次,遍及五十多个法域。那里有抽签,有准备,也有前后两次测量。缺的是两样东西:规模和可核实的构成。
第二接近的例子是二〇二一年的全球大会:一百人,由抽签在全世界范围内选出,使成员在年龄、性别、出身和收入上与地球的居民相称;十一周内工作六十八小时;最终宣言在格拉斯哥气候大会上宣读。看来这是迄今达到的深度上限——而它止步于一百人。
由此可以看出所有这类尝试所面对的岔路。公民大会有深度而没有规模:一百人把问题弄清楚了,但他们不能以社会的名义说话。公民复决有规模而没有深度:数以百万计的人投了票却没有弄清楚,而且常常是就权力机关拟定的表述投票。妨碍把二者结合起来的,正是上面说到的那件事:无法在远距离上诚实地遴选并诚实地清点人。
由此也就看出,一份可核实的、由唯一的人组成的名册,对于举办这类大会的人有什么实际价值:它们之中最薄弱的地方,是从哪里拿到一份名单,使得从中抽样的随机性不被任何人质疑。名册解决了这个问题,而且解决得中立:抽签没有立场,对任何一方同样适用。
这一切对测量的构造意味着什么,以及为什么第五项属性成了决定性的,见《公民的声音》文件。