“世界第一”究竟怎样比较?

发布者:窈窕美男 2026-9-21 10:09

一、先确定比赛项目,再讨论谁是第一

“世界第一”听起来像一项客观称号,但如果不说明比较什么,它往往只是把许多不同问题装进同一个词。经济总量、居民生活、创新能力、国际融资、军事投射与规则参与,既有关联,也存在明显差异。一个国家可以在若干领域领先,却未必能够以可承受成本决定另一个大国的核心选择。

本文的答案是,把比较分成资源规模、转换效率、特定任务表现和长期可维持性四个层次,再根据问题说明权重。排名可以有用,但必须交代年份、对象、口径和用途。没有这些前提,所谓综合实力总分,容易把作者的偏好包装成自然界本来存在的一张成绩单。

这不是为了回避中美比较。恰恰相反,严谨的方法应当允许作出明确但有限的判断:某方在什么条件下能更便宜、更可靠地完成某项任务,差距来自哪里,对手怎样调整会改变结果。它拒绝的是用一项领先替代所有领先,以及用所有复杂性为借口不再检验任何事实。

GPS-3S提供了基本连接:S1解释资源和能力怎样形成,S2解释国家如何配置与使用,S3解释互动后能够获得或维持什么空间。把三层分开,才不会用拥有多少替代能用多少,也不会把一次使用成功当作长期控制能力已经成立。

二、主案例:同一年的经济,可以出现不同的规模排序

世界银行国际比较项目的2021年结果显示,中国按购买力平价计量的经济占全球约18.9%,美国约15.5%。[1] 这两个比例使用同一统计框架和同一参考年,能够支持该口径下的规模比较。但它们不是2026年的实时数据,也不是可以按这个比例直接购买外国企业、装备或金融资产的现金余额。

国际比较项目通过价格比较,改善不同经济体之间产出与支出实际规模的可比性。其2021轮资料还包括2017年修订结果及其他年份的推算,必须把基准调查、修订和外推分开。[2] 同一个年份的数字后来改变,可能来自统计更新,不一定意味着现实经济突然发生了同等幅度的跳变。

市场汇率与购买力口径回答的问题不同。跨境交易需要考虑实际可兑换货币与市场价格,比较境内能够购买的商品服务则要处理各地价格差异。不能把购买力数字叫成“真正的钱”,也不能因为它不能直接兑换,就认定它完全没有资源比较意义。

用一个假设说明:某国在一年内实物产出没有改变,而汇率发生明显波动,以外币表示的名义总量就可能变化。这并不意味着工厂和工程师同时消失,但也不意味着汇率毫无影响;进口设备、外币债务与国际融资条件可能随之改变。真正需要分析的是哪些能力受影响,而不是只选一个让自己排名更高的换算方法。

还要防止把总体购买力用于每一种具体投入。住房、理发、工程施工与进口仪器面对的价格条件不同,整体调整系数不能保证准确代表任何一项特殊采购。若研究的是某个产业,应该尽可能检查该产业的设备、人员与能源成本,而不是拿全国平均换算率代替项目预算。

经济总量也不是可以随时提取的财富存款。期间产出、既有资产、资产负债和可支配现金分属不同账目;某项产出增长能否留下再投资资源,还取决于维护、折旧和收入分配。比较规模时先算清期间,比较韧性时再核对存量和可用性,能够避免把同一笔资源在不同时间重复计算。

进一步比较国家能力,还要问产出能够经过什么渠道转为财政、研发、基础设施和公共服务。较大的经济总量可以提供潜力,资源配置和组织能力却决定潜力怎样兑现。私人收入不能无成本地变成政府预算,普通设备也不能不经调整就完成另一类任务,中间始终存在转换时间与机会成本。

主案例中的第三方同样会改变结果。一个国家可以从海外购买投入,却未必能够在所有情境下保持同样供给;伙伴自己的需求、政策和风险判断会影响合作。将全部进口视为脆弱,或将全部贸易关系视为可随意调用的储备,都是过度简化。总量排序无法替代这种具体供应核对。

因此,经济排名变化真正值得追踪的链条是:产出与价格变化影响可用资源,资源配置改变产业与公共能力,对手及伙伴调整选择,新的反馈再影响增长与合作。只有这些环节反复连接,某种规模领先才可能形成稳定的战略效果。GDP本身不会替国家完成其中任何一次选择。

这个案例也构成最直接的反证:如果两种合理口径可以改变排序,就说明“第一”必须绑定问题,而不是说明其中必有一种统计是阴谋。批评一项指标,应该说明它不适用于哪种用途,而不是因为结果不合意就否定它的全部价值。

三、辅助案例:创新榜的第一,不是国际政治的第一

世界知识产权组织的2025年全球创新指数中,瑞士排名第一,美国第三,中国第十;报告综合了约八十项创新相关指标。[3] 这组结果提供了关于创新生态的比较,但不能解释成瑞士因此拥有最大的全球军事或政治影响,也不能把中国的第十写成所有技术领域都居于第十。

综合指标必须处理选择、标准化、权重和加总。经合组织与欧盟联合研究中心的复合指标手册,专门讨论了这些方法及不确定性、敏感性问题。[4] 方法透明,并不能让权重变成没有价值判断的自然常数;它只是使读者能够知道指标如何形成,并检验改变合理假设后结论是否仍然稳定。

一个国家拥有大量企业和人口,可能在总量上占优;一个较小经济体可能在单位资源效率和制度环境上表现突出。比较创新时,两种信息都重要。国家战略研究需要分别记录规模、质量、转化与韧性,不能把人均优势直接当作总量优势,也不能用总量掩盖明显的效率差距。

对中美而言,这意味着双方都要接受同样标准。中国数量改善是值得记录的变化,美国关键前沿与商业网络也是需要核验的资产。不能在中国领先时只谈数量,在美国领先时只谈无法测量的“真正质量”,也不能反过来把所有质量问题都说成不重要。

四、辅助案例:物流排名与生活质量,各有自己的问题

2023年物流绩效指数采用六个维度的专业人士调查;世界知识产权组织对世界银行数据的收录显示,新加坡该年综合得分为4.3,排名第一。[5] 这能帮助观察跨境物流环境,却不是测量全部国内运输,更不是战时全球调度能力的综合分数。评分对象、样本和用途决定了它的解释边界。

更重要的是,指标本身会变。世界银行2025年推出的物流绩效指标新框架,转向以运输、航空、邮政等实际运作数据观察连接、速度与可靠性。[6] 因此,不能把新框架中的一个数直接接在旧调查排名后面,宣布同一指标连续改善或恶化。版本更新首先要求重新检查可比性。

联合国开发计划署的人类发展指数,则从健康、教育和生活水平三个维度衡量人的发展。[7] 它并不声称测量霸权,也不应被强行转换成霸权。一个国家维持很强的外部影响,未必意味着所有居民的机会都最好;一个社会改善生活质量,也不必先成为最大的国际军事中心。

这两个辅助案例共同说明,国家研究需要容纳不同目标。物流工具帮助识别运输问题,发展指标提醒我们关注人的实际生活。战略能力当然重要,但不能因为研究国际竞争,就把社会福祉从评价中删除;也不能因为重视福祉,就假定外部约束不会影响长期选择。

五、投入、产出与可调用性,不能在一张表里重复加分

军事支出是典型例子。斯德哥尔摩国际和平研究所的方法说明列出了军费范围、数据来源和可比性限制。[8] 支出能够显示资源投入,却不是直接的作战效果;汇率、工资、采购结构、维护和核算差异都会影响解释。本文不把某个预算总量换算为胜率,也不提供具体军事行动建议。

同样,研发、专利和高技术产品收入处在不同环节。若把它们不加区分地相加,可能对同一条能力链重复奖励;若全部只取投入,又可能忽略结果。合理的账本应当保留各环节,而不是为了总分好看,把一个成功项目在多个栏目中反复当成独立实力。

国际货币基金组织份额公式将GDP、开放度、经济波动和储备等变量结合,用于其特定制度目的;GDP部分还混合市场汇率与购买力口径。[9] 这说明,机构选择权重是为了处理具体分配问题,不等于这些权重可以直接复制为“世界第一公式”。用途不同,指标安排就需要重新论证。

可调用性还需要另外评估。企业总部所在地、生产所在地、所有权和危机中的实际使用权可能不同;盟友也有自身目标。把某国所有跨国企业收入与全部伙伴资源机械相加,会高估控制范围。真正重要的是在具体任务中谁愿意投入多少,以及组织这些投入要付出什么代价。

六、最强反方:决策终究需要排序,分得太细会不会失去答案

最有力的反对意见是,预算和时间有限,国家与企业不可能永远只列维度、不作判断。若所有问题都以“各有优势”结束,复杂方法就可能变成拒绝承担结论责任的工具。这个批评成立,分维度不应取消排序,而应使排序拥有明确的任务和可检验假设。

可以先设定几个不互相混淆的任务:保障境内基本运行、发展某项前沿知识、可靠提供跨境服务,或参与制定特定规则。然后分别明确需要什么资源、允许多少成本、评价多长时间。任务明确后,就可以有条件地比较谁更有优势,而不必先证明某国在整个世界一切问题上第一。

这里存在一个重要例外:关键短板可能不能被其他长板简单补偿。假设一个系统缺少无法替代的核心投入,再多普通产能也不能立即恢复;此时使用简单加权平均,会把真正的瓶颈稀释掉。应先检验最低必要条件,再比较超过门槛后的成本与质量,而不是所有指标都无限互换。

随后进行敏感性检查。如果稍微改变一个合理权重,结论就完全翻转,应公开其脆弱性;如果在多组合理条件下,某方仍能更可靠地完成任务,判断就更稳健。不确定性不是不作判断的理由,而是决定结论应该说多强、需要观察什么新证据的依据。

七、比较必须把对手适应和第三方选择放回来

一次排名是截面,长期竞争是互动。中国在某项领域扩大能力,可能获得规模收益,也可能推动美国投资新路线;美国加强某种网络,可能提高效率,也可能增加伙伴的备份需求。若只把今天的优势线性外推,就会把本应解释的第二轮反馈提前删除。

中国最需要避免的负债,是为了改善指标而偏离任务。追求项目数量、预算比例或排名名次,如果没有提高可靠产出和实际收益,就可能消耗资源。美国也可能在既有高分中忽略维护、成本和新进入者问题。方法必须对双方对称,不能给中国设置无限未来潜力,却把美国冻结在现状。

第三方尤其不应只作为加分项。它们会比较不同供应者,追求自身收益,并可能选择分散合作。中美某一方有更大总量,不等于对方一定愿意追随;某次外交支持也不等于所有领域承诺。衡量体系能力,需要记录参与条件、投入比例和合作持续性,而不只是伙伴名单的长度。

历史类比也必须服从这一纪律。英国在不同领域被美国赶超,并不是所有能力同时归零;过去某个工业强国失败,也不能证明工业没有用。可借鉴的是资源怎样经由组织和选择转为效果,不能照搬旧时代的指标权重。技术、制度与相互依赖变化后,比较方法本身也要接受更新。

八、一份可信的世界实力比较,应交代四件事

第一,交代题目:比较哪个主体、哪个领域、什么任务与时间窗。正常商业环境与高压环境分开,单个国家与实际可动员网络分开。标题可以简洁,正文必须补齐这些边界;否则读者无法知道“第一”究竟在哪一种意义上成立。

第二,交代数据:来源、年份、单位、分母、修订情况与统计边界。基准调查、推算和预测分开,不能用新发布日期掩盖旧观察年。对无法核验的数字不作精确推断,缺失项目标为缺失,而不是默认为零或替某方补入想象中的优势。

第三,交代转换:资源通过什么机制形成可用能力,哪些瓶颈不能简单补偿,伙伴愿意投入多少。采用权重时公开依据,涉及反事实时说明假设。无论结果有利于哪一方,都不以总分代替因果链,不用一个量级直接推出另一种权利。

第四,交代失效条件:在三至五年或更长窗口内,哪些变化会推翻判断。对“为赢”,重要的不是永远找到中国排第一的指标,而是检验中国能否持续减少外部强制、扩大可靠选择并参与规则形成。这样的比较可以得到鲜明结论,但结论必须允许现实纠正;这比一份无法说明如何计算的冠军证书更有长期价值。

“为赢”是“为什么中国一定赢”的简称。

本账号内容由作者利用AI、与AI共同完成。AI承担大量资料查找、总结归纳、逻辑梳理和文字编辑工作;作者负责选题、判断、审核并承担发布责任。

主要参考资料

[1] 世界银行,ICP 2021: Economic size of economies;页面未标统一发布日期,采用文内历史或统计年份。核验范围:2021年购买力平价GDP,中国全球份额18.9%、美国15.5%;不作为现行汇率或2026年排名。
https://www.worldbank.org/en/programs/icp/brief/ICP2021_DataViz_1

[2] 世界银行,International Comparison Program: Data;页面未标统一发布日期,采用文内历史或统计年份。核验范围:2021年基准、2017年修订及其他年份外推的区别。
https://www.worldbank.org/en/programs/icp/data

[3] WIPO,Global Innovation Index 2025: Switzerland, Sweden, US, Republic of Korea and Singapore Lead; China Enters Top 10;2025-09-16。核验范围:2025年综合创新榜、约80指标;不作为2026榜或单项能力排名。
https://www.wipo.int/pressroom/en/articles/2025/article_0009.html

[4] OECD/JRC,Handbook on Constructing Composite Indicators: Methodology and User Guide;2008。核验范围:综合指标构造、方法透明与解释限制;官方出版介绍,不声称已逐页阅读全书。
https://www.oecd.org/en/publications/handbook-on-constructing-composite-indicators-methodology-and-user-guide_9789264043466-en.html

[5] WIPO全球创新指数指标页,Logistics performance;页面未标统一发布日期,采用文内历史或统计年份。核验范围:世界银行2023年物流绩效调查6维度;新加坡4.3分;官方再发布的原机构统计,不推广为2026排名。
https://www.wipo.int/gii-ranking/en/indicators/322

[6] 世界银行,LPI 2.0;2025。核验范围:2025版采用2023—2024年运营数据、与此前调查方法不同;不直接拼接分数。
https://lpi.worldbank.org/en/home

[7] UNDP,Human Development Index;页面未标统一发布日期,采用文内历史或统计年份。核验范围:健康、教育、生活水平三维度;定义用途,不作国家综合国力排序。
https://hdr.undp.org/data-center/human-development-index

[8] SIPRI,Military expenditure: Sources and methods;页面未标统一发布日期,采用文内历史或统计年份。核验范围:军事支出统计范围与方法;投入不是战场效果或全部安全能力。
https://www.sipri.org/databases/milex/sources-and-methods

[9] IMF,IMF Quotas;页面未标统一发布日期,采用文内历史或统计年份。核验范围:份额公式包含经济规模、开放度、经济变化和储备等变量;制度用途不等于通用国力公式。
https://www.imf.org/en/about/factsheets/sheets/2022/imf-quotas

大家都在看

相关文章