国产大模型调用量全球领跑,美国巨头会议室里吵翻了天

发布者:逸飞而过 2026-8-3 10:09

2026年8月,两份几乎同时发布的报告,在太平洋两岸掀起了截然不同的风浪。

第一份来自中国数据研究中心,白纸黑字写得清楚:中国头部开源大模型的周调用量已突破5.34万亿Token,连续多周在全球开源模型调用榜上稳居第一。阿里Qwen系列、DeepSeek系列、月之暗面Kimi系列,三个中国品牌占据了全球开源模型调用量的前五席中的三席。

第二份来自美国国会下属的美中经济与安全审查委员会。报告的核心结论只有一句话,却让硅谷的AI巨头们后背发凉:美国在AI大模型领域的领先优势正在以超出预期的速度收窄,中国开源模型的全球生态占有率已从2024年的不到一成飙升至2026年中的近四成,增速是同期美国开源项目的两倍以上。

简单翻译一下这两份报告的意思:中国大模型不仅追上来了,而且在开源这条赛道上,正在把美国甩在身后。

消息传到硅谷,几家闭源巨头的会议室里据说吵翻了天。有的高管拍桌子说要加大游说力度,推动华盛顿出台更严厉的对华AI禁令。有的技术负责人冷冷地回了一句:禁什么禁?我们自己内部都在偷偷用他们的开源权重做微调,你以为禁令能拦住谁?

这句话,把会议室所有人都干沉默了。

一、调用量不撒谎

全球开发者为什么疯狂涌向中国开源模型?答案简单到硅谷不愿意承认:便宜,好用,而且不卡脖子。

旧金山一位独立开发者算过一笔账,这个账本被晒到X上之后获得了十几万次转发。他说自己做的是一款面向中小学生的AI辅导应用,日活大概十万。如果接OpenAI的API,按照每百万Token几美元的费率,一个月的账单妥妥超过四万美元。而切换到中国开源模型,把权重下载到本地服务器部署,同样规模的调用量月成本不到两千美元。

从四万到两千,差了整整二十倍。

这不是个例。美国“小型科技协会”今年夏天做了一份内部调研,超过两百家硅谷初创公司已经将部分甚至全部AI工作负载从闭源API迁移到了中国开源模型。迁移的首要原因不是政治立场,不是技术偏好,就是纯粹的生存账——融的钱快花完了,API账单成了压垮骆驼的最后一根稻草。

调用量不会撒谎。Token就是开发者的选票,每一张票都投给性价比最高的那个。中国开源模型之所以能在全球调用榜上霸榜,根本原因不在于参数有多大、跑分有多高,而在于它们让普通开发者用得起顶级AI。

这是互联网时代Linux取代Unix的故事,在AI时代的重演。历史从来不会重复细节,但总是押着同样的韵脚。

二、美国政客喊着封锁,硅谷程序员忙着部署

调用量霸榜之后,华盛顿的反应一如既往:封。

几周前,美国财政部高官公开警告,称中国企业利用“模型蒸馏”技术“窃取”美国大模型能力,扬言要出台更严厉的出口管制,甚至考虑立法禁止带有中国开源权重的代码在受美国监管的云平台上运行。

结果这份警告还在走内部审批流程,硅谷那边先炸了。

由隐私保护巨头Proton、顶级孵化器Y Combinator生态企业等近两百家硅谷公司组成的“小型科技协会”,连夜写了一封联名公开信递到华盛顿。公开信的核心意思就一句话:别封,我们都用着呢。你这一刀下去,中国AI伤没伤不知道,美国九成的AI初创公司明天就得断气。

这不是表态,这是求救。

更让华盛顿难堪的是,连美国国防部的部分AI项目也在使用中国开源模型的权重进行测试。一位不愿具名的国防承包商工程师在技术论坛上匿名发帖说:“我们对比过七个国家的开源模型,中国模型在同等算力条件下的推理效率是最高的。这是纯粹的工程优势,跟政治没关系。”

这句话点到了一个关键:中国开源模型不是靠抄袭领先的,而是在被封锁的条件下,被逼出来了一条极致工程效率的路线。

美国禁售高端GPU给中国,中国团队就在算力受限的情况下拼命优化架构。稀疏异构MoE、多头潜变量注意力机制、FP8混合精度微调——这些技术名词听起来枯燥,但它们共同构成了中国大模型“把算力利用率拉满”的核心竞争力。用更少的卡做出能打的产品,这是被封锁逼出来的硬功夫。

现在这个硬功夫正在反向输出全球。硅谷公司用中国模型不是因为“爱中国”,而是因为“账算得过来”。商业世界最诚实的东西就是账单,账单不会撒谎。

三、“追不上的不是模型,是生态”

如果只是调用量领先,硅谷还不至于焦虑。真正让会议室吵翻天的是,开源生态一旦形成,追回来的难度远超想象。

过去十年,硅谷靠着Linux、Android、PyTorch的开源生态吸引了全球最顶尖的开发者,形成了“开源即硅谷”的行业共识。但现在,这个共识正在被松动。中国开源大模型在全球开发者社区里正在构建一套平行的引力场——以Hugging Face为集散地,以Ollama和llama.cpp为部署工具,以中国模型的低成本高性能为核心卖点,一套完整的去西方化AI生态正在悄然成型。

一位谷歌DeepMind的工程师在内部备忘录里写了一段被媒体曝光的话:“我们曾经认为,开源生态是美国的护城河。但现在,中国团队正在用比我们更开放、更彻底的开源策略,把这条护城河填平。我们追不上的不是模型本身,而是模型开源之后,全球开发者围绕它自发生长出来的生态。”

这不是危言耸听。全球开发者在Hugging Face上为中国开源模型贡献的Star数、Fork数和社区讨论量,在短短一年内翻了将近五倍。每一个Star背后都是一个愿意为这个生态贡献时间的活生生的工程师。他们可能不讲中文,可能从没去过中国,但他们选择了中国模型,因为好用,因为开源,因为便宜。

硅谷会议室里争论的,表面上是“要不要对中国AI加码封锁”,骨子里是谁都不愿意承认的一个事实:在开源这条路上,美国正在丧失主场优势。

闭源巨头们曾经用价格和围栏把AI变成了昂贵的奢侈品,中国开源社区则用开放和性价比把它变成了大众消费品。开发者永远站在最便宜、最开放、最自由的那一边,这和意识形态没有关系,这是人性。

会议室里的争论还在继续,但会议室外的代码仓库不会等人。每一次硅谷高管拍桌子讨论要不要封锁的时候,GitHub上又会多出几十个基于中国开源模型的新项目。抱怨声再大,也盖不过代码提交的声音。

大家都在看

相关文章