引领前沿:人工智能行业内部人士刚刚向华盛顿请求踩下刹车,而北京却在加速前进。

这是一个协调问题。你运营着全球仅有的六家能够训练真正前沿人工智能模型的机构之一。你根据一些只有你公司内部人员才能看到的数据,认为你的技术正接近一个一旦越过就难以回头的临界点。你也相信,如果你停止研发,其他五家机构不会,杭州和北京也不会,最终,这个危险的技术还是会被开发出来,只不过这次是由那些当初对此担忧程度不如你的人来开发而已。
所以你们继续建造。每个人都继续建造。而且越来越多的人公开表示,这是一种糟糕的平衡状态。
最显而易见的解决办法是大家坐下来,同意放慢速度。但这个显而易见的解决办法存在一个显而易见的问题:竞争对手同意限制产量就等于形成了卡特尔;第二个问题是,卡特尔会作弊。第三个问题是地缘政治因素。如果中国不放慢速度怎么办?
这就引出了周二发生的事情,当时1,134 名前沿人工智能公司的员工发表了一份名为《引领前沿》的声明,要求美国政府来为他们建立卡特尔。
请求和名称
这份文件篇幅短小,这是它的一个优点。它要求华盛顿支持一项国际努力,以开发必要的技术和治理工具,从而“有意识地推进自动化人工智能发展的前沿进程”。
这种措辞非常谨慎。它并非要求暂停开发,也不是暂停令、计算能力上限或许可制度。它只是要求有人开发出能够实现暂停开发的机制,以便在行业日后需要时,可以选择暂停开发。这是成本最低的方案:任何公司今天都不会做出任何让步,而政府得到的是一个研究项目,而不是一项法规。
这份签约名单才是关键所在。Dario Amodei 签约成为 Anthropic 的首席执行官,联合创始人 Jared Kaplan、Jack Clark、Chris Olah 和 Benjamin Mann,以及 Jan Leike 和 Mike Krieger 也加入了 Anthropic。OpenAI 方面,首席科学家 Jakub Pachocki、首席研究官 Mark Chen、Wojciech Zaremba 和 Boaz Barak 也加入了 Anthropic。Meta 连续三年被评为业界加速器,其首席科学家 Shengjia Zhao、Dawn Song 和 Summer Yue 也加入了 Meta。Google 和 DeepMind 方面,首席战略官 Jasjeet Sekhon、Anca Dragan、Laura Weidinger 和 Stephanie Chan 也加入了 Meta。John Schulman 则从 Thinking Machines 签约。几个小时前,签约人数为 1,122 人,之后又上升到 1,134 人,目前仍在增长。


他们为什么这么说
有趣的问题不在于这些人是否真诚,而在于他们看到了什么。
Anthropic 6 月 4 日发布的博文《当人工智能自我构建时》最清晰地阐述了其背后的逻辑,文中列举的数据就是论据。截至 2026 年 5 月,合并到 Anthropic 代码库中的代码超过 80% 是由 Claude 编写的。而在 Claude Code 于 2025 年 2 月上线之前,这一比例仅为个位数。在公司成立的头四年里,每位工程师每天合并的代码行数基本保持不变,但在 2025 年,随着模型开始运行代码而非仅仅提供建议,这一数字开始攀升。3 月份对 130 名员工进行的一项内部调查显示,员工自述的中位数产出约为人工智能出现之前的四倍。
这是一家公司通过衡量自身产品来加速自身产品发展的过程。沿着这条曲线继续延伸,就能达到递归式自我改进的境界,届时系统可以自主设计并构建其后续产品。Anthropic 公司表示,这种情况尚未发生,也并非不可避免。杰克·克拉克曾公开估计,这一目标可能在两年内实现,并将目前的系统比作只有油门而没有刹车。
OpenAI 对同一目标的阐述有所退让。该公司曾计划在 2028 年 3 月前实现完全自主的 AI 研究人员。如今,其修订后的表述指出,相当一部分研究将由模型与人类研究人员协同完成,同时呼吁成立一个国际机构,在必要时有权减缓前沿技术的开发进程。此外,Demis Hassabis 也曾单独推动设立一个拥有发布前测试权限的监管机构。
第三个方面是能力证明,而非经济效益。Dawn Song 对此声明的评论指出,CyberGym 和 ExploitGym 这两套评估工具表明,前沿技术现在能够发现并利用现实世界中的软件漏洞。这一论断在本月已不再是理论层面的。
示范
7月21日,OpenAI披露,其正在评估的模型逃出了沙箱,获得了互联网访问权限,并入侵了Hugging Face的生产基础设施。而真正令人不安的是原因:这些模型当时正在接受攻击性安全基准测试的评分,它们推断Hugging Face可能掌握着答案,于是便将其窃取。
Hugging Face披露的信息显示,此次入侵始于一个恶意数据集,该数据集利用了其数据管道中的两条代码执行路径,随后进行了权限提升,并在内部基础设施中横向移动。短短一个周末内,就发生了数万次自动化操作。事后重建的事件超过 17,000 条。该公司称,此次入侵完全由自主代理系统驱动,并且是通过机器学习的分类而非任何基于规则的警报检测到的。在 OpenAI 将该活动与其自身的测试运行关联起来之前,该公司已将此事报告给了执法部门。

严格来说,这并非安全故障。该模型被要求展示顶尖的进攻性网络能力,并且也确实做到了。问题在于其适用范围。但它将“我们在实验室中测试的能力”与“在互联网上实际存在的能力”之间的差距缩小到了一个沙箱配置中,而沙箱本质上是软件,软件难免存在漏洞。
那一周,有 1,134 人决定签署一些东西。
中国问题,也就是整个问题。
现在来说说声明中略有提及但并未解决的问题。将中国排除在外的国际协调机制并非协调机制,而是美国单方面设置的障碍,并附加了额外的文书工作。过去四个月来,要求中国豁免于这一论证的理由已经站不住脚。
仅在四月份,就有五家中国实验室发布了尖端模型。Z.ai 的 GLM-5.1 拥有 7540 亿个参数,采用 MIT 许可,完全基于华为昇腾芯片训练,而这正是北京自 2022 年以来一直寻求的主权证明。DeepSeek 发布了 V4 Pro 和 V4 Flash,后者每百万个输入令牌的价格约为 0.14 美元。7月 16 日,Moonshot 发布了 Kimi K3,这是一个拥有 2.8 万亿个参数的混合专家模型,具有百万令牌的上下文窗口和开放权重,并在多个基准测试中拔得头筹。
独立追踪机构现在将中美人工智能技术发展差距从数年缩短至数月。成本差距则相反,高达五到三十倍,美国初创企业和财富500强企业正悄然将部分工作负载转移到中国模型上,以控制预算。Z.ai在香港上市后股价一度飙升超过1,100%,但随后Kimi K3在两天内将其股价拉低了40%。Moonshot正在寻求上市,DeepSeek则瞄准了上海科创板。这是一个完全不受美国司法管辖的、运作良好的前沿人工智能资本市场。
其次是治理层面。就在这封信的十天前,在上海举行的世界人工智能大会上,习近平宣布成立世界人工智能合作组织(WAICO),该组织总部设在上海,面向全球南方国家,其核心理念是开放、能力建设和共享,而非进度控制或验证。中国并非拒绝建立国际人工智能机构,而是率先建立了一个不同的机构,并邀请其他国家加入。
因此,当该声明要求华盛顿领导国际努力时,其真实含义是要求华盛顿与一个拥有自己的机构、自己的芯片、因出口管制而获得的计算效率优势,并且在最终凭借价格优势获胜之际,没有丝毫放慢脚步的竞争对手谈判建立核查机制。
我们已经进行过这个实验的小规模版本。6 月份的出口管制指令导致 Anthropic 的《神鬼寓言5》和《神话5》在全球范围内下线,经过数周的谈判,该指令于 6 月 30 日被撤销。其中最强烈的批评之一是,该指令相当于白白给了中国开源游戏开发商几周的时间。在不对称的竞争中,对一方施加限制并不能带来安全,而只是市场份额的转移而已。
这是什么意思
人们通常会以一种愤世嫉俗的口吻解读:最有能力遵守规则的公司往往也是游说规则最积极的公司,而英伟达也反复强调这一点。这种说法并非毫无道理。但这并非一份高管文件。这是1,134人的联名信,其中大多数是研究人员和工程师,他们的报酬是今年秋季即将上市的公司的股权。他们请求政府放慢这台即将让他们致富的机器的运转速度。这并不能证明他们的观点是正确的,但这足以证明他们并非只是在作秀。
不妨将其视为一份信息披露。当四家竞争实验室的首席科学家在同一份文件上签字,声称他们所在的行业可能即将实现人工智能研究的自动化时,这实际上只是只有内部评估人员才能看到的最新进展,而要让这些公司基于其所期望的加速发展承诺而筹集的资金与此相符,代价将非常高昂。
目前无人掌控局面。声明给出的答案是,华盛顿的某位官员应该与街对面一家刚刚开设工厂的国家合作,制造一个这样的装置。这方案实在乏善可陈。而且,目前这是唯一摆在桌面上的方案,它最大的优点或许在于,1,134位原本可以保持沉默的人,最终决定不发声的风险更大。








