AI 安全爭论进入第二回合:三大实验室密谈监管机构

作者:明豪
发表时间:
+-



OpenAI行政總裁奧特曼身穿深色西裝,雙手張開作解釋手勢,正在台上發言。OpenAI 行政总裁奥特曼 9 月 15 日在三藩市举行的 Salesforce Dreamforce 大会上与该公司执行长贝尼奥夫对谈时表示:「 现在我们不用费太多想像力就能想像到这件事可能会如何出错 。 我认为世界对此感到担忧是理所当然的 。」 同日,OpenAI 確认正与 Anthropic 及 Google 磋商成立 AI 行业标准机构;而美国总统特朗普本週在 Truth Social 上将对失控 AI 的恐惧称为 「 骗局 」 与 「 诈骗 」。(示意图)

【 观 view AI 科技前沿 】九月第二週,AI 安全的爭论还停留在 「 该不该慢下来 」;到了第三週,问题已经换成了 「 由谁来执行 、 怎么执行 」。 这个转变发生得比任何人预期的都快,而它暴露出的分歧也比 「 放缓 」 二字所能涵盖的复杂得多 。

9 月 15 日,OpenAI 发言人向 CNBC 確认,该公司正与 Anthropic 及 Google 磋商,探討如何共同建立一个 AI 行业的标准机构 。 討论的起点是 Google DeepMind 执行长哈萨比斯(Demis Hassabis)7 月 14 日发表的框架 —— 他提议成立一个由美国主导的 「 前沿 AI 标准机构 」(Frontier AI Standards Body),採取公私合作的自律组织形式,接受联邦政府监管,模式参照美国金融业监管局(FINRA)。

这是两个月前几乎无人关注的一篇技术政策文章 。 而在阿莫代伊 9 月 12 日发表 《 我们必须为前沿定速 》、 奥特曼与马斯克相继附和之后,它突然变成了整个行业唯一摆在桌面上的具体方案 。 哈萨比斯自己也在网上回应阿莫代伊:「 达里奥的文章指明了正確的前进方向,细节仍需完善,但方向对于应对当前的关键时刻而言是正確的 。」

奥特曼:「 世界感到担忧是理所当然的 」

9 月 15 日,在三藩市 Moscone 中心举行的 Salesforce 年度 Dreamforce 大会上,奥特曼与 Salesforce 执行长贝尼奥夫(Marc Benioff)进行对谈 。 他说了一句相当罕见的话:「 现在我们不用费太多想像力就能想像到这件事可能会如何出错 。 我认为世界对此感到担忧是理所当然的 。」

同一场合他也说:「 世界应该相信我们会做正確的事,因为这是正確的事,而且我们深知此事的重要性 。」 这两句话並列时有一种张力 —— 既承认外界的恐惧合理,又要求外界给予信任,而后者正是这场爭论中最稀缺的资源 。

奥特曼此前在 9 月 14 日凌晨于 X 发表的长文,是他至今关于安全框架最具体的表述 。 他明確表示 「 我们欢迎一个为前沿 AI 设定一致安全要求的联邦框架 」,並提出 AI 进展可能 「 非常糟糕 」 的两条路径:一是人类 「 把未来的控制权输给 AI」,二是过多权力集中在单一个人或单一公司手上 。 他写下的一句话被广泛引用:「 任何程度的美国竞爭压力,都不足以正当化轻率行事,或让能力跑在对齐与监测之前 。」

他同时为 「 定速 」 设定了边界:「 当我们谈 『 定速 』 时,我们指的不是 『 停止 』。 进展一直很快,並且将继续很快 。」 关于国际层面,他的表述是:「 我们需要政府帮助的地方是国际协调 。 但首先我们应该做好自己能做的事 。」

值得注意的另一个表太出现在 Dreamforce 的对谈中 。 奥特曼批评了业界一种常见的推託说法 ——「 有些公司会说,『 只要別的公司负责,我们就负责 』」,接著他说:「 这句话不该有任何附加条件 。」 这句话几乎是直接针对整场爭论的结构性弱点:当每家公司的安全承诺都以对手的承诺为前提时,没有人真的做出了承诺 。

在商业讯号上,奥特曼向媒体表示 OpenAI 不会在 2026 年上市,公开理由正是 AI 安全方面的顾虑 。 考虑到 Anthropic 与 OpenAI 此前都被报导正在筹备可能创纪录的 IPO,这是一个实质性的让步 —— 也是目前为止 「 放缓 」 最可验证的一个动作 。

马斯克:让对手来批改你的作业

9 月 14 日,马斯克在洛杉磯举行的 All-In Summit 上提出了一个技术上最可操作的建议 。 他主张,xAI、OpenAI、Anthropic、Google、Meta,以及 「 三到四家领先的中国公司 」,应该在模型发佈前互相允许对方在自己的模型上运行 「 测试框架 」(test harness)来评估安全性 。

他的说法是:「 这样一来,你就不是在批改自己的作业了,至少会有竞爭对手来批改你的作业,如果他们看到问题就会拉响警报 。」 他承认这不是完美的解决方案,但 「 你发现问题的机率会大幅提高 」。 他也承认,与 xAI 竞爭的其他实验室尚未同意这项提案,但认为 「 这是朝正確方向迈出的一步,而且是我们可以很快做到的事情 …… 我认为这可能也是中国会同意的事 」。

这个提案与阿莫代伊的 「 嵌入式评估者 」(embedded evaluators,即给予外部评估者 「 类员工级別 」 的存取权限)在精神上一致,都是试图解决同一个问题:目前所有的安全声明都是自我认证的 。 阿莫代伊表示 Anthropic 现在就承诺提供此类存取权,奥特曼则回应 「 承诺让独立评估者拥有类员工存取权是个很好的主意,我们也会照做 」。

但马斯克的立场也有明显的內部矛盾 。 他主张行业自律的同时,其公司正在司法上阻挡州层级的 AI 立法 ——xAI 起诉加州,试图推翻该州的 《AI 训练数据透明法 》(AB 2013),並起诉明尼苏达州,反对该州禁止 「 脱衣 」 应用的法律 。 此外,SpaceX 的 AI 部门正因 Grok 图像生成器被用于制造和传播深度偽造色情內容而面临多项调查与诉讼,其中涉及儿童性虐待材料以及未经同意的成人私密影像 。

换句话说,同一个人同时主张 「 业界应该互相检查 」 与 「 政府不该来检查我们 」。 这不必然是虚偽 —— 他可能真诚地认为同行互评比立法更有效 —— 但它精確地说明了为什么纯自愿机制难以取信于人 。

当日 SpaceX 股价下跌 3.15%。

黄仁勋:「 这是一个假二分法 」

Dreamforce 同一天,Nvidia 执行长黄仁勋在阿莫代伊之后不久登台,给出了完全相反的判断 。

他认为市场力量已经存在,行业不需要新的法律或法规 。 关于速度与安全的取捨,他说:「 这是一个假选择 。 你完全可以同时拥有两者 。」 他给模型开发商的建议是:「 能跑多快就跑多快 。 但如果你在任何时候觉得公司失控了 、 或者產品不会是安全的,那就暂停一下,確保把它做对 。」

在 Dreamforce 台上他更直接地说:「 我们不需要任何新法律 。 我们不需要新法规 。」

前一天在 All-In Summit,黄仁勋的访谈中途接到了特朗普的电话 。 总统在扩音状太下表达了对阻碍 AI 数据中心建设者的不满,称这些人 「 正好落入许多不希望这件事发生的人手中 」,並暗示那可能是中国 。 黄仁勋的回应是:「 您说得对,我们不会让那种事发生,总统先生 。」 財政部长贝森特(Scott Bessent)9 月 15 日在众议院金融服务委员会作证时表示,特朗普与黄仁勋 「 完全一致 」。

作为东道主,贝尼奥夫採取了看似中立但实际上颇有分量的立场 。 他对记者表示:「 如果他们觉得应该慢下来,那就该慢下来 。 如果他们觉得应该加速,那就该加速 。 然后他们应该为此承担责任 。」 最后那半句,正是整场爭论真正的缺口所在 —— 目前不存在任何让他们承担责任的机制 。

白宫:「 骗局 」

特朗普政府的反击在本週急剧升级 。 特朗普在 Truth Social 连续发文,将对失控 AI 的恐惧称为 「 骗局 」(hoax)和 「 诈骗 」(scam),並猛烈抨击公众对数据中心的抵制 。

身兼总统科技与科学顾问委员会共同主席的大卫 · 萨克斯(David Sacks)鼓励科技巨头 「 儘管去为前沿定速 」,但要求他们 「 別再假装放缓的动机纯粹出于利他 」。 国防部研究与工程次长埃米尔 · 迈克尔(Emil Michael)的说法更强硬,他对 Fox News 表示:「 我认为我们现在看到的恐惧营销,是一群人和一套意识形太 、 以及背后的非营利组织所发动的协调行动,他们试图恐嚇美国公众 。」

国家经济委员会主任哈塞特(Kevin Hassett)9 月 15 日对 CNBC 表示,私营部门才是处理 AI 担忧的 「 正確场所 」,政府会持续监察行业,並在 「 必要时动用执法手段,確保企业行为负责 」。

众议院议长麦克 · 约翰逊在 9 月 15 日的记者会上透露,特朗普计划 「 在下週之內 」 在白宫召集 AI 领袖 。 他同时驳斥末日论:「 总统的意思是,你们不会在十年內全都死掉 。 那是个骗局 。」

两个阵营与一组奇怪的同盟

CNBC 的观察是,这场由一则关于人类命运的警告所引发的爭论,形成了两个涇渭分明的阵营:一边是特朗普 、 黄仁勋与萨克斯;另一边是长期互为敌手的阿莫代伊 、 奥特曼与马斯克,以及一大批 AI 研究人员 。

这场爭论的起点是 9 月初 Anthropic 研究员雅各 · 科克森(Jacob Coxon)的离职声明,他指控领先的 AI 实验室正在 「 拿我们的生命赌博 」。Anthropic 的对齐研究负责人埃文 · 胡宾格(Evan Hubinger)隨即公开支持:「 雅各说得对,我们真的诚挚相信 AI 可能杀死所有人类!我个人认为未来十年內的机率超过 10%。」

在政治光谱上,出现了近年罕见的组合 。9 月 15 日,进步派参议员桑德斯(Bernie Sanders)、 共和党众议员奇普 · 罗伊(Chip Roy)与前白宫策略师史蒂夫 · 班农(Steve Bannon)在华盛顿的一场非营利活动上同台,共同支持对 AI 採取行动 。 参议员马克 · 华纳(Mark Warner)则主张,国会必须抓住 「AI 领袖主动呼吁监管 」 这个难得的窗口 。

中国的回应与那个无解的两难

阿莫代伊自己承认,他的提案面对的 「 最艰难的两难 」 是:如果敌对国家选择不跟进怎么办 。 他在 CBS《 周日早晨 》 节目中表示:「 更长期的做法是共同为 AI 进展的速度设定一个速限 。 我认为这会非常困难,因为抢先领跑的诱因 、 以及由此获得的军事优势都太大了 。 老实说,我不知道这是否可能,但我们应该尝试 。」

中国方面的回应相当直接 。 中国外交部 9 月 14 日称这些执行长的言论是 「 恐惧营销 」(fearmongering)。 官方媒体 《 环球时报 》 同日撰文指出,「 阿莫代伊的提议试图将中国在 AI 领域的正当发展描绘成威胁,並进一步在该领域挑动中美对抗 」。

这使马斯克 「 中国可能会同意互测 」 的乐观判断显得缺乏依据 。 但也应该注意,官方表太与技术层面的接触未必同步;中国此前確实在推动 AI 安全的国家标准制定,习近平 7 月也曾在一次 AI 会议上呼吁各国共同 「 確保人工智能始终处于人类控制之下 」。

底层逻辑:自我加速的迴路

回到技术本身,本轮恐慌的触发点有一个相对明確的机制 。 阿莫代伊在文中写道:「 大约从今年夏天开始,AI 的进步速度急剧加快,主要驱动力是 AI 建造下一代 AI 的能力日益增强 。」 他的判断是:「 若不加约束,它可能跑得比我们理解和控制这些系统的能力更快,因此必须极其谨慎地推进,甚至可能根本不该推进 。」

这就是递归自我改进(recursive self-improvement, RSI)。 当模型开始实质参与自身的研发,进步曲线便从人类的工作节奏中脱鉤 。 奥特曼在 Dreamforce 的说法与此呼应:考虑到现有模型的能力,安全与监测必须先于能力 。

另有一个值得留意的观察来自路透社 Breakingviews:前沿放缓可能反而让第二梯队获益 —— 当竞爭焦点从前沿能力转向效率与成本,市场格局会被重塑 。 这提醒我们,「 放缓 」 在商业上从来不是中性的,它会制造贏家与输家,而这本身就会影响各方的立场 。

这一週真正改变了什么

坦白说,本週没有任何具有约束力的东西诞生 。 标准机构仍在磋商阶段,马斯克的互测提案尚无一家对手同意,联邦框架尚未成文,白宫的会议还没开 。

但有三件事確实改变了 。

第一,爭论的问题变了 。 从 「AI 是否危险 」 转向 「 监督机构应该长什么样 」,这是一个巨大的进步 —— 因为前者永远爭不出结论,后者至少可以设计 。 哈萨比斯的 FINRA 模式 、 阿莫代伊的嵌入式评估者 、 马斯克的同行互测,三者並不互斥,甚至可以组合成一套机制 。

第二,分歧的位置变了 。 现在的主要对立不再是 「 业界 vs 监管者 」,而是 「 业界与部分国会议员 vs 白宫与芯片產业 」。 当被监管者主动要求监管 、 而政府称之为骗局时,传统的政治剧本失效了 。

第三,也是最重要的一点 —— 所有方案目前都是自愿的 。 阿莫代伊承诺提供类员工存取权,奥特曼承诺照做,马斯克提议互测但对手未答应 。 这些承诺的共同特点是:撤回它们不需要付出任何代价 。 贝尼奥夫那句 「 然后他们应该为此承担责任 」,仍然是一张空白的支票 。