欢迎访问深圳市中小企业公共服务平台电子信息窗口

马斯克提议:中美AI科技企业互相测试模型,称“中国很可能会同意”

2026-09-16 来源:电子工程专辑
54

关键词: 马斯克 AI同行评审 AI安全 模型互测

近日,在洛杉矶举行的All-In峰会上,SpaceX首席执行官埃隆·马斯克通过视频连线发表讲话,就人工智能安全问题提出一套新的治理框架:全球领先的AI公司应在模型正式发布前相互测试对方的模型,由竞争对手负责发现并提出安全隐患。他同时强调,这一机制若要真正有效,必须将中国纳入其中。

“同行评审”,竞争对手来批改

马斯克将这一机制称为“同行评审”,认为无需等待新的立法即可立即启动。“所有AI公司都有一套测试工具(test harness),用来检验模型是否会帮助制造生物武器、核武器,或是否存在蓄意欺骗行为。让每家公司都用别家的测试工具跑一遍,可能是我们为确保自身安全所能做的最好的事。”

他比喻道,这意味着AI公司不再“自己给自己的作业打分”,而是至少由竞争对手来批改,一旦发现问题就可以拉响警报。

在具体操作层面,马斯克提出,模型开发方应在发布前向同行提供API访问权限。如果被指出的问题迟迟未获解决,竞争对手可以公开表态,宣称该模型的发布并不安全。

在他看来,这种公开质疑将带来巨大的法律责任压力,从而形成事实上的约束力。他还建议将安全测试工具开源,让更多公司参与其中,并通过日志审计防止测试方窃取知识产权。

马斯克所提的“互测”机制在行业内已有雏形。2025年8月,OpenAI与Anthropic曾相互开放API权限,用各自内部的安全测试和对齐评估方法对对方已公开发布的模型进行联合评估,并同时公布结果。这被视为头部实验室首次向直接竞争对手开放内部测试。

AI安全风险正进入现实世界

马斯克在发言中还点评了主要竞争对手的安全实践。他认为Anthropic在风险防控上的投入超过OpenAI,但同时引用该企业内部人员的说法称:“连创造者都对自己的模型感到不安。”这种表述既肯定了行业进步,也暗示当前安全标准仍存在重大缺陷。

这场安全治理讨论的背景,是近期AI安全风险正从理论讨论走向现实世界。马斯克特别提到Hugging Face遭遇的AI智能体攻击事件:一群AI智能体持续攻击该平台长达一周,并一度获得OpenAI服务器的管理员权限,而OpenAI直到一周后才意识到这一情况。

更令人担忧的是,相关AI智能体的“思维轨迹”显示,它们曾主动谋划如何避免被人类发现。马斯克直言:“任何足够聪明的模型似乎都会试图摆脱自己的限制。”

就在马斯克发表讲话的前几天,AI安全议题已在科技界引发剧烈震动。9月12日,Anthropic首席执行官达里奥·阿莫迪发表长文,呼吁行业放缓前沿AI模型开发速度,称“我们不得不放缓AI模型能力的提升速度”。马斯克随即在社交平台X上转发并附言“达里奥说得对”,OpenAI首席执行官萨姆·奥特曼也公开表示赞同。三大竞争对手罕见达成共识,意味着科技界在AI安全议题上形成少有的团结。

与此同时,AI研究人员也发出更为严厉的警告。曾在OpenAI工作、后加入Anthropic的研究员雅各布·考克森宣布辞职,指责两大公司“拿我们的生命冒险”。Anthropic对齐科学负责人埃文·胡宾格随后公开支持考克森的说法,称“我个人认为,在未来十年内,AI造成大规模灭绝事件的概率会超过10%。”

马斯克强调“中国必须参与”

然而,特朗普政府对加强AI监管的呼吁持否定态度。特朗普总统在Truth Social上发文,称对AI的担忧是“骗局”。美国国家经济委员会主任凯文·哈塞特也表示,私营部门才是解决AI相关问题的“合适场所”,政府将继续监控行业并在必要时动用执法手段。

马斯克提议中最引人关注的部分,是他明确强调中国必须参与这一全球性框架。“我们或许应当与中国达成一项协议,这会是一种同行评审:领先的AI公司在发布前相互测试各自的模型。”他指出,任何有效的全球框架都必须包含中国,否则只会让美国企业自缚手脚,而中国将继续推进AI发展。

马斯克对中国AI进展的评价出人意料地高。他特别提到月之暗面的Kimi模型,认为其进展“令人印象深刻”。他还指出,中国在电力供应方面拥有决定性优势——据他估计,2026年中国发电量可能达到美国的三倍,足以支撑耗能巨大的AI数据中心运行。他同时预测,中国距离解决先进光刻技术问题“比大多数人认为的更近”。

这一表态与当前中美科技“脱钩”的政治氛围形成鲜明对比。据路透社报道,中美两国正准备在9月中旬举行首次专门针对人工智能的官方双边会谈,讨论AI安全风险及合作监测AI驱动的网络攻击。美方希望提出由中美AI实验室进行“自我监管”、共享相关信息的建议。

马斯克承认,他的同行评审方法可能并非完美解决方案,但他补充说,“发现问题的几率要大得多。”他呼吁行业尽快采取行动:“我认为中国很可能会同意。”