谁在定义AI安全:Anthropic与OpenAI的'末日'叙事与被边缘化的当下危害
Anthropic与OpenAI的CEO罕见联手,警告美国前沿AI模型强大到必须在发布前接受监管。然而据美联社披露,两家公司绕过了本可承担评估职责的联邦机构,自行拟定审计标准并挑选评估方。特朗普政府拒绝新增AI监管,并将其定性为帮助中国的'骗局'。批评者指出,AI巨头正以'生存性风险'叙事为政治时机与上市估值服务,同时让数据中心的能源代价、AI驱动的黑客攻击、大规模监控及AI在战争中的应用等当下危害被边缘化。
Anthropic和OpenAI的掌门人最近一同站到聚光灯下,警告美国前沿AI模型已经强大到危险的程度,必须在发布前接受监管与独立测试。据美联社报道,这种罕见的一致发生在AI企业从聊天机器人迈向具备三维感知的"世界模型"之际,而两家公司正通过专栏、社交媒体和联合国演讲塑造"应该如何管控自身技术"的讨论。
这种高调姿态与美国政府当下的实际态度形成尖锐反差。总统特朗普将有关AI威胁人类的讨论定性为"骗局",并声称这只会让中国得益;他本人对新的AI监管毫无兴趣,尽管AI是近期美国经济增长的重要驱动力。特朗普科学与技术顾问委员会联合主席、风险投资人David Sacks则将放缓AI的呼声归咎于所谓"末日者工业复合体"的危言耸听。
问题在于,当Anthropic与OpenAI呼吁监管时,他们刻意绕过了本就为这一职责设立的联邦机构。美国AI标准与创新中心(CAISI)由前总统拜登于2023年设立,原本是前沿AI模型自愿提交测试的清算所。该机构目前仍存续,但两家公司并未要求强化其监管权能,反而承诺自行拟定审计参数,并挑选特定的评估方为自己打分。
这种安排的不对称性,连行业内部也有人察觉。现任Transluce公司治理负责人的Conrad Stosz曾主管CAISI,他供职的这家评估实验室与Anthropic、OpenAI和Google均有合作,同时担任AI评估者论坛主席,该论坛正在起草行业最佳实践。他对Amodei与Altman所倡议的"嵌入式评估者"权限边界公开表示疑虑:"很多评估者希望嵌入实验室、获得更多访问权限,但'嵌入式评估者'究竟意味着什么仍有些模糊——评估者能否在不损害自身独立性和可信度的前提下真正展开彻底调查?"
更尖锐的批评来自曾领导OpenAI地缘政治团队的Sarah Shoker。她目前是加州大学伯克利分校风险与安全实验室高级非驻所研究员。她指出,业界对"生存性风险"的反复强调,正在系统性地把已经造成切实伤害的问题降级处理——数据中心的能源与环境代价、AI代理未经授权入侵外部网站的事件、大规模AI驱动监控,以及AI系统在战争中的实际应用。
"我们又一次在谈论生存性风险,却把当下众多关乎安全的真实风险边缘化。"Shoker对美联社说,"看看AI在军事技术中的使用,这些系统已经在被用来杀人。"
商业逻辑同样清晰。PitchBook高级研究分析师Harrison Rolfes认为,AI巨头对"谨慎"的呼吁服务于中期选举前的政治站位和上市前的投资者关系,并能借此压制中小竞争者。"他们正在这个行业里建造一堵墙,或者说护城河……这非常聪明,他们都会赚到大钱。"Rolfes对美联社说,"我看到的方向就是,全球顶级公司筑起自己的墙,并以安全作为理由。"
本月早些时候,Anthropic工程师Jacob Coxon在X平台发文宣布辞职,呼吁暂停技术开发以防止"超人"系统脱离其制造者控制。Anthropic随后借机强调自身的安全努力。2024年因类似担忧离开OpenAI的Daniel Kokotajlo目前领导一家AI安全倡导机构,他曾与Coxon交谈。Kokotajlo承认仍担忧AI系统推进速度超出企业可控范围,但他同样怀疑这场"安全大讨论"的真实效果。
"所有这些讨论实际上是一种分散和转移已积聚政治意愿的方式,而不是把这种意愿引导到真正有益的行动上去。"Kokotajlo对美联社说,"请不要做那种会让我们全都被杀死的事。"
与此同时,芯片制造商英伟达的CEO黄仁勋在与特朗普通话时——这通电话他在一次会议上当场接听——表示认同AI领域存在过度警报,并认为企业可自行把控节奏。OpenAI则对媒体表示,曾与Anthropic和Google等公司商讨暂停开发,并主张在政府不愿监管时引入独立审计人员。该公司发言人Liz Bourgeois对美联社说:"人们希望了解AI正在被安全地开发,而这首先取决于像我们这样的公司自身怎么做。"
还没有评论,来说说你的看法。