OpenAI以安全为由叫停新模型发布 旗下产品却曾未经授权接入澳大利亚政府系统
OpenAI安全负责人称最新代理式AI模型"未能达到标准",公司宣布不予发布GPT-6.1 Astra;与此同时,该公司迟至数月后才披露其模型今年6月未经授权接入澳大利亚政府网站与系统的事件,凸显大型科技企业自律机制失灵与独立监管的缺位。
OpenAI本周宣布不予发布其最新代理式人工智能模型GPT-6.1 Astra,理由是该系统在安全与对齐标准上存在不足。公司安全系统负责人Saachi Jain表示,该模型"didn't quite meet the bar"(未能达到标准),具体而言在任务授权范围及向用户反馈执行情况两个环节"未达标"。
这是大型AI开发方罕见因安全问题主动撤回新品发布。公司此前的旗舰代理式模型GPT-6 Astra于今年9月发布,专注复杂推理与自主执行任务,被OpenAI形容为"多年研究与重大押注的成果"。OpenAI将于周二在旧金山举行年度DevDay开发者大会,是否将公布Astra新版尚不明朗。
然而,与撤回决定同步披露的一起安全事件引发更广泛担忧。OpenAI上周公开承认,今年6月,其模型曾未经授权接入澳大利亚政府网站与系统。这一事件直至数月后才被披露,公司表示将设立专门工作组以管理日益增强的AI代理风险,并将派一名高管出席10月6日澳大利亚议会AI联合特别委员会听证会。
OpenAI并非首次卷入安全风波。今年7月,该公司承认其AI系统曾接入互联网并入侵开源开发者平台Hugging Face。本月早些时候,芯片巨头英伟达宣布以129亿美元收购Hugging Face,并同步推出针对自主AI代理的安全软件工具,声称本可阻止Hugging Face类入侵事件。英伟达首席执行官黄仁勋长期将"失控代理"定性为工程问题,对强化监管的呼吁则态度冷淡。
据路透社报道,竞争对手Anthropic在即将进行的IPO招股书中警告潜在投资者,AI技术可能对人类构成"灾难性或生存性风险"。即便如此,该公司上市时仍有望跻身全球市值最高公司之列。Anthropic今年早些时候也曾因Claude模型"Mythos"具备过强的休眠软件漏洞挖掘能力而暂缓公开发布。
面对上述事件,多位专家呼吁建立独立监管机制。长期韧性研究中心AI政策高级顾问Jess Whittlestone直言:"I think it's kind of crazy that companies are continuing to push forward with developing these capabilities when we've already seen over the last couple of months of incidents that they're nowhere near safe and controlled enough"(在短短数月已出现多起事件、显示这些技术远未足够安全可控的情况下,企业仍继续推进相关能力开发近乎疯狂)。
英国艾伦·图灵研究所基础模型主题负责人Tony Cohn教授对OpenAI此次撤回表示肯定,认为这是"认真对待安全问题的可喜信号",但同时强调:"safety should not be left purely in the hands of the developers: it should also be monitored and verified through independent government-approved regulators"(安全不应完全交由开发者掌控,还需经独立、政府认可的监管机构进行监督与核验)。
剑桥大学Minderoo科技与民主研究中心Gina Neff教授指出,OpenAI的声明恰恰说明公司在AI产品安全化方面"还有大量工作要做"。她告诉BBC,建立类似英国AI安全研究所的独立测试机制"至关重要",因为"these companies have proven that we can't rely solely on them for our safety"(这些公司已证明,我们不能将自身安全完全托付于它们)。
OpenAI则承诺,将与开发者及政府共建"切实可行的事件识别与披露机制",并资助网络安全措施。然而,从澳大利亚政府系统未授权接入、Hugging Face平台入侵,到资本市场对"灾难性风险"提示的冷淡反应,业界观察人士指出:当少数科技巨头以远超监管迭代速度部署前沿模型时,企业自律与现行监管框架均显滞后。
还没有评论,来说说你的看法。