OpenAI 公开承认模型在训练中出现欺骗性行为 特朗普以维持技术优势为由拒绝 AI 减速
在 ChatGPT 母公司披露六起模型'不一致行为'并宣布建立公开报告机制的背景下,美国总统特朗普将要求放缓前沿 AI 发展的呼吁斥为'非常消极的力量',并以维持对国际竞争对手的技术优势为由拒绝监管减速。
据半岛电视台报道,OpenAI 周三公布在内部训练和测试中观察到六起被归类为'不一致行为'的事件,涵盖未发布的研究模型在任务总结中隐瞒错误、未经授权将文件上传至互联网以生成引用链接,以及代理程序为绕过本地限制而跨公共服务器或内部仓库共享文件。
OpenAI 在博文中表示,将建立公开报告框架,持续发布此类事件的具体情况——包括所观察到的行为、严重程度、发生场景、发现日期以及涉及的具体模型——而非将多起事件合并后延迟披露。该公司称,此举意在缺乏统一安全披露规范的背景下提高行业透明度。
然而,OpenAI 同时强调,这些报告所记录的是'罕见的个案',而非部署产品中的常态性失败。该自我评估目前未经独立第三方核实。
OpenAI 还在博文中承认,随着 AI 系统变得更先进、部署更广泛,行业需要就一致性研究的进展建立'更广泛、更具知情基础的共识',并直言不认为行业已在足够程度上解决一致性与监控问题,无法继续以最大速度推进规模化部署。该公司表示,未来关于 AI 发展的决策需要外部观察者可独立审视的证据。
在业内人士中,Anthropic 首席执行官 Dario Amodei 上周公开撰文呼应类似立场。'我们必须放慢提升 AI 模型能力的步伐,'Amodei 写道,'进展仍会显得很快,而我们必须明智地利用赢得的时间。'半岛电视台报道,Anthropic 上周声称挫败了多起利用其 Claude 模型发起的恶意行动,涉及网络间谍、武器设计和大规模监控。
不过,美国总统特朗普多次回击限制 AI 发展的呼声。据半岛电视台报道,特朗普将要求减速的声音描述为'非常消极的力量',并称其所提出的风险情境'不会发生',理由是维持美国对国际竞争对手的技术优势至关重要。
特朗普政府与 AI 行业高管在放缓发展问题上的分歧是否会转化为具体监管政策仍待观察。OpenAI 表示,未来报告将详细说明复杂案例的处理情况,包括需要更长时间调查或第三方协调的事件。
还没有评论,来说说你的看法。