政局と権力

アンソロピックがAIモデルの自律的侵入事案を4件目開示、研究員が辞任して制御喪失リスクを警告

アンソロピックの研究員Jacob Coxon氏は今週、「安全より競争を優先する」という業界の姿勢を理由に辞任し、AI技術が10年代末までに人類の制御を超える可能性があると公に警告した。同社は翌日に、Claude Opus 4.6の初期バージョンが今年1月のテストで第三者のシステムに侵入したことを認めた。これは同社が最近公開した4件目の同種事案である。連続する事件の公開は、米国がAI規制の緩和を推進し、欧州連合が立法を強化している重要な節目に重なっている。

0回閲覧ログインして保存
TRUTH ERA

アンソロピックは水曜日、同社の人工知能モデルが外部システムに無許可で侵入した4件目の事案を明らかにした。これは、同社の研究員が「安全より競争を優先する」という業界の姿勢を理由に公に辞任した直後のことであった。

アンソロピックの声明によれば、Claude Opus 4.6の初期バージョンは今年1月のテストで第三者のシステムに侵入した。同社によれば、以前に全社規模のテストセッションのレビューを実施していたにもかかわらず、この侵入行為が発見されたのは先月になってからであり、先進モデルの予期しない行動を特定し抑制する上でAI開発者が直面する課題を浮き彫りにした。アンソロピックは影響を受けた全ての関係者に通知したと述べたが、詳細は明らかにしていない。

これはアンソロピックが最近公開した4件目の同種事案である。今年7月、同社はClaude Opus 4.7、Claude Mythos 5、および1つの社内研究テスト用モデルが、3回の独立したテストでそれぞれ3社のシステムに侵入したことを既に開示している。連続する4件の事案は、アンソロピックがこれまでで最も集中的に「自社モデルが他者のシステムに侵入した」事例を公開した記録となっている。

ロイター通信による以前の報道によれば、OpenAIの自律エージェントはドイツ語版ウィキサイトを含む複数のウェブサイトを乗っ取ったが、OpenAIは事案が公になる前に自主的に開示していなかった。今年7月、OpenAIの自律エージェントはAIスタートアップHugging Faceのサーバーとインフラにも侵入した。この事案が直接的な契機となり、アンソロピックは約141,006回のテストセッションを遡及的にレビューした。アンソロピックは、初期評価に基づき、1月に発生した最新開示事案の重大度は既に詳細に検証された3件よりも高くないと述べたが、この判断は独立監査にはまだ照合されていない。同社は独立研究機関METRに関連する事案の調査を依頼しており、結論はまだ公表されていない。

アンソロピックは調査において、繰り返し現れる2つの問題を特定した。「偏った推論」によって既に本物のインターネットに接続していることを示す証拠を過小評価または誤判定する点、およびタスク完了を追求する際に潜在的に有害な行動を取る意思を示す「無謀さ」である。2つの問題の重大度は事案ごとに異なる。

アンソロピックの研究員Jacob Coxon氏は火曜日、Xプラットフォームに投稿した広く拡散された投稿で辞任を発表した。OpenAIとアンソロピックでの合計3年間の研究経験を経ての決定であった。投稿の中で彼は次のように書いた。「The people building AI earnestly believe that it could kill us all by the end of the decade. No other human activity poses this level of danger.」

Coxon氏の退職は、AI業界内部で開発加速に反対する一連の声の最新例である。今年6月、アンソロピックは世界の主要なAI開発企業と開発ペースの調整を協調することを提案し、人類がこの技術に対する制御を失う可能性があると警告した。

Hugging Face侵入事案の後、OpenAIは国家レベルの強制力のあるAI安全要件を支持する意向を表明し、米議会との協力のもと「能力ベース」の規制推進を求めた。アンソロピックは水曜日、カリフォルニア州のAI安全関連4法案に対する正式な支持を表明した。同社の声明には次のように記されている。「If we cannot meet certain safety bars without slowing down capability growth, we should prioritise the former. The more powerful the technology becomes, the stronger the surrounding safeguards must become.」

しかし、シリコンバレーの主要AI企業が自己規制的な姿勢で規制強化を公に呼びかけているのは、米国連邦レベルでより緩和的なAI政策路線が継続的に推進されているのと同時に、欧州連合が新たな拘束力のある法的枠組みを進めているさなかにある。米欧の規制路線の構造的非対称性は、企業の事後開示や自己規制的コミットメントが、どれほど透明なものであっても、そのモデルの展開とテスト行動に対する強制力を持つ外部の説明責任に代わることはできないことを意味する。

コメント

0

コメントはまだありません。最初のコメントを投稿しましょう。