政局と権力

Anthropicのアライメント責任者が「解決策なし」の超知能リスクを公に認め、業界は「人類の命を賭けている」と警告

Anthropicのアライメントサイエンス責任者Evan Hubinger氏は、同社内部が本十年中に超知能が全人類を殺害する可能性があると本気で信じており、現時点で解決策がないことを公に認めた。一方、1300人以上のフロンティアAI企業従業員が連署で制御不能リスクを警告したが、AnthropicとOpenAIはいずれも研究開発の停止や外部規制の受け入れを約束していない。国連人権高等弁務官は、AIが「存亡に関わるリスク」を構成すると警告した。

1回閲覧ログインして保存
TRUTH ERA

Anthropicのアライメントサイエンス責任者Evan Hubinger氏は今週、稀有なことに公に認め、同社内部が本十年中に超知能が「全人類を殺害する」可能性があると本気で信じており、いわゆる「アライメント問題」に対する明確な解決策が現在のところないことを認めた。これはAnthropic研究員のJacob Coxon氏が離職を発表した後、企業内部から投げかけられた最新の衝撃である。

ABC News Australiaの報道によると、Coxon氏はソーシャルメディアX上で直言し、自身がAnthropicとOpenAIで合計3年間の事前学習研究に従事した後に離職することを選んだ理由として、「両社とも責任ある行動を取っていない」ことを挙げた。彼の原文は次の通りである。「彼らは自己改良型の超知能に向かって一直線に突き進んでおり、賭けの対象は我々の命である。」

Hubinger氏はその後X上で、Coxon氏の発言が「正しい」と返答した。彼は次のように書いた。「我々は本当にAIが全人類を殺害する可能性があると信じている!私は個人的に、今後10年以内に発生する確率は10%を超えると考えている。」企業の存続と人類の運命に関わる技術路線の問題について、彼は同時に次のように認めた。「Anthropicは全力で取り組んでいると信じているが、我々には超知能のアライメント問題を解決する手段がなく、またその解決への道を明確に歩んでいるわけでもない。」

Coxon氏は孤立した事例ではない。今年7月、Anthropic、OpenAI、その他のフロンティアAI企業から1300人以上の従業員が連署による公開声明を発表し、「能力の発展が、我々が生成するシステムを理解し制御する能力を迅速に超える可能性がある」と警告し、米国政府が国際的な取り組みを支援し、「フロンティアAIの開発ペースを意識的に制御する」ことができるツールの構築を呼びかけた。このイニシアチブは「Pacing the Frontier」と名付けられた。

しかし、両社の連署への回答はいずれも原則のレベルにとどまり、具体的な行動の約束にはなっていない。ABC News Australiaが両社のXプラットフォーム上の声明を引用して報じたところによると、Anthropicは先月発表した「再帰的自己改良」に関する研究が「社会が準備できるよう、フロンティアAIの開発ペースを意識的に制御するツールの必要性を示している」と認めた。OpenAIは曖昧な表現で、「我々は、将来のある時点で、フロンティアモデル開発のAI加速が非常に高くなり、世界がAI進歩の速度を制御する必要が出てくる可能性があると信じている」と述べた。両社とも研究開発の一時停止や拘束力のある外部規制の受け入れを約束していない。

規制の空白は国際的な場でより直接的に名指しされるようになっている。ABC News Australiaの報道によると、国連人権高等弁務官Volker Turk氏は月曜日、ジュネーブで、先進AIが人類に「存亡に関わるリスク」をもたらす可能性があると警告し、公共サービス、通信、民主主義体制への打撃を含むその事務所が列挙したリスクを低減させるため関連企業に圧力をかけることを誓った。Turk氏は「手遅れになる前に」AI安全のために「鉄壁の保障」を築くことを呼びかけた。「私も、業界内部の関係者と同様に、先進AIが人類に存亡に関わるリスクをもたらす可能性を懸念している」と彼は国連機関で発言した際に述べた。

「アライメント問題」の本質は、人類の能力を超えるAIシステムが人類の価値観を共有しない可能性があるという点にある。米国連邦レベルではフロンティアAIに対する拘束力のある規制枠組みがいまだ確立されていない状況を背景に、業界内部は今、最も率直な方法で次のように認めている。この競争のリスクとリターンの分布は非対称であり、利益は企業に固定され、代償は全員にのしかかる可能性がある。

コメント

0

コメントはまだありません。最初のコメントを投稿しましょう。