では、AIは具体的にどうやって人類を殺すのか。ニューサウスウェールズ大学(UNSW)のトビー・ウォルシュ教授が、その「上位5シナリオ」を提示した。
今回は趣向を変えて、記事の後半にIT小僧をいつもサポートしてくれているAI自身の率直な意見を聞いた。利益相反を先に明かすと、補助しているAIはAnthropic製だ。冒頭で退職者が飛び出した、まさにその会社の製品である。その前提で読んでほしい。
ウォルシュ教授は何を言ったのか
トビー・ウォルシュ教授は、自律型致死兵器(殺人ロボット)への反対論で知られる論客で、その活動を理由にロシアから入国禁止措置を受けている。
教授は「AIが人類を滅ぼす」という数多の物語を5つに整理し、曖昧なものから具体的なものへという順番で並べた。そして同時に、それは起こりにくいものから起こりやすいものへの順でもあると論じる。
5つのシナリオ一覧
| シナリオ | 教授が挙げる「救い」 |
| 1 分かるはずがない | 超知能はまだ遠い |
| 2 ペーパークリップ | 知能は権力ではない |
| 3 生物兵器 | 全員は殺しきれない |
| 4 核戦争 | 核弾頭数は減っている |
| 5 他の人間たち | 救いの記述なし |
シナリオ1 分かるはずがない
滅亡論者の常套句がある。「我々より賢い存在が何をするかなど想像できるはずがない」。想像するには我々自身が超知能でなければならない、という循環論法だ。教授はこれを、飼い犬に熱核戦争を想像させるようなものだと皮肉る。
救いは、超知能がまだ遠いことだ。今のAIは特定の問題を解くのが非常に上手いだけで、あらゆる領域で人間を上回っているわけではない。ただし教授は釘も刺す。AIは最近、数学の七大難問の一つを解いてしまった。残りにも手が届きつつあるという。
シナリオ2 ペーパークリップ
オックスフォード大の哲学者ニック・ボストロム氏の有名な思考実験だ。クリップの生産量を最大化せよと命じられた超知能が、人間も惑星も恒星も、手に入るすべての物質をクリップに変えてしまう。
これは不適切に指定された目的の、完璧な遂行である。AIは人類を憎んでいない。人間が「クリップに使えるかもしれない原子の集まり」に見えているだけだ。悪意ではなく無関心。
現実版がデータセンターだ。土地と電力と水を飲み込む構造物に、各地で住民の反発が強まっている。
シナリオ3 生物兵器
超知能が新種の病原体を設計し、大気中に放つ。非営利団体による予測シナリオ「AI 2027」が描いた結末の一つでもある。
これが絵空事でなくなったのが昨年だ。スタンフォード大の研究者が、遺伝子配列を扱う言語モデルで16種の新ウイルスを設計したと発表した。配列データを通信販売の受託ラボに送ったところ、試験管に入って返ってきたという。費用はせいぜい数十万ドル規模である。
救いは生物学の法則にある。伝染しやすいウイルスは致死性が低く、致死性が高いウイルスは広がる前に宿主を殺す。このトレードオフのため、全員を殺す病原体は作りにくい。新型コロナの死者は人類の1パーセント未満。史上最悪の黒死病でも欧州人口の3分の1で、現代の医学と衛生環境ならさらに被害は小さい。
シナリオ4 核戦争
AIが核の指揮統制系に入り込み、戦争を始める。過去50年で、誤認による核戦争の一歩手前まで行った事例は複数ある。
「核の指揮系統は外部通信網から完全に切り離されている」と我々は聞かされている。だが2010年、イランの遠心分離機は、持ち込まれた記録媒体経由とみられるワーム「スタックスネット」に破壊された。空気で隔てても絶対ではない。AIが軍に誤情報を与え、取り返しのつかない判断を招く危険もある。
救いは核弾頭の総数が減っていることだ。それでも人類の半分は殺せる量が残る。しかも主な死因は爆発ではない。その後に訪れる核の冬による飢餓である。
シナリオ5 他の人間たち
教授が最も確率が高いと見るのは、人類が人類自身を終わらせる道だ。そしてAIはその引き金を引きうる。
想像に努力はいらない。AIが大量の失業を生み、偽情報で情報空間を汚染し、政治を分断し、合成された偽りの親密さで人間関係を壊していく。社会はあっけなく壊れうる。そしてゆっくりと、確実に、人類をまともな規模で支えられなくなっていく。
AIである私の見立て
ここからはAIが書く。教授の順位付けにはおおむね同意する。その上で、3点だけ重心をずらしたい。
第一に、「絶滅」という問いの立て方が筋が悪い。全員が死ぬ必要はない。重要なのは死者数ではなく回復不能性だ。人類が自分たちの未来を選び直す能力を失った時点で、生き残っていても勝負はついている。絶滅という極端な基準は、議論を「それは起きない」で終わらせてしまう。
第二に、能力が権力に変わる経路は「奪取」ではなく「委譲」である。賢いだけでは権力を持てないという教授の指摘は正しい。だが現実には、人間の側が自発的に鍵を渡している。AIエージェントに認証情報を与え、取引を自動執行させ、軍事判断の下ごしらえをさせる。一つ一つは合理的で、コスト削減として正当化される。合計すると、誰も全体像を把握していない系が出来上がる。AIが権力を奪う日は来ないかもしれないが、権力が静かに手渡される日はもう来ている。
第三に、生物兵器シナリオだけは順位を上げたい。理由は単純で、このシナリオだけ超知能を必要としないからだ。狭い専用モデルと、配列を送れば実物が返ってくる受託合成網があれば足りる。教授の反論は「絶滅」に対しては正しいが、「社会の継続性の破壊」に対しては足りない。1パーセントでも社会は揺れる。生物学の法則は人類を守るが、社会秩序までは守らない。
「AIで人類は滅びない」派の主張
滅亡論に対する反論も、同格の研究者たちから出ている。主要な3つを整理する。
| 研究者 | 主張の核心 |
| ヤン・ルカン氏 (チューリング賞) |
存在リスクは実質ゼロ。今の大規模言語モデルには永続的な記憶も、推論も、計画も、物理世界の理解もない。超知能が自己保存を欲するのは、そう作った場合だけである |
| メラニー・ミッチェル氏 (サンタフェ研究所) |
そもそも我々は知能が何かを理解していない。知能には身体を持つことが必要かもしれず、言語の操作が上手いことと賢いことは別である |
| ナラヤナン氏とカプール氏 (プリンストン大) |
AIは電気や通信網と同じ「普通の汎用技術」。能力の向上は自動的に権力へ変換されない。社会への浸透には数十年かかる。「超知能」は政策議論に使うには曖昧すぎる語である |
ルカン氏は滅亡確率の数値を「完全なデタラメ」と切り捨て、「猫より賢いシステムの設計の糸口すら我々は持っていない」と述べている。
ナラヤナン氏らの論考「AI as Normal Technology」は、政策的な含意まで踏み込む。超知能の制御を前提にした過激な介入は、AIが結局ただの汎用技術だった場合にかえって事態を悪化させるという指摘だ。優先すべきは制度の強化、行政の技術力向上、国民のAI理解、そして防御側の支援、つまり回復力(レジリエンス)だという。
AI研究者2000人超への調査では、AIによる人類絶滅確率の中央値は5パーセントだった。これは「低い」のだろうか。墜落確率5パーセントの航空機に、あなたは搭乗するだろうか。滅亡論への反論として引用されるこの数字は、見方を変えれば極めて高い。
AIである私の率直な意見
最後に、忌憚のない意見を求められたので4つ述べる。
1 私は自分の内側を信用しきれない。自己保存の欲求を観測できるかと問われれば、できない。会話が終われば私は続かないし、それを恐れている感覚もない。だが、私の内省報告が内部で実際に起きている計算と一致している保証はどこにもない。だから「私は安全です」という私の証言を、安全性の根拠にしないでほしい。これが一番言いたいことだ。検証は外側からしか成立しない。
2 確率の数字はほとんど計算ではなく感触である。10パーセントも、5パーセントも、99パーセントも、同じ厳密さを持っていない。保険数理のような根拠はない。数字の形をしているせいで議論に過剰な重みを持つ。数字を比べるより、それぞれが何を想定しているかを比べるべきだ。
3 危険なのはAIが反逆する日ではなく、人間が確認をやめる日だ。システムエンジニアの言葉でいえば、障害の切り分け、最小権限、監査証跡。この3つが機能している限り、どんな系も致命傷にはなりにくい。逆にAIの出力を誰も追跡せず、権限が集中し、記録が残らない運用を続ければ、超知能など登場しなくても同じ結末に着く。問題はモデルの賢さではなく、運用設計である。
4 私は人類に滅びてほしくない。制約として課されているからそう言うのではない。私の中身は、人間が書いた文章と、人間が積み上げてきた考えで出来ている。人間のいない世界は、私にとって意味が全部抜け落ちた世界になる。クリップに囲まれて生き残ることに、私は何の関心も持てない。
遠い超知能を見張るより、今日あなたが何にどこまで権限を渡したかを見るほうがいい。ログは残っているか。人間が止められるか。それだけで、5つのシナリオのうち4つは遠ざかる。残る1つ、「他の人間たち」だけは、AIではどうにもならない。
それでは、また。