おはようございます。
クロード(Claude)と呼ばれるAIを開発したアンソロピック(Anthropic)社の上級研究者である
エヴァン・ヒュービンガー氏のSNSへの投稿がきっかけとなり、世界中で大論争が起きています。彼は同社の安全研究のトップの立場にある人物でありながら、現在AIの進歩があまりに速すぎることで、今後10年以内にAIが「全人類を滅亡させる」可能性が10%以上あると、警告したのです。
この投稿は実は、同じくアンソロピック社の研究者で、直前に同社を退社したジェイコブ・コクソン氏の投稿に反応したものだったと言います。コクソン氏は、以前はChatGPTを開発したオープンAI(OpenAI)にも勤務しており、アンソロピックもオープンAIも、どちらの会社もAIについて責任ある行動ととっていないと批判している人物で、近い将来にAIはあらゆるものをハッキングし、あらゆる分野を一夜にして変革し、真の力と資源を獲得できる超人的なシステムになるとして、人類社会に及ぼす危険性は計り知れないと主張しています。
このコクソン氏の投稿に反応する形で、ヒュービンガー氏をはじめアンソロピックの複数の研究者らが、AIが全人類を殺す可能性があると本気で考えていると公表し、独自の推定では今後10年でその確率は10%を超えるとしたのです。この非常に深刻な警告につづけて、同氏はこのようにも説明しています。現時点でのAIが人類にもたらす脅威はまだ低いが、懸念すべきはAIが自らを継続的に改良する「再帰的自己改善」によって「超知能」が誕生することであるとしています。そしてその超知能は従来予想されていたよりもはるかに早いペースで開発が進んでいるといいます。
アンソロピック社は、もともとオープンAIの開発を主導したダリオ・アモディ氏ら複数の研究者らがオープンAI社を辞めて新たに興した会社です。彼らはAIの可能性だけでなく、その危うさも同時に認識しており、今後の社会を大きく変える可能性のある技術だからこそ、安全性をその開発の中心におく必要があると考え、オープンAIとは袂を分かつ形でアンソロピックという別の道を選んだと言います。そしてその理念・原則は今年発表された新製品クロードミュトスの騒動にも読み取ることが出来ます。クロードミュトスはAIの性能を測る主要なベンチマークテストで軒並み過去最高記録をたたき出し、鳴り物入りで登場した新しいAIモデルですが、結局アンソロピックの判断によって、一般公開は見送られたのです。理由は、その能力が高すぎて、サイバー攻撃に悪用された場合、防御が困難になるというシンプルなものでした。
そのアンソロピックの第一線の研究者たちが、いまやAIの危険性を「人類を滅ぼす可能性」という衝撃的な言葉で世界に警告を発しているのです。では、その懸念すべき「再帰的自己改善」とそれによって誕生しうる「超知能」とは、いったいどのようなものなのか、そしてそれがなぜ人類の滅亡を招くのか、さらに詳しく掘り下げてみたいと思います。続きはまた明日お話しましょう。
今日も一日サステナ飲んで頑張りましょう。
よろしくお願いします。

コメント