9月19日、Huamani氏とOrtutay氏が「Will AI models achieve the ability to improve autonomously? Leading labs say the scenario is near」と題した記事を公開した。この記事では、OpenAIやAnthropicといった主要AIラボが「AIの再帰的自己改善(RSI)」の実現が近いと表明している現状について詳しく紹介されている。
AnthropicのClaudeが自社の次世代モデル開発を主導
最も具体的な数字を出したのはAnthropicだ。同社は今週、Claudeが同社のモデル研究・開発業務の26%を主導していると発表した。「高レベルのプロンプトからタスクをエンドツーエンドでほぼ完結できる」段階にあるという。ただし、人間の監督下にある点は強調されており、完全自律には至っていない。
この発表はAI業界全体に対して一種の"公開圧力"となった。Anthropicは他のラボにも同様の指標を公開するよう促しており、RSI開発の透明性を業界標準にしようとする動きが読み取れる。
RSI(再帰的自己改善)とは何か
RSI(Recursive Self-Improvement)とは、AIが自分自身を改善し、より優れた次世代バージョンを設計し、そのバージョンがさらに次を設計する——というサイクルを指す。
カリフォルニア大学サンタクルーズ校の物理学教授であり非営利団体Future of Life Instituteの共同創設者・エグゼクティブディレクターを務めるAnthony Aguirre氏はこう説明する。
「重要なのは、AIがその作業を担う割合が増えるほど、プロセスが加速するという点だ。AIは人間よりはるかに速く動作する」
コーネル大学のJohn Thickstun助教授(AIの行動制御手法を研究)は、より冷静な見方を示す。
「実は数年前から、過去世代のモデルを次世代モデルの開発支援に使ってきた。コードを書かせ、次世代のAIシステムを作るという形で」
つまり緩やかなRSIはすでに始まっている——それが現場の共通認識だ。ただし、大きな飛躍的改善(creative leap)はまだ起きていないとThickstun氏は指摘する。
各社の現在地
OpenAIは今月、「熟練した研究者が数日かけて行うタスクを実行できる」自動化された「リサーチインターン」システムを発表した。さらに2028年3月を目標に、完全自動化された「AIリサーチャー」の開発を進めると表明している。
ただし同社は、完全なRSIを「安全に実現する方法をまだ知らない」と認めており、安全性・アライメント研究の進捗が能力向上に追いつかない可能性も自ら明示している。
xAI(Elon Musk)はより積極的だ。MuskはGrokモデルについて、「人間の関与は徐々に減っており、各モデルが前モデルによって構築されている」と述べ、完全自動化の達成時期を「遅くとも2027年まで」と予告した。
一方、Microsoft AIのCEO Mustafa Suleiman氏は「humanist superintelligence(ヒューマニスト的超知性)」という概念を掲げ、AIは「高度な自律性を持つ無制限の存在」ではなく、「慎重に調整・制約された」ものであるべきだとの立場を示している。
「人類史上最悪のアイデア」という評価
Aguirre氏の言葉は強烈だ。
「AnthropicのデータからAI関与の割合が増え続けているのが見える。そしてその行き着く先は、私が思うに、人類史上最悪のアイデアの実現だ。それでも彼らはやっている」
完全自律のRSIが実現すれば、科学・医療分野での急速な進歩が期待できる一方、AIが人間の制御を逃れるリスクも現実味を帯びる。
Anthropicは条件付きでの開発一時停止に言及しているが、その条件とは「世界中の競合他社が検証可能な形で同様に停止すること」だ。業界全体の協調が前提であり、現実的に困難な条件であることは否めない。
OpenAIが「安全な実現方法を知らない」と認めつつもRSIを目標と位置づけ、MuskがRSI到達時期を具体的に宣言する——各社の姿勢のずれが鮮明になってきた局面だ。
詳細はWill AI models achieve the ability to improve autonomously? Leading labs say the scenario is nearを参照していただきたい。




