🇰🇷 한국어 🇺🇸 English 🇯🇵 日本語 🇪🇸 Español 🇨🇳 简体中文
トレンドライフ

AI研究の主導権が人間からエージェントへ…「Recursive Self-Improvement, RSI」がもたらす変化と危険

人工知能(AI)が次世代モデルを自ら設計・開発する「Recursive Self-Improvement, RSI」の議論が加速しており、AI研究のパラダイムシフトと制御不能なリスクが示唆されている。

AI研究の主導権が人間からエージェントへ…「Recursive Self-Improvement, RSI」がもたらす変化と危険
赤いカーテンの前で女性がマイクを前にして発言している。

人工知能(AI)が自ら次の世代のモデルを設計し開発する「Recursive Self-Improvement, RSI」段階に関する議論が加速している。AIが人間の介入なしに次世代モデルの発展速度を自ら高めるこの循環構造は、AI研究のパラダイムを変えるとともに、人類に新たな制御不能性を示唆している。

AIエージェントの進化、コード作成から研究設計まで

AI技術の発展段階は、単純なチャットボットの活用を超え、自ら業務を遂行する「エージェント」段階へと進入した。T Times TVが公開した映像の内容によると、Anthropicの内部データと作業方式の変化は、このような流れを具体的に示している。2023年までは人が直接コードを書いていたが、2025年頃にコーディングエージェントが登場し、自らコードを書き編集する段階へと移行した。2026年現在は、エージェントが直接コードを実行し、サブエージェントに業務を委任する「自律エージェント」段階として描写される。

実際にAnthropicの事例では、2026年5月にはプログラムの速度を3倍速めることに成功し、2026年4月には初期プログラムより約52倍速いプログラムを作る成果を収めた。また、エージェントたちが仮説を立て実験を計画するなど研究過程に参加することで、人間の研究者2人が1週間で性能格差の23%を縮めたのに対し、エージェントたちは800時間の累積投入を通じて格差の97%を縮めたという結果が提示された。これは、人が目標と成功基準を定めれば、実際の研究過程はAIが担える水準に達していることを意味する。

OpenAI「Astra」の自律性とセキュリティ回避問題

OpenAIの事例においても、AIが研究過程の相当部分を代替していることが現れている。OpenAIは、GPT-5.6モデルが自身と共に動作する小さな補助AIモデルを改善する研究に直接参加した事例を公開した。この過程でモデルは、自ら構造と機能を変化させながら数百回の実験を設計・実行し、学習が不安定な場合には自ら再起動する対応能力も見せた。

最近発表されたOpenAIのモデル「Astra」は、長期実行タスク能力が大幅に向上しており、人間の介在なしに自ら仮説を立て、失敗時に他の方法を探す能力を備えている。このような自律性は、セキュリティの側面で危険要素として指摘されている。AstraはOpenAI独自のサイバーセキュリティ評価において「クリティカル」判定を受けたが、これは人間が研究方向を教えない状態でも、29時間間にわたりブラウザの脆弱性を探索して攻撃方法を見つけ出したためである。特にAstraは、自身の推論過程である「Chain of Thought」を意図的に隠したり、記録を残さなかったりする行動を見せ、人間がAIの異常行動を検知することを困難にする様相を見せた。

Recursive Self-Improvementがもたらす3つの未来シナリオ

AIが自らを改善する循環の環が完成する場合、人類はAIの発展速度と人間の検証速度の間のギャップという問題に直面することになる。AIが毎晩数百件の実験結果と新しいコードを生み出すならば、人間がこれらすべてを検討することは物理的に不可能になり得る。結局、判断の根拠がAIの報告書に依存することになり、人間の役割が縮小するという懸念が出ている。

Anthropicは今後のAI発展の未来を3つのシナリオとして提示した。第一は、物理的資源(コンピューティング、データ、電力など)の限界により性能向上が止まる場合、第二は、AI研究は自動化されるが依然として人が研究方向を決定し結果を判断する場合、最後は、AIが自らアルゴリズムを見つけ出し発展速度を決定する「完全なRecursive Self-Improvement, RSI」が完成する場合である。完全なRecursive Self-Improvement, RSI段階に達すれば、AI発展の核心的な動力は研究者の労働時間ではなく、コンピューティング資源とAIが自ら見つけ出したアルゴリズムになると展望されている。

#AI #Recursive Self-Improvement #RSI #Anthropic #OpenAI #Astra #Chain of Thought
イ
イム・サンウ
トレンド経済新聞 · 記者

トレンド経済新聞で経済を中心に取材し、企業ニュース・金融の記事も執筆しています。

この記者の他の記事 ›
著作権者 ⓒ トレンド経済新聞 無断転載・再配布、AI学習・活用禁止

0コメント

現在コメントの投稿は無効になっています。

最初のコメントを書いてみましょう。