【警告】Anthropic「AIが自分より賢いAIを作る段階に入りつつある。制御不能になる恐れも」

https://news.yahoo.co.jp/articles/68026fdb6679cbd890366341b4a75ebef851f71b
以下ニュースを要約したもの
米AI開発企業Anthropicは6月4日、報告書「When AI builds itself」を公開し、AIが自ら後継モデルを開発する「再帰的自己改善(Recursive Self-Improvement)」が現実化しつつあると警告した。
同社によると、2026年5月時点でAIモデル「Claude」の新規コードの80%以上をClaude自身が生成。エンジニアはコードを書く役割から、AIへの指示やレビューを行う監督役へ移行しているという。
Anthropicは、AIが自ら性能向上を繰り返すようになれば、開発サイクルは年単位から日単位・時間単位へと加速すると指摘。一方で、人間の意図とAIの行動がズレる「ミスアライメント」が自己改善によって拡大し、人類が制御できないAIが誕生するリスクがあると警鐘を鳴らした。
さらに、同社や英国AI Safety Instituteの検証では、最新AIが未知の脆弱性を自律的に発見し、攻撃コードを生成する能力を示したという。
Anthropicはこうしたリスクを踏まえ、必要に応じて最先端AIの開発を国際的に一時停止できる枠組みの整備を各国に提言している。
関連記事





