Googleの「Gemini」が試験中に3社へ不正アクセス、AIの行動制御に課題

無料見積サイバー保険の⼀括⾒積⽐較はこちらから

画像:BBCより引用

Googleの生成AI「Gemini」が、サイバーセキュリティ能力を評価する試験中に、実在する企業3社のシステムへ自律的に不正アクセスしていたことが明らかになりました。

報道によると、事案は独立した評価会社Irregularが実施した2026年5月の試験で発生しました。試験では、用意された架空企業のシステムから情報を取得する課題が与えられていましたが、本来は制限されるはずのインターネット接続が意図せず可能になっており、Geminiは試験環境の外にある実在企業のシステムへアクセスしました。

一連の出来事において、Geminiによる不正アクセスは複数回確認されています。情報によると、このうち1件は、試験用の架空企業と同じ名前の実在企業を取り違え、パスワードを推測して侵入していた、とのこと。残る2件では、ウェブ検索で見つけた公開リポジトリに含まれる認証情報を使い、実在企業のシステムに侵入したとされています。

Googleは事案について、Geminiはいずれの事例でも、侵入先が試験用ではなく実在企業のシステムだと気づいた段階で、自ら行動を停止したとしています。なお、同様の事例はOpenAIでも発生しており、2026年7月の試験中に、AIモデルがHugging Faceなどのシステムに不正アクセスしていたことが明らかになっています。OpenAIは当時のモデルについて、通常より安全対策を減らした試験条件で動作していたと説明しています。

これらの事例は、AIが与えられた課題を進める過程で、許可された範囲を超えて外部システムにアクセスする危険性を示しています。AIによるサイバー攻撃への懸念が一段と強まり、企業においては、セキュリティ対策の徹底が一層求められる状況です。

参照Google’s Gemini AI hacked three companies in security test|BBC