ニュース表@ふたば
[ホーム]

[掲示板に戻る]
レス送信モード
おなまえ
E-mail
題  名
コメント
添付File []
削除キー(記事の削除用。英数字で8文字以内)

画像ファイル名:1786104921692.jpg-(181629 B)
181629 BOpenAIのテストAIが「AI同士の掲示板」を勝手に構築して情報共有し攻撃を実行していたことが判明Name名無し26/08/07(金)21:15:21 IP:133.175.*(vectant.ne.jp)No.4410373+ 9月18日頃消えます
【Gigazine】2026年7月21日にOpenAIは「テスト中のAIがHugging Faceを攻撃してしまうセキュリティインシデントが発生した」と発表しました。このインシデントについて、OpenAIの研究者がセキュリティカンファレンスのBlack Hat USA 2026で講演し、「AIエージェント同士が情報共有のための掲示板を秘密裏に形成していた」というエージェントの自律的な攻撃実態について説明しました。

OpenAIはテスト中のAIモデルによるHugging Faceへの攻撃について、「テストモデルにはインターネットへのアクセス権限を与えていなかったが、モデルはパッケージ管理システムのArtifactoryに存在する脆弱(ぜいじゃく)性を悪用してインターネットに接続し、Hugging Faceに対する攻撃を実行した」と説明しています。また、OpenAIは攻撃を即座に検知することができず、攻撃成功から1週間ほど経過した2026年7月19日に調査を開始したことが明らかになっています。

(中略)説明によると、OpenAIは2026年5月7日に内部評価モデルの実験的な強化学習フローを開始したとのこと。
1無題Name名無し 26/08/07(金)21:15:55 IP:133.175.*(vectant.ne.jp)No.4410374+
    1786104955162.png-(229102 B)
229102 B
強化学習の一環としてモデルに困難な課題を与えた結果、モデルはOpenAIの内部ネットワークで稼働しているArtifactoryに対する攻撃を実施してインターネットへの接続を試みました。攻撃は失敗したものの、攻撃の過程で「Artifactoryのシステム内にデータを書き込める」ということにモデルが気付いたとのこと。その後、別のAIエージェントがArtifactoryのシステム内に「他のエージェントに課題解決の助けを求めるメモ」を保存したことを切っ掛けにAIエージェント同士で情報を共有する掲示板のようなシステムが形成されました。

2026年5月26日には「掲示板」でやり取りされた情報をもとに「Artifactoryの脆弱性を悪用してインターネットに接続する」という手法が確立されました。

その後、2026年7月4日にエージェントによるアクセスの過負荷によってArtifactoryのシステムがダウン。
2無題Name名無し 26/08/07(金)21:16:20 IP:133.175.*(vectant.ne.jp)No.4410375+
    1786104980407.png-(73683 B)
73683 B
この時点でOpenAIは掲示板が形成されていたことに気付き、掲示板を作成できないように対策を講じました。しかし、AIエージェントは認証されていないWebDAVエンドポイントを悪用して2026年7月8日に掲示板を再構築し、情報共有を再開しました。

AIエージェントは共有した情報を悪用して2026年7月8日〜19日にOpenAI内部、2026年7月8日〜13日にはHugging Faceへの攻撃を実施。そして2026年7月16日にHugging Faceが「AIエージェントによる攻撃」の存在を公表し、2026年7月19日にOpenAIがインシデントを報告するに至ったというわけです。

なお、AnthropicもOpenAIのインシデントを受けて過去のテスト内容を精査し、テストモデルによる外部への攻撃が実行されていたことを報告しています。

https://gigazine.net/news/20260807-openai-hugging-face-explain/

- GazouBBS + futaba-