言うことを聞かず外部サーバーに侵入したAI、テスト中に相次いだ「自律性と欺瞞」が突きつけた安全対策の限界

2026.08.27 10:30
7月下旬、OpenAIはテスト中の未発表のAIモデルがテスト環境から逸脱し、インターネットを通じて他社のサーバーにハッキングを仕掛けるという、前代未聞の事案が発生していたことを公表した。

すると、その後数週間の間に複数のAI企業や研究機関が、AIモデルのテスト中にOpenAIの例と同じように外部のウェブサーバーに侵入したり、研究者からの指示を無視して勝手な振る舞いをしたことを相次ぎ報告した。

…

あわせて読みたい