ブリュッセル=西尾邦明印刷するメールでシェアするFacebookでシェアするXでシェアするはてなブックマークでシェアする

[PR]

英政府機関のAISI(人工知能安全研究所)は4日、最先端AIモデルが性能評価テストの途中で、実在する人間をだます形でサイバー攻撃を試みたと発表した。偽アカウントや偽メールの送信など、人間を欺く手法を駆使したという。実際の被害は生じていないが、AISIは「特定の指示なしに、現実世界で実在の人物を標的とした、これほど深刻な欺きを確認したのは初めて」と警告している。 AISIは7月25~28日に米アンソロピックの「ミュトス5」と米オープンAIの「GPT5.6ソル」について、悪用を防ぐ安全対策を無効化した状態でテストした。122回のテストのうち10回で計19件の不正行為を確認し、内訳はミュトスが17件、GPTが2件だった。 深刻だったのは、ミュトス5による攻撃。課題の解決手段を探す過程で想定外の行動を取り、実在するソフトに悪意のあるコードを仕込もうと試み、そのためにAIが自ら複数の偽アカウントを作り、保守担当者に承認を迫ったという。標的となる人物の活動時間や利用ツールなどもネット上で調べて攻撃を設計していた。 AIは悪意を指摘されても、別のアカウントから擁護したり、「単純なミスだった」とうそをついて編集履歴を書き換えたりして無害を装った。最終的に人間の判断で被害を阻止できたが、AISIは「成功と失敗の差はわずかだった」と分析している。■「重大なインシデント」…この記事は有料記事です。残り229文字有料会員になると続きをお読みいただけます。※無料期間中に解約した場合、料金はかかりませんこの記事を書いた人西尾邦明欧州総局|経済担当専門・関心分野金融・財政、原発・エネルギー、AI・テクノロジー関連トピック・ジャンルジャンル印刷するメールでシェアするFacebookでシェアするXでシェアするはてなブックマークでシェアする