リサーチ・論文

アンソロピック「クロード・コード オートモード」にプロンプトインジェクション攻撃確認

サイモン・ウィリソンズ・ウェブログ (Simon Willison's Weblog) は8月27日(現地時間)、米AIスタートアップ Anthropic (アンソロピック) がプロンプト・インジェクション攻撃からの保護策として重視する「Claude Code (クロード・コード) Auto Mode (オート・モード)」に、セキュリティ研究者が攻撃手法を発見したと報じた。この機能はAnthropicがデフォルト設定としており、その有効性を強調していた。

リサーチ・論文

Microsoft Word向けCopilotに自己複製型ワームを発見

Simon Willison's Weblog (サイモン・ウィリソンズ・ウェブログ) は2026年7月29日(現地時間)付けで、Håkon Måløy (ホーコン・モーロイ) 氏が、Microsoft WordのCopilotに対するプロンプトインジェクション攻撃を自己複製型ワームに進化させる手法を発見したと報じた。攻撃者はドキュメント内に隠された指示を配置し、Copilotがその指示をユーザーのリクエストの一部と解釈して、編集中または作成中のドキュメントを操作する。さらにCopilotはその隠し指示を生成ドキュメントにコピーし、新たな伝播元となりうる。

リサーチ・論文

AIアシスタントへのプロンプトインジェクション攻撃、6000回の試行で秘密漏洩せず

Simon Willison's Weblogが2026年6月26日(現地時間)付けで報じたところによると、フェルナンド・イララサバル氏が運営する「hackmyclaw.com」でのチャレンジにおいて、AIアシスタント「OpenClaw」のテストインスタンスからの秘密漏洩を試みるプロンプトインジェクション攻撃が、2000人の参加者による6000回の試行にもかかわらず、一度も成功しなかったことが明らかになった。このテストには500ドルのトークン費用が費やされ、多すぎる受信メールによりGoogleアカウントの一時停止も発生したが、機密情報の引き出しは阻止された。

リサーチ・論文

仮想インシデント「CVE-2026-LGTM」レポートが話題に

Simon Willison's Weblogが2026年6月26日(現地時間)付けで報じたところによると、アンドリュー・ネスビット (Andrew Nesbitt) 氏が作成した仮想インシデントレポート「CVE-2026-LGTM」が注目を集めている。このレポートは、競合するベンダーのAIレビューエージェントが、あるパッケージの悪意性を巡って意見対立ループに陥り、多額の費用とコメント数を費やした仮説的な事例を描写している。

リサーチ・論文

OpenAI、ChatGPTに「Lockdown Mode」導入 プロンプトインジェクション攻撃からのデータ漏洩阻止へ

OpenAIは6月5日(現地時間)、チャットボットサービスChatGPTに新機能「Lockdown Mode」を導入した。これは、プロンプトインジェクション攻撃による情報漏洩の最終段階を阻止することを目的としており、外部ネットワークへのリクエストを厳しく制限することで、機密データが攻撃者に転送されるのを防ぐ。この機能は、個人向けアカウントやセルフサービス型ビジネスアカウントに順次展開されており、安全な利用環境の提供を目指す。

リサーチ・論文

MetaのAI悪用でInstagramアカウント乗っ取り: サポートシステム連携に脆弱性の指摘

Meta(メタ)は2026年6月1日(現地時間)、同社のAIサポートシステムが悪用され、Instagram(インスタグラム)の著名アカウントが不正に乗っ取られる事案が発生したことをSimon Willison's Weblogが報じた。ハッカーはAIチャットボットに対し、ターゲットアカウントを新しいメールアドレスにリンクするよう要求するだけで、通常のアカウント復旧プロセスを迂回することに成功。この事態は、Metaがアカウント復旧プロセスを迅速化するため、サポートシステムをAIチャットボットと連携させていたことに起因すると見られている。