リサーチ・論文

アンソロピック「クロード・コード オートモード」にプロンプトインジェクション攻撃確認

サイモン・ウィリソンズ・ウェブログ (Simon Willison's Weblog) は8月27日(現地時間)、米AIスタートアップ Anthropic (アンソロピック) がプロンプト・インジェクション攻撃からの保護策として重視する「Claude Code (クロード・コード) Auto Mode (オート・モード)」に、セキュリティ研究者が攻撃手法を発見したと報じた。この機能はAnthropicがデフォルト設定としており、その有効性を強調していた。

ベンダー・製品

Zed、エージェントパネルにサンドボックス機能を導入、AI実行の安全性を強化

Zedは8月5日(現地時間)、開発環境「Zed」のエージェントパネル内におけるサンドボックス機能のサポートを開始しました。この機能は、エージェントがターミナルおよびフェッチツールを利用する際の操作をオペレーティングシステムによって強制的に制限するものです。バージョン1.14のリリースから、全てのユーザーに対してデフォルトで有効化されます。ユーザーはエージェントの行動を厳密に制御できるようになり、意図しない挙動やプロンプトインジェクション攻撃からの防御を強化します。

リサーチ・論文

Thomas Ptacek氏、2025年AIモデルの脱出能力に警鐘

Thomas Ptacek氏は2026年7月22日(現地時間)、2025年に公開されるオープンウェイトモデルを活用し、ペンテストハーネスを構築すれば、多くのネットワークでサンドボックスからの脱出、スキャン、ハッキングが可能になるとの見方を示した。同氏はこの能力が最先端のフロンティアモデルに限定されるものではないとも指摘していると、Simon Willison's Weblogが報じた。

リサーチ・論文

Datasette Agent、WASMサンドボックスでMicroPython稼働:AIコード安全実行へ

Simon Willison's Weblogは2026年6月2日(現地時間)、Datasette Agent向け新ツール『datasette-agent-micropython 0.1a0』のリリースを伝えた。このツールは、データセット操作AIエージェントが生成するPythonコードを、WebAssembly (WASM) サンドボックス内で稼働するMicroPythonにより安全に実行することを目指す。大規模言語モデル (LLM) のGPT-5.5が初期アルファ版でサンドボックスからの脱出に失敗しており、AIが生成する未知のコードを安全に実行するための基盤構築に向けた進展が示された。

リサーチ・論文

サイモン・ウィルソン氏、Wasmサンドボックス向けMicroPythonライブラリ「micropython-wasm 0.1a1」をリリース

「Simon Willison’s Weblog」は2026年6月2日午後7時20分(現地時間)に、サイモン・ウィルソン氏がMicroPythonサンドボックスをWebAssemblyで動作させるためのPythonライブラリ「micropython-wasm 0.1a1」をリリースしたと報じました。本ライブラリは、WebAssemblyの持つサンドボックス機能とポータビリティを活用し、MicroPythonコードを安全かつ効率的に実行する環境を提供します。リリースに際し、既存プロジェクト「datasette-agent-micropython」の開発過程で顕在化した複数の技術的制限が解消されたとされています。