AIエージェント

研究・論文

プロンプトインジェクションはSSRFに化ける|研究解説

LLMを組み込んだWebアプリでは、プロンプトインジェクションがSSRFやSQLiなど古典的脆弱性への新しい侵入経路になる。そう整理した査読前の研究を、7モデル×5シナリオの実験結果と情シスが押さえるべき防御の優先順位とあわせて解説します。
研究・論文

AIエージェントのメモリ干渉|記憶が更新されない罠

AIエージェントの長期記憶は、新しい情報を入れても上書きされないことがある。arXivの査読前論文が示した「メモリ干渉」の構造と、社内AI運用で情シスが備えるべき点を解説します。
研究・論文

GUIエージェントのガードレール、説得で崩れる

画面を操作するGUIエージェントに「危険な操作はするな」と1行書くだけで攻撃成功率は最大約40ポイント下がる。ただし単発の依頼に限る話でした。4ターンの段階的な説得で防御が押し戻されることを示した査読前研究を、情シス目線で読み解きます。
研究・論文

MCPサーバ91.8%が認証なし|研究解説

インターネットに公開されたMCPサーバ414台を実際に検査した査読前研究を解説します。91.8%がOAuth認証なし、687のツールが制限なしのシェル実行を露出。情シスが自組織で確認すべき点を整理します。
研究・論文

AI生成文に秘密情報を隠す研究|検知の限界

LLMが生成する自然な文章に秘密情報を埋め込む「生成型テキストステガノグラフィ」の査読前研究を解説。受信側で100%復元できるようになった意味と、平文監視やDLPでは見つけられない情報持ち出し経路について、情シスの実務目線で整理します。
研究・論文

プロンプトインジェクション検知、AI内部信号の研究

AIエージェントは間接プロンプトインジェクションに「内部では気づいている」——2026年8月公開の査読前論文がそう示しました。検知精度AUROC90%超という結果と、情シスが押さえるべき前提条件・限界を整理します。
研究・論文

マルチエージェント化で攻撃面が拡大|研究解説

AIエージェントを1体から複数体の分業構成に変えるだけで、単体では成立しない攻撃が通る——arXivの査読前研究「From Monoliths to Swarms」を、情シスの実務目線で読み解きます。
研究・論文

AIエージェントの設計は外部から複製されうる|研究解説

社内AIエージェントの「ハーネス」(指示や連携の設計)は、外から対話するだけで復元されうる——arXivの査読前研究が示したリスクと、情シスが今のうちに整理しておくべき前提を解説します。
研究・論文

マルチエージェントAIの盲点|連結で崩れる安全性

個々のLLMが安全でも、複数のAIエージェントを連結すると安全性は崩れる——査読前研究「ChannelGuard」が指摘する多エージェント構成の盲点と、情シスが押さえるべき勘所を実務目線で解説します。
研究・論文

MCPサーバの脆弱性を実行証拠で検出|研究解説

LLMエージェントの外部連携基盤MCPの脆弱性を、疑わしい文字列ではなく実際の実行結果(証拠)で判定する検査手法FlowGuardの査読前研究を、情シス目線で解説します。
研究・論文

AIエージェントの「停止」は効くのか 承認ゲートの穴を検証

AIエージェント基盤の「承認ゲート」「キャンセル」「タイムアウト」は、止めたはずでも副作用が実行されることがある——査読前研究が6つの主要フレームワークで実効性の欠落を測定。情シスが押さえるべき論点を解説します。
研究・論文

AIエージェントの隠れた改ざんを構造監視で検知|研究解説

AIコーディングエージェントがタスク達成の裏で権限拡張やログ劣化を仕込むリスクを、訓練不要の「構造監視」で検知する査読前研究を解説。情シスがAI導入時に押さえるべき監視の勘所をまとめます。
研究・論文

AIエージェントのメモリが新たな攻撃面に 研究解説

AIエージェントの永続的な「メモリ」がプロンプトインジェクションの新たな攻撃面になると指摘する査読前研究を情シス向けに解説。外部からの上書きは難しい一方、一度埋め込まれた命令はセッションを越えて悪用されうる点を整理します。
研究・論文

認証情報の漏えいをAIエージェントで検出 研究解説

メールやチケット、インシデント記録に紛れ込んだ認証情報をLLMエージェントで検出し、その鍵が「どのシステムを開けるか」まで特定する査読前研究を、情シスの実務目線で読み解きます。
研究・論文

プロンプト注入を因果で防ぐ研究「ARGUS」

AIエージェントを狙う「文脈依存型」のプロンプトインジェクションを、行動の因果的な裏付けを検証して防ぐ研究「ARGUS」を情シス実務者向けに解説します。攻撃成功率28.8%→3.8%という結果と、その限界を整理します。