プロンプトインジェクション

AI(企業向け)

【2026年版】電話応対AI・ボイスボットの「音声チャネル攻撃」対策ガイド——ボイスクローンによる本人確認突破・通話中プロンプトインジェクション・ツール呼び出し悪用で”電話口のAI”が乗っ取られる手口と、発信者検証・ライブネス検知・ASR後サニタイズ・高リスク操作の人間ゲートによる多層防御

はじめに——守る対象が「画面の中のAI」から「電話口のAI」へ これまでのAIセキュリティ記事では、チャットボットやAPIといったテキストベースの公開推論エンドポイントを守る話(モデル抽出・蒸留窃取対策)や、画像・音声を「入力」とし...
AI(企業向け)

【2026年版】AIの「守る側」が攻撃される——ガードレール回避・LLM-as-a-Judge汚染・監視テレメトリ改ざん|検知・評価レイヤー自体を無力化する”メタ攻撃”の手口と、評価者分離・多数決判定・改ざん不能ログによる多層防御

はじめに——「守る仕組み」そのものが、次の標的になる これまでのAIセキュリティ記事では、「守る仕組み」を一段ずつ積み上げてきました。入口でプロンプトインジェクションを弾くガードレール(分類器・入力フィルタ)、エージェントの振る舞い...
AI(企業向け)

【2026年版】AIブラウザ/コンピュータ操作エージェントの「知覚層インジェクション」防御ガイド——エージェントが”見ている画面・DOM・アクセシビリティツリー”に偽装指示を仕込まれ操作を乗っ取られる手口と、視覚的サニタイズ・操作前確認ゲート・到達ドメイン制限による多層防御

はじめに——攻撃面は「テキスト入力」から、エージェントが"見ている画面"へ移った これまでのAIセキュリティ記事では、プロンプト欄やAPIに送り込まれるテキスト入力をどう検証するかを中心に扱ってきました。しかし2026年、Claud...
AI(企業向け)

【2026年版】AIエージェントの「目標ハイジャック(Agent Goal Hijack)」防御ガイド——単発のプロンプトインジェクションでは終わらない”長時間タスクの目標すり替え”の手口と、計画層の監視・目標整合性チェック・チェックポイント検証による多層防御

これまでのAIエージェント・セキュリティ記事では、「1回の入力でAIを乗っ取る」プロンプトインジェクションや、「記憶を書き換える」メモリ汚染、「下流に毒を流す」出力汚染を、それぞれ独立した攻撃として扱ってきました。しかし2026年、これら...
AI(企業向け)

【2026年版】AIアシスタントの「ゼロクリック・データ流出」防御ガイド——EchoLeak・ShadowLeak・HashJackが”ユーザーが何もしなくても”社内データを盗む仕組みと、自動レンダリング遮断・出力チャネル封鎖・情報フロー制御による多層防御

これまでのAIセキュリティ記事では、攻撃者が「何かを送り込む」「エージェントに何かを実行させる」といった能動的な攻撃を中心に扱ってきました。しかし2025〜2026年に実証された新種の流出は、その前提を覆します。ユーザーは何もクリックせず...
AI(企業向け)

2026年版】LLMジェイルブレイク対策ガイド——「プロンプトインジェクション」とは別物。Crescendo・Many-shot・Policy Puppetryで”モデル自身の安全機構”を破る手口と、入出力分類器・マルチターン会話監視・レッドチームによる多層防御

はじめに——守るべきは「注入された指示」ではなく「モデル自身の安全判断」 これまでのAIセキュリティ記事では、プロンプトインジェクション、プロンプトリーク、Confused Deputy(混乱した代理人)といった、外部から注入された...
AI(企業向け)

2026年版】マルチモーダル・プロンプトインジェクション対策ガイド——画像・PDF・音声に「見えない指示」を仕込まれ、VLM搭載エージェントが乗っ取られる手口と、OCR前処理・モダリティ分離(Dual-LLM)・非テキスト経路の入力検査による多層防御

はじめに——攻撃面は「テキスト」から「画像・PDF・音声」へ移った これまでのインジェクション系の記事では、システムプロンプトを吐かせる「プロンプトリーク」、ツール呼び出しを乗っ取る攻撃、出力を汚染する手口、間接的なデータ送信といっ...
AI(企業向け)

【2026年版】AIエージェントの「自己増殖型プロンプトインジェクション(AIワーム)」封じ込めガイド——Morris II型攻撃がA2A・共有メモリ・MCPを伝播する仕組みと、伝播遮断・隔離(セグメンテーション)・増殖検知による封じ込め設計

はじめに——「1体の汚染」から「群れの連鎖崩壊」へ これまでのプロンプトインジェクション系の記事では、「1体のAIエージェントがどう汚染されるか」「汚染された出力が下流でどう暴走するか」を中心に扱ってきました。しかし2026年、A2...
AI(企業向け)

【2026年版】AIエージェントの「モデルカスケード/LLMルーティング層」セキュリティ設計ガイド——コスト最適化が招く強制ダウングレード攻撃・判定汚染・フォールバック権限逸脱への防御設計

「コストを下げるために、GPT-5 → GPT-5-mini → Claude Haiku と自動で振り分けるルーターを入れた」——2026年、こうしたモデルルーティング/カスケード構成はLLMアプリの標準装備になりつつあります。しかし、...
AI(企業向け)

【2026年版】AIエージェントの「Confused Deputy(混乱した代理人)」攻撃対策ガイド——MCPサーバー・ブラウザエージェント・Coworkが”ユーザーの権限で攻撃者の指示を実行する”構造的脆弱性と、コンテキスト分離・権限プロビナンス追跡・人間承認ゲートによる防御設計

はじめに——「ユーザーの権限で、攻撃者の指示が実行される」という構造的脆弱性 2025年から2026年にかけて、AIエージェントの業務導入が一気に進みました。Claude Desktop・Claude Code・Cowork、Cha...
タイトルとURLをコピーしました