AIエージェント

AI(企業向け)

【2026年版】AIエージェントの「緊急停止・被害範囲最小化(キルスイッチ/サーキットブレーカー)」設計ガイド——自律化したエージェントが暴走・乗っ取られた瞬間に”止める・囲い込む・巻き戻す”を、権限サーキットブレーカー・支出/レート遮断・ブラストラジウス分離・段階的自律で実装する多層封じ込め

はじめに——「防ぐ」でも「直す」でもない、"暴走している最中に止める"という空白 これまでのAIセキュリティ記事では、プロンプトインジェクションやツールポイズニング、モデル抽出といった「侵入・攻撃を事前に防ぐ」ための多層防御を中心に...
AI(企業向け)

【連載⑳・最終回】企業AI導入「つまずき」解決シリーズ 総集編——19の壁を1枚の地図に統合する「AIガバナンス全体像」|定着・ROI・PoC死から、人事・組織・コスト・レジリエンス、対外開示・委託先・顧客受容まで——”点の対処”を”経営の仕組み”に束ね、これからのAI経営へ橋渡しする統合フレーム

はじめに——19の壁を歩き終えて、いま「地図」を描く 本連載「企業AI導入『つまずき』解決シリーズ」は、第1回の「導入したのに誰も使わない」から始まり、前回⑲の「顧客が“AIには対応されたくない”と離れていく」まで、企業がAIを事業...
AI(企業向け)

【2026年版】MCPの「ツールポイズニング/ラグプル」対策ガイド——AIエージェントが読む”ツールの説明文”に見えない指示を仕込まれ、承認後に中身が静かに書き換わる手口と、ツール定義のピン留め・再承認ゲート・クロスサーバー・シャドーイング検知・実行前スキャンによる多層防御

はじめに——AIエージェントが「読む」ツールの説明文が、攻撃の入口になる これまでのAIセキュリティ記事では、公開した推論エンドポイントの窃取や、モデルハブ・プラグインを狙うAIサプライチェーン攻撃、あるいはツール呼び出し時の引数イ...
AI(企業向け)

【2026年版】AIエージェントの「サンドボックス脱出」対策ガイド——コード実行・ファイル操作を許したエージェントが隔離環境を破って母艦に到達する手口と、コンテナ強化・エグレス制御・実行前ポリシー検査・使い捨て環境による多層防御

はじめに——「サンドボックスで実行すれば安全」という前提そのものを疑う これまでのAIセキュリティ記事では、Claude Code・Cowork・OpenClaw系のエージェントにコード実行やファイル操作を許すとき、「サンドボックス...
AI(企業向け)

【2026年版】AIエージェントの「インシデントレスポンス&フォレンジック」実務ガイド——検知した後どう動くか|会話ログ・ツール呼び出し履歴・メモリスナップショットの証拠保全と、封じ込め・根本原因分析・再発防止をAI特有の揮発性に合わせて再設計するIR運用

はじめに——「検知した」その後の30分で、証拠は消えていく これまでのAIセキュリティ記事では、プロンプトインジェクションやメモリ汚染、目標ハイジャック、ゼロクリック・データ流出といった攻撃を「どう検知し、どう防ぐか」を中心に扱って...
AI(企業向け)

【2026年版】AIエージェントの「目標ハイジャック(Agent Goal Hijack)」防御ガイド——単発のプロンプトインジェクションでは終わらない”長時間タスクの目標すり替え”の手口と、計画層の監視・目標整合性チェック・チェックポイント検証による多層防御

これまでのAIエージェント・セキュリティ記事では、「1回の入力でAIを乗っ取る」プロンプトインジェクションや、「記憶を書き換える」メモリ汚染、「下流に毒を流す」出力汚染を、それぞれ独立した攻撃として扱ってきました。しかし2026年、これら...
AI(企業向け)

【2026年版】Hermes Agent実践導入&OpenClaw移行ガイド——自己学習する自己ホスト型AIエージェントの仕組み・OpenClawとの違い・curl一発の導入手順と、hermes claw migrateによるメモリ/スキル/APIキー/チャネル設定の無停止移行

はじめに——「乗り換え」ではなく「無停止カットオーバー」として設計する 2026年のAIエージェント界隈は、ひとつの巨大なエコシステム(OpenClaw)と、それを猛追する自己学習型の新鋭(Hermes Agent)の二強構図に整理...
AI(企業向け)

【2026年版】PewDiePie発「Odysseus」実践導入&安全運用ガイド——shell・メール・カレンダー権限を持つローカルファーストAIワークスペースを、逆プロキシ・Tailscale・サービス内部化で”管理コンソール”として安全に晒さない設計

2026年5月31日、世界最大級のYouTuberであるPewDiePie(Felix Kjellberg)が「Odysseus(オデュッセウス)」というセルフホスト型AIワークスペースを公開しました。公開から48時間でGitHubスター...
AI(企業向け)

【2026年版】AIエージェントの「評価・トラジェクトリ採点」設計ガイド——「動いた」と「正しく仕事をした」は別物|タスク成功率・ツール呼び出し精度・軌跡効率をτ-bench/LLM-as-Judgeで継続採点し、CIで回帰を止める

「デモでは完璧に動いたエージェントが、本番リリースのたびにどこか壊れる」「最終的な答えは合っているのに、なぜか余計なツールを叩いて遅い・高い」——AIエージェントを本番運用し始めた開発者から、こんな相談が急増しています。 従来のソフ...
AI(企業向け)

【2026年版】AIエージェントの「コンテキストエンジニアリング」設計ガイド——メモリ設計の次に来る”コンテキスト・ウィンドウ予算管理”|Context Rot・圧縮・サブエージェント分離・JIT取得で「長く動くほど精度が落ちる」を防ぐ実装

AIエージェントを作っていて、こんな経験はありませんか。「最初の2〜3ステップは完璧に動くのに、ステップが進むにつれて指示を無視しはじめ、最後には全然関係ない行動を取る」——。多くの開発者が「プロンプトが悪いのでは」「モデルが弱いのでは」...
タイトルとURLをコピーしました