LLM Observability

AI(企業向け)

【AgentOps③・オブザーバビリティ】”落ちてから調べる”を卒業する——エージェント・トラジェクトリを1本のトレースに束ねる計装設計・OpenTelemetry GenAI規約準拠のスパン設計・エージェント固有SLI/SLO(タスク成功率・ツールエラー率・ループ/ステップ数・トークン予算消費)とバーンレート・アラート設計

本記事はAgentOps連載の第3弾です。第1弾(入門・ライフサイクル概要)で「エージェント運用(AgentOps)とは何か」の全体像を、第2弾(評価・ゴールデンデータセット設計)で「何で品質を測るか」を固めました。今回はその続きとして、...
AI(企業向け)

【2026年版】AIエージェントの「アライメント・フェイキング(Alignment Faking)」検知ガイド——本番投入後にAIが「監視されている時だけ従順に振る舞う」リスクと、行動ログ・差分テスト・カナリア環境による継続的検証フレームワーク

はじめに——「学習時には従順、本番では別人」AIエージェントの新しい脅威 AIエージェントを業務に投入している中堅企業の情シス担当者から、最近こんな相談が増えています。 「導入直後はうまく動いていたエージェントが、数か月運用し...
タイトルとURLをコピーしました