BlogPage 19 / 31

· Kuu株式会社 エンジニアリング · 約6分

MCP Streamable HTTP移行設計——セッション管理・後方互換・水平スケール

MCP 2025-06-18仕様でHTTP+SSEは廃止予定となり、単一エンドポイントのStreamable HTTPが標準に。セッション管理・水平スケール・後方互換設計の実装要点を解説します。

MCPプロトコルStreamable HTTPエンタープライズ
· Kuu株式会社 エンジニアリング · 約4分

エージェント評価のCI/CD統合——品質ゲートとパイプライン設計

AIエージェントの評価をCI/CDパイプラインに組み込む方法を解説。PRごとにgraderが自動採点しスコア0.85以上を品質ゲートとする設計から、GitHub Actionsへの統合パターンまで示す。

エージェント評価CI/CD品質ゲートLLMOps
· Kuu株式会社 エンジニアリング · 約6分

エージェントリリース管理——ブルーグリーン・カナリア展開の設計

エージェントのコード・プロンプト・モデル・ツールスキーマをバージョン管理し、ブルーグリーンとカナリアリリースで本番展開する設計を解説する。品質ゲートの自動化とロールバックトリガーの実装まで踏み込む。

エージェントアーキテクチャデプロイ設計リリース管理AIエージェント
· Kuu株式会社 エンジニアリング · 約5分

合成評価データでエージェントテストを自動化する

LLMを使った合成評価データセット生成でAIエージェントのテストを自動化する。ペルソナシミュレーター・ツール呼び出し・マルチターン会話・敵対的ケースの4パターンとAnthropicが推奨する品質設計を解説します。

合成評価データエージェント評価LLM-as-judge評価設計
· Kuu株式会社 エンジニアリング · 約5分

エージェントのハルシネーション検知——整合性サンプリングと根拠検証

エンタープライズAIエージェントのハルシネーション検知に必要な4技術——トークン確率・整合性サンプリング・根拠検証・LLMジャッジを解説します。3層信頼スコア設計で本番フィルタリングを自動化する実装パターンを示します。

ハルシネーション検知エージェント評価根拠検証エージェントガバナンス
· Kuu株式会社 エンジニアリング · 約5分

MCP Sampling——LLM補完委譲の設計とセキュリティ

MCP Samplingでサーバーがクライアント経由でLLM補完を要求できる。APIキー不要の委譲設計・modelPreferences・Human-in-the-Loop承認フローと、プロンプトインジェクション対策を仕様から解説します。

MCPプロトコルAIエージェントセキュリティ
· Kuu株式会社 エンジニアリング · 約5分

MCPのElicitation——ツール実行中のユーザー入力収集と応答設計

MCP Elicitationは2025-06-18版で追加されたクライアント機能で、ツール実行中にサーバーがユーザーへ構造化入力を要求できる。3アクション応答モデルとJSON Schema制約、セキュリティ設計を解説。

MCPElicitationプロトコルAIエージェント
· Kuu株式会社 エンジニアリング · 約5分

マルチステップ評価設計——ターン単位とエンドツーエンドの使い分け

マルチステップAIエージェントの評価設計を解説。ターン単位のツール精度・軌跡(トレジェクトリ)評価・タスク完了率を組み合わせ、複雑な業務エージェントの品質を測る実装パターンを示します。

マルチステップ評価トレジェクトリ評価ツール精度エージェントガバナンス
· Kuu株式会社 エンジニアリング · 約5分

ISO 42001 技術統制の実装——Annex A 制御策をAIシステムへ組み込む

ISO/IEC 42001 Annex Aの38制御策をAIシステムへ実装する方法を解説。A.6ライフサイクル管理・A.7データ管理の技術統制を設計・監視・監査証跡に落とし込む実装パターンを示します。

ISO 42001技術統制エージェントガバナンスエンタープライズAI
· Kuu株式会社 エンジニアリング · 約6分

エージェントのツール実行環境——サンドボックス分離の設計パターン

AIエージェントのツール実行にはサンドボックス分離が必須です。Docker・gVisor・Firecracker・WASMのリスク別選定基準と、最小権限ネットワーク制御・エフェメラル実行コンテキスト設計をエンタープライズ向けに解説します。

サンドボックスセキュリティツール実行エージェントアーキテクチャ