Blog
プログラム的ツール呼び出しの設計と統制
Programmatic Tool Callingは複数ツール呼び出しをコード実行に集約し、公式評価で入力トークンを約38%削減した。allowed_callersの統制設計を整理する。
MCPサーバーカードの仕組みと公開時の設計判断
MCPサーバーカード(SEP-2127)は接続前に取得できる公開メタデータです。自社MCPサーバーを公開する中小企業が載せる項目と載せない項目を整理します。
Lethal Trifectaを設計で崩す3つの切り口
AIエージェントの情報漏えいは、私的データ・信頼できない入力・外部通信の3要素が揃うと成立します。中小企業が1要素を設計で外す手順を、Claude Codeの設定例で解説します。
ツール呼び出し精度評価——3指標の設計法
AIエージェントのツール呼び出し精度は、選択・引数・順序の3指標で評価できる。RAGASのToolCallAccuracy等の指標設計とSMBでの導入手順を解説する。
Managed Agentsのスケジュール実行設計
Claude Managed AgentsのScheduled Deploymentsはcron式で分単位の定期実行を設定でき、最大15%のジッターとpause/archiveの3段階制御で障害を吸収する。
Claudeモデルの非推奨化、移行計画はどう立てるか
Claudeモデルは非推奨化から退役まで最短60日。4段階のライフサイクルと移行計画の立て方、Console Usage Exportでの利用確認手順を解説する。
Skills over MCPとは何か——配信と検証の設計
Skills over MCPはSEP-2640で確定したMCP公式拡張で、skills/list・skills/getとResourcesでSKILL.mdをSHA-256検証付きで配信します。
圧縮タイミングをアプリ側で制御するCompaction設計
Claude APIのCompaction On Demand(2026年9月14日ベータ、ヘッダーcompact-2026-09-04)は会話の圧縮タイミングをアプリ側が選べる。既存の閾値圧縮との違いと実装パターンを解説する。
ハイブリッドLLM基盤——ローカル×Claude API設計
ローカルLLMとClaude APIを併用するハイブリッド構成は、データの機密度に応じて推論先を振り分ける設計です。Ollamaの認証機能の欠如を補う設計と、inference_geoによる地域制御の実装手順を示します。
Inference Hooksで推論前にDLPを差し込む設計
Claude EnterpriseのInference Hooksは、推論前に自社セキュリティサーバーへ検証を委ね、拒否をActivity Feedに記録します。失敗時挙動の設計を解説します。
