- 📄 論文解説: GAAT — ガバナンス対応エージェントテレメトリによるマルチエージェントAIの閉ループ制御
- ✍️ OpenTelemetry公式解説: AIエージェント可観測性の標準化 — GenAIセマンティック規約とベストプラクティス
- ✍️ Cerbos公式解説: MCPサーバーへのポリシーベース認可制御 — RBAC/ABACをYAMLで宣言的に管理
- 📄 論文解説: 実運用MCPサーバー7,973台の認証セキュリティ実態調査 — 40%が認証なしでツール公開
- 📄 論文解説: Securing the Model Context Protocol — MCPの脅威モデルと防御制御フレームワーク
論文概要(Abstract) SqueezeAttentionは、LLM推論時のKVキャッシュを層方向(layer-wise)とトークン方向(sequence-wise)の2次元で管理する手法である。従来のKVキャッシュ圧縮手法がすべてのAttention層に一律のバジェットを割り当てていたのに対し、著者らはコサイン類似度による層重要度測定に基づいて各層に異なるKVバジェットを配分する。著...