本記事は AWS Machine Learning Blog: Introducing agent-to-agent protocol support in Amazon Bedrock AgentCore Runtime および AWS Open Source Blog: Open Protocols for Agent Interoperability Part 4 の解説記事です。 ...
08/03/2026 blog tech_blog
AWS A2A Bedrock +7
本記事は https://arxiv.org/abs/2405.16444 の解説記事です。 論文概要(Abstract) CacheBlendは、RAG(Retrieval-Augmented Generation)システムにおいて、事前計算済みのKVキャッシュを非プレフィックス位置でも再利用可能にする手法である。従来のprefix cachingでは、入力の先頭部分と一致するKVキャ...
08/03/2026 blog paper
LLM KV cache RAG +4
本記事はAIによって生成されています。 内容の正確性には十分注意していますが、最新の情報は公式ドキュメントをご確認ください。 ブログ概要 Model Context Protocol(MCP)は、Anthropicが2024年11月に発表したオープンプロトコルである。LLMアプリケーションと外部データソースやツールとの間に標準化された接続インターフェースを提供することを目的として...
08/03/2026 blog tech_blog
MCP Model Context Protocol Anthropic +4
本記事は arXiv:2504.03767 の解説記事です。 論文概要(Abstract) Model Context Protocol(MCP)はLLMエージェントが外部ツール・データソースと連携するためのインフラストラクチャとして広く採用されているが、その普及に伴い新たなセキュリティ課題が生じている。本論文では、LLMを自動監査者として活用し、MCPサーバー実装のセキュリティリスクを...
08/03/2026 blog paper
MCP security LLM +7
本記事は Anthropic: Donating the Model Context Protocol and establishing the Agentic AI Foundation の解説記事です。 ブログ概要(Summary) 2025年12月、AnthropicはModel Context Protocol(MCP)をLinux Foundation傘下の新組織「Agenti...
08/03/2026 blog tech_blog
MCP Anthropic Linux Foundation +7
論文概要 ToolSandboxは、Apple Researchが提案した大規模言語モデル(LLM)のツール利用能力を評価するための、ステートフル・対話型ベンチマークである。既存のベンチマークが単発のFunction Calling評価に留まるのに対し、ToolSandboxは状態を持つツール実行環境と対話型ユーザシミュレータを組み合わせ、マルチターンかつ状態依存のタスクに対するLLMの能...
08/03/2026 blog paper
LLM tool use function calling +5
本記事は Google Developers Blog: Announcing the Agent2Agent Protocol の解説記事です。 ブログ概要(Summary) 2025年4月、GoogleはAIエージェント間の相互運用性を実現するオープンプロトコル「Agent2Agent(A2A)」を発表した。50社以上のテクノロジーパートナー(Atlassian、Salesforce...
08/03/2026 blog tech_blog
A2A Google multi-agent +7
本記事は https://arxiv.org/abs/2312.05516 の解説記事です。本記事の著者自身が実験を行ったものではなく、論文の内容を解説・引用したものです。 論文概要(Abstract) Pensieveは、マルチターン会話におけるLLMサービングの効率を大幅に改善するシステムである。従来のステートレスなLLMサービングでは、会話のターンごとに過去の会話履歴を繰り返し再処...
08/03/2026 blog paper
LLM serving KV cache multi-turn conversation +4
本記事は LLM-Inference-Bench: Inference Benchmarking of Large Language Models on AI Accelerators(arXiv:2411.00136、2024年10月31日投稿)の解説記事です。 論文概要(Abstract) Chitty-Venkata et al.は、LLM推論の計算効率性を評価するための包括的なベ...
08/03/2026 blog paper
LLM inference benchmark +5
本記事は The Great Migration: Why Every AI Platform is Converging on Kubernetes(CNCF公式ブログ、2026年3月5日公開)の解説記事です。 ブログ概要(Summary) AmazonのSabari Sawant氏がCNCF公式ブログに寄稿したこの記事は、Kubernetesが単なるマイクロサービスオーケストレーター...
08/03/2026 blog tech_blog
CNCF Kubernetes LLM +7