Home
0h-n0 TechBLog
キャンセル

✍️ AWS解説: ヘルスケア領域におけるHuman-in-the-Loopエージェントワークフローの4実装パターン

ブログ概要 AWSのSenior AI/ML Solutions ArchitectであるPierre de Malliard氏が2026年4月8日に公開した本ブログでは、ヘルスケア・ライフサイエンス領域のAIエージェントシステムにおいて、人間の承認を組み込む4つの実装パターンが解説されている。GxP規制、患者安全、PHI(Protected Health Information)保護、監...

📄 論文解説: Agent Workflow Memory — 再利用可能ワークフロー誘導によるLLMエージェントの長期タスク解決

論文概要 Agent Workflow Memory (AWM) は、LLMベースのエージェントが過去の経験から再利用可能なタスクワークフロー(ルーティン)を誘導し、後続タスクの解決を導く手法である。著者らは、人間が日常的に行う「過去の経験から手順を学び、将来の行動に活かす」というプロセスをエージェントに実装した。AWMはオフライン(事前の訓練データから学習)とオンライン(テスト時にストリ...

✍️ AWS解説: LangGraph×Amazon DynamoDBによる耐久性AIエージェントの構築

ブログ概要(Summary) AWS公式データベースブログにて、Lee Hannigan氏(Sr. DynamoDB Database Engineer)が2026年1月13日に公開した記事である。LangGraphのチェックポイント機構をAmazon DynamoDBで永続化するための公式パッケージ langgraph-checkpoint-aws の設計思想と実装パターンを解説している...

📄 論文解説: ALAS — ステートフルマルチLLMエージェントフレームワークによる障害認識型プランニング

論文概要(Abstract) ALASは、LLMベースのエージェントが抱える4つの根本的欠陥――自己検証の不在、コンテキスト侵食、次トークン近視、永続状態の欠如――に体系的に対処するマルチエージェントフレームワークである。各プランをロール特化エージェントに分解し、バージョン管理された実行ログによる自動状態追跡を装備し、軽量プロトコルで調整する。障害発生時にはグローバル再計画を回避し、局所補...

✍️ ブログ解説: Right-size your PTU deployment and save big — Azure OpenAI PTUの適正サイジングとコスト最適化

本記事は Right-size your PTU deployment and save big の解説記事です。 ブログ概要 Azure OpenAI ServiceのProvisioned Throughput Units(PTU)は、専用のモデル処理容量を確保する予約型デプロイメントである。公式ブログでは、PTUのコストが高く見える主因は「ピーク負荷に合わせて全容量をPTUで確保し...

📄 論文解説: AI推論サービスの信頼性向上 — 本番障害156件の実証分析

本記事は Enhancing reliability in AI inference services: An empirical study on real production incidents の解説記事です。 論文概要 本論文は、大規模LLM推論サービスで発生した156件の高重大度インシデント(2025年4月〜6月)を体系的に分類・分析した実証研究である。著者らは4カテゴリから...

📄 論文解説: SageServe — 予測型オートスケーリングによるLLMサービング最適化

本記事は SageServe論文 の解説記事です。なお、本記事は論文の内容を解説するものであり、筆者が独自に実験を行ったものではありません。 論文概要 SageServeは、Microsoft Office 365における1日あたり1,000万件のLLM推論リクエストの分析に基づき設計された、クラウドデータセンター向けLLMサービングフレームワークである。短期的なリクエストルーティングと...

📄 論文解説: Intelligent Router for LLM Workloads — ワークロード特性を考慮したLLM推論の負荷分散

本記事は Intelligent Router for LLM Workloads: Improving Performance Through Workload-Aware Load Balancing の解説記事です。LLM推論における負荷分散の課題を、ワークロード特性を考慮した強化学習ベースのルーティングで解決するアプローチを詳しく解説します。 論文概要 大規模言語モデル(LLM)...