Home
0h-n0 TechBLog
キャンセル

✍️ OpenAI公式ブログ解説: GPT-5.5 — 完全再学習ベースモデルのアーキテクチャと性能分析

OpenAI公式ブログ解説: GPT-5.5 — 完全再学習ベースモデルのアーキテクチャと性能分析 ブログ概要 本記事は OpenAI公式ブログ: Introducing GPT-5.5 の解説記事です。 2026年4月23日、OpenAIはGPT-5.5を発表した。GPT-5.5はGPT-4.5以来初となる完全再学習(full retrain)ベースモデルであり、GPT-5.0〜5....

📄 論文解説: Multi-Agent Systems — From Classical Paradigms to Large Foundation Model-Enabled Futures

本記事は arXiv:2604.18133 の解説記事です。 論文概要(Abstract) Wang et al.(2026)は、マルチエージェントシステム(MAS)を古典的パラダイムからLLM(大規模言語モデル)駆動のパラダイムまで包括的にサーベイした論文である。古典的MASの閉ループ協調フレームワーク(知覚・通信・意思決定・制御の4次元)と、LLMベースMASの5コアモジュール(役割...

📄 論文解説: Externalization in LLM Agents — Memory・Skills・Protocols・Harnessの統一的分類体系

本記事は Externalization in LLM Agents (arXiv:2604.08224) の解説記事です。 論文概要(Abstract) Zhou et al.(2026)は、LLMエージェントの能力拡張を外部化(Externalization)という統一的概念で整理したサーベイ論文を発表した。著者らは150本以上の先行研究を横断的にレビューし、外部化をMemory(記...

📄 論文解説: Recursive Language Models — REPL環境による再帰的推論でコンテキストウィンドウの100倍超を処理

論文概要(Abstract) 本記事は Recursive Language Models (arXiv:2512.24601) の解説記事です。 Recursive Language Models(RLM)は、LLMのコンテキストウィンドウを超える入力をプログラム的に分解・再帰処理する推論フレームワークである。著者らは、入力をREPL(Read-Eval-Print Loop)環境の変...

📄 論文解説: CustomerServiceBench — カスタマーサービス対話におけるLLM評価ベンチマーク

本記事は arXiv:2504.10139 の解説記事です。 論文概要(Abstract) CustomerServiceBenchは、カスタマーサービス対話におけるLLMの能力を包括的に評価するベンチマークである。著者らは、実際のカスタマーサービスログから構築した1,000件以上のマルチターン対話セッションに対して、タスク完了(TC)・応答品質(RQ)・ツール使用正確性(TUA)・ポリ...