論文「TomasuLLM」は2026年9月21日(現地時間)、プレプリントサーバーarXiv(分類cs.CL)に投稿された。大規模言語モデル(LLM)エージェントの応答時間を左右する長時間実行ツールの待ち時間問題に対処するランタイムとして提案され、コンパイラやテストスイートなどのツール呼び出しでエージェントが待機状態に陥る課題に対し、手順外の投機的実行という手法を導入した。

TomasuLLMは、従来のプロセッサが採用するアウトオブオーダー実行と同様の発想に基づく。コンパイラやテストスイートの実行など、長時間を要するツール呼び出しは、逐次的なインターフェースの下では予測可能で早期着手が可能な処理であってもエージェントを待機状態に陥らせていた。TomasuLLMはこの課題に対応するため、将来実行される可能性のあるアクションを事前に下書きとして準備し、隔離されたコピーオンライトのサンドボックス内で投機的に実行する仕組みを採用した。

実行したアクションの依存関係と影響範囲は継続的に追跡される。コミット対象となる状態への検証が完了した場合に限り、結果は元のタスク実行順序に沿ってコミットされる。この手順により、タスクの正確性を保ったまま、ツール呼び出しを手順外で先行実行できるとしている。

性能評価では、サブ秒から数分単位まで幅のあるツール呼び出しを含む複数のベンチマークで効果を確認したという。SWE-bench Verifiedの100タスクでは1.31倍、Terminal-Bench 2.0の28タスクでは1.35倍、SWE-Marathonの18セッションでは1.27倍の進捗速度を記録した。4,010件に及ぶ監査済みコミット検証の記録では、誤った承認(false accepts)は確認されなかったとしている。

TomasuLLMが示した結果は、ソフトウェア開発タスクやデータ分析など、ツール呼び出しの待ち時間が応答性のボトルネックとなる場面で、エージェントの実行効率を高める可能性があるとみられる。

論文はarXivのカテゴリ「cs.CL」に分類されており、原題は「TomasuLLM: Out-of-Order Speculative Execution for LLM Agents」。原文はarXiv(https://arxiv.org/abs/2609.38201)で公開されている。


参考: arXiv cs.CL (アーカイブ) — 2026年10月1日 13:00 (JST)

この記事をシェア
X はてブ LinkedIn