Apple ML Research、LLM推論効率化の新手法「ARBITRAGE」を発表
Apple ML Researchは2026年8月6日(現地時間)、大規模言語モデル (Large Language Models) の推論効率を向上させる新たな投機的生成フレームワーク「ARBITRAGE」を発表した。同研究は、従来の推論高速化手法である投機的デコーディング (Speculative Decoding) が抱える課題に対処し、特に推論タスクでの性能と計算コストの比率を改善する。
Tag
1 件の関連記事