リサーチ・論文

AIレッドチーム評価の限界と証拠的価値を形式化

arxiv.orgは2026年7月23日(現地時間)、「What AI Red-Team Evaluations Can and Cannot Prove」と題する論文を発表した。同論文は、AIモデルのレッドチーム評価が証明できる範囲とできない範囲を厳密に定義し、評価の「証拠的上限 (evidential ceiling)」を計算可能な形式で導出した。バンダナ・カウル (Bandana Kaur) 氏が執筆した本稿は、特定のハーム率を下回る稀なリスクカテゴリーにおいて、現行のパッシブベンチマークが十分な安全性の証拠を提供できない可能性を指摘している。

リサーチ・論文

PyroDash、SLMとLLMの協調推論でコスト削減と高精度を両立

arXiv cs.CLが2026年7月22日(現地時間)付けで報じたところによると、大規模言語モデル (LLM) と小規模言語モデル (SLM) の協調推論フレームワーク「PyroDash」が発表された。このフレームワークは、LLMの持つ高い推論能力とSLMの低コストという利点を組み合わせることで、推論コストを削減しつつ精度を維持、または向上させることを目的としている。PyroDashはトークンレベルでのSLM-LLM連携を通じて、SLMがアシスタンスを要求するかを判断し、Collaborate Engineを介してLLMに処理をオフロードする仕組みを持つ。

リサーチ・論文

LLM戦略推論の新評価ベンチマーク「Cattle Trade」が登場

arxiv.orgは5月14日(現地時間)、ロバート・ミュラー氏とクレメンス・ミュラー氏らが、大規模言語モデル (LLM) の戦略的推論能力を評価する新たな多エージェントベンチマーク「Cattle Trade」を導入する論文を公開した。この革新的なベンチマークは、不完全情報、敵対的相互作用、およびリソース制約下でエージェントとしてのLLMが、複雑な経済ゲームにおいて多様なスキルを統合的に展開できるかを測ることを目的としている。