機密GPU推論、NVIDIA H100とIntel TDXの性能を評価
Wei Wang氏らは5月20日(現地時間)、arXiv cs.AIにて、NVIDIA H100 GPUとIntel TDXを利用した機密コンピューティング環境におけるAI推論性能に関するベンチマーク研究を発表した。この研究では、Mistral-7B v0.1およびQwen3-30B-A3Bの2つの大規模言語モデルを使用し、標準的な非機密実行と比較した性能コストを評価している。
Tag
2 件の関連記事
Wei Wang氏らは5月20日(現地時間)、arXiv cs.AIにて、NVIDIA H100 GPUとIntel TDXを利用した機密コンピューティング環境におけるAI推論性能に関するベンチマーク研究を発表した。この研究では、Mistral-7B v0.1およびQwen3-30B-A3Bの2つの大規模言語モデルを使用し、標準的な非機密実行と比較した性能コストを評価している。
Yijun Lu氏らの研究チームは2026年5月6日(現地時間)、長期にわたる探索エージェント向けに、新しい文脈オーケストレーション手法「コンテキスト・リアクト(Context-ReAct)」と、それに基づくエージェント「ロングシーカー(LongSeeker)」を発表した。この手法は、エージェントが推論、ツール使用、情報観察を行う際に、急速に増加する作業文脈を適応的に管理することを目的としている。計算コストの増加や誤情報生成のリスクを低減し、探索エージェントの効率と信頼性向上を目指す。