AI Edgeline
最新まとめ【速報】公式VCベンダー論文音声規制About
キーワードを入力
    最新まとめ【速報】公式VCベンダー論文音声規制About
    キーワードを入力
      最新
      VC・資金調達 Natural、AIエージェント決済で3000万ドル調達 Stripeと競合へ VC・資金調達 MoonshotのAIモデル「Kimi K3」が注目集める リサーチ・論文 Moonshot AI、フロンティア級Kimi K3を発表 — オープンモデル競争激化 VC・資金調達 AIインフラのInfinity、1,500万ドルを調達 ベンダー・製品 Moonshot AI、「Kimi K3」新規登録を一時停止 需要集中で 中国AI競争の過熱を反映 VC・資金調達 AIモデルのコモディティ化と費用構造の変化 ベンダー・製品 Bristol Myers Squibb、NVIDIA Vera Rubinベースの先進AI工場を構築 ベンダー・製品 xAI、Grok 4.6の訓練来週完了へ 2兆パラメータ規模で性能とコスト両立目指す ベンダー・製品 Anthropic、Claude Fable 5アクセスを再編 リサーチ・論文 サム・アルトマン氏、GPT-3級モデル早期公開の意向—訴訟文書が示すOpenAI戦略 ベンダー・製品 Vercel Workflows、実行状態のリージョン指定機能を提供開始 リサーチ・論文 Apple、長尺動画要約向けの新ベンチマーク「LVSum」発表 ベンダー・製品 Vercel、Remote Cacheのビルド成果物一括削除機能を提供 リサーチ・論文 Apple ML Research、マルチビューTransformer向けポジショナルエンコーディング「RayRoPE」発表 ベンダー・製品 Together AIとY Combinator、YCコミュニティ専用GPUクラスターを稼働
      1 / 15

      Tag

      #PagedWeight

      1 件の関連記事

      リサーチ・論文 · 7月21日 00:27

      PagedWeight、MoE LLM推論のGPUメモリを最大72.0%削減

      arXiv cs.LGは7月17日(現地時間)、Mixture-of-Experts (MoE) 大規模言語モデル (LLM) の推論効率を大幅に改善する新手法「PagedWeight」を発表した。同技術は、MoE LLM運用における主要課題である、増大するモデルウェイトとKey-Value (KV) キャッシュのGPUメモリ要件に対し、ランタイムでの動的かつ品質を意識したウェイト量子化で対処する。これにより、エキスパートウェイトの精度を維持しつつKVキャッシュサイズを最適化し、全体的なリソース効率を大幅に改善。特に、既存手法と比較してGPUメモリを最大72.0%削減し、スループットを最大1.94倍向上させることが可能と報告されている。

      arXiv cs.LG 続きを読む →
      AI Edgeline

      シリコンバレーの超最前線の AI 情報を、毎日最速でアップデート。一次情報を、新聞記事スタイルで届けます。

      カテゴリ

      • 【速報】公式 24h 以内
      • メーカー公式発表
      • VC・資金調達
      • ベンダー・製品
      • リサーチ・論文
      • ポッドキャスト
      • 規制・政策

      編集について

      • 編集方針
      • RSS フィード
      • X (旧 Twitter)

      すべての記事に原文へのリンクと公開日時を併記しています。一次情報の信頼性を最優先に運営しています。

      © 2026 AI Edgeline