ベンダー・製品

Together AI、ファインチューニングサービスを拡充 新モデル追加と価格改定

Together AIは9月10日(現地時間)、AIモデルのファインチューニングサービスを大幅に拡張したと発表した。今回のリリースでは、最新のオープンウェイトモデルへのサポートを拡大したほか、トレーニング過程をリアルタイムで監視できるライブ実験追跡機能、トレーニングおよびデータ処理におけるきめ細かな制御機能が導入された。また、一部モデルのトレーニング価格引き下げも実施され、利用者の費用負担軽減を図る。

リサーチ・論文

MoEモデル、データ繰り返しで過学習増加 研究論文が指摘

arXiv cs.LGが2026年9月10日(現地時間)付けで公開した論文が、Mixture-of-Experts (MoE) モデルが学習データの繰り返しに対して、高密度活性化Transformerモデルよりも過学習しやすいことを指摘した。人間が作成したテキストデータの供給が枯渇する中、言語モデルの学習データ繰り返しは一般的な手法となっている。この研究は、MoEの性能劣化がデータの繰り返し率に大きく依存し、その影響がスパース性と共に増加することを示している。

ベンダー・製品

Vercel、医療特化LLM「Ling 3.0 Flash Sante」をAI Gatewayで提供

Vercelは2026年9月4日(現地時間)、inclusionAIが開発した健康・医療分野に特化した大規模言語モデル「Ling 3.0 Flash Sante」を同社のAI Gatewayを通じて提供開始しました。このモデルはMixture-of-Experts(MoE)アーキテクチャを採用し、1240億の総パラメータと256Kトークンのコンテキストウィンドウを特徴とします。提供開始から2026年10月4日までは無料で利用可能です。

ベンダー・製品

Vercel、AI GatewayにTencentのLLM「Hy4 Preview」を統合

Vercelは8月27日(現地時間)、自社のAI Gatewayにおいて、Tencentが開発したオープンソースの大規模言語モデル(LLM)「Hy4 Preview」が利用可能になったことを発表した。Hy4 Previewは、合計770Bのパラメーターとトークンあたり49Bのアクティブパラメーターを持つMixture-of-Expertsモデルであり、1Mトークンのコンテキストウィンドウに対応。これにより、AI Gatewayのユーザーは、同モデルの高度な推論機能を活用し、多様な開発ニーズに対応できるようになる。

リサーチ・論文

MoEモデル量子化ダメージ、経路フリップの検出と修復課題を提示

パーヴェル・グー (Parvel Gu) は7月14日(現地時間)、arXiv cs.AIで論文を公開し、Mixture-of-Experts (MoE) ルーティングの不連続性が、4ビットKVキャッシュの量子化によって引き起こされる「フリップ」現象を明らかにした。このフリップはトークンを決定境界を越えさせ、エキスパートの活性化を反転させる。本研究は新たな緩和策を提案するものではなく、因果関係の解明、経験的発見、および検出限界に関する結果を提供している。

ベンダー・製品

Vercel、AI GatewayでPoolside「Laguna S 2.1」提供開始

Vercelは2026年7月21日(現地時間)、AI GatewayにおいてPoolsideの「Laguna S 2.1」モデルの提供を開始しました。このモデルはオープンウェイトのMixture-of-Expertsモデルで、最大1Mトークンのコンテキストウィンドウに対応します。エージェント型コーディングや長時間実行タスクに特化しており、思考モードと非思考モードの2つのバージョンが利用可能です。

ベンダー・製品

Tencent、2950億パラメータの「Hy3」をApache 2.0で公開 MoE採用、利用制限撤廃へ

Tencentは7月6日(現地時間)、オープンウェイト言語モデル「Hy3」に関する詳細を公表した。Hy3は2950億パラメータを持つ大規模モデルでありながら、Mixture-of-Experts(MoE)アーキテクチャの採用により、任意のトークン処理にアクティブに稼働するパラメータを約210億に抑えている。地理的および利用制限のないApache 2.0ライセンスでの提供は、オープンモデル市場に新たな選択肢をもたらすと見られる。

リサーチ・論文

Tencent、2950億パラメータのMoEモデル「Hy3」をApache 2.0で公開

Tencentは7月6日(現地時間)、Apache 2.0ライセンスに基づく大規模言語モデル「Hy3」を公開した。Simon Willison's Weblogが報じた。Hy3は、総パラメータ数2950億を誇るMixture-of-Experts(MoE)モデルで、アクティブパラメータ210億、MTPレイヤーパラメータ38億を持つ。Tencent Hy Teamが開発したこのモデルは、同規模の既存モデルを凌駕し、パラメータ数で2〜5倍の主要なオープンソースモデルに匹敵する性能を持つとTencentは説明している。

ベンダー・製品

Moonshot AI、Kimi K2.7-Codeに高速モード追加も独立ベンチマーク未提出

Moonshot AIは2026年6月15日(現地時間)、Kimi K2.7-CodeのHighSpeed Modeの提供を開始したと発表した。同社はこれにより、中央値長コーディング入力で約180トークン/秒、短コンテキストタスクで最大260トークン/秒のスループットを実現し、標準版と比較して約6倍高速だと主張している。しかし、同社はモデルを独立したコーディングベンチマークに提出しておらず、開発者はベンダーが報告した数値のみを判断基準としている。

リサーチ・論文

Mellum 2技術レポート公開、MoE言語モデルでソフトウェア開発に特化

オープンウェイトのMellum 2 (メラム2)は5月29日(現地時間)、その言語モデルに関する技術レポートを公開した。このモデルは120億パラメータのMixture-of-Experts (MoE)モデルであり、トークンあたり25億のアクティブパラメータを持つ。Mellum 2はソフトウェアエンジニアリングに特化した汎用言語モデルとして設計され、コード生成・編集、デバッグ、多段階推論、ツール利用と関数呼び出し、エージェントコーディング、対話型プログラミング支援といった幅広い領域をカバーする。

リサーチ・論文

マルチフィジックス基盤モデル、負の転移学習を克服:疎エキスパートで解決

Ellwil Sharma氏とArastu Sharma氏は5月14日(太平洋時間)、マルチフィジックス基盤モデルにおける「ネガティブトランスファー」(互換性のない知識が学習を妨害する問題)を克服する新手法を発表した。これは「Shodh-MoE」と名付けられた潜在トランスフォーマーアーキテクチャを導入し、疎な混合エキスパートルーティングを用いる。異なる偏微分方程式(PDE)レジームの同時学習で生じる勾配衝突や不安定な最適化を抑制し、スケーラブルな科学機械学習(SciML)の実現を目指す。

リサーチ・論文

MoE向け新アーキテクチャ「UniPool」、グローバル共有エキスパートプール導入

arXiv cs.LGは2026年5月7日(現地時間)、Minbin Huang氏らがMixture-of-Experts (MoE) アーキテクチャの新しい設計「UniPool」を提案したと報じた。UniPoolは、従来層ごとに独立していたエキスパートセットをグローバルな共有プールとして扱い、各層のルーターからアクセスさせる構造を持つ。この設計変更により、LLaMAアーキテクチャの多様なモデルスケールにおいて、既存のMoEと比較して検証損失とパープレキシティの改善が確認された。

リサーチ・論文

EMOがモジュール性高いMoE実現 大規模モデルの選択的専門家利用に道

論文公開サイトarXiv cs.CLが2026年5月7日(現地時間)付けで報じたところによると、大規模言語モデル (Large language models) のモジュール性を高める新しいMixture-of-Experts (MoE) モデル「EMO」が発表された。EMOは、事前学習中に文書の境界のみを用いて、人間の定義する事前知識なしで首尾一貫した専門家グループを形成する。これにより、メモリ制約のある環境での大規模疎モデルの実用性が向上する可能性が示されている。