Together AI、オープンモデル向け予約型推論サービス「プロビジョンド・スループット」提供開始
Together AIは7月8日(現地時間)、フロンティアオープンモデル向けの予約型推論容量サービス「プロビジョンド・スループット (Provisioned Throughput)」の提供を開始した。本サービスは、トークンベースの料金体系と99%の稼働時間サービス品質保証契約 (SLA) を提供し、企業が予測可能で信頼性の高い推論能力を利用できるよう設計されている。
Tag
8 件の関連記事
Together AIは7月8日(現地時間)、フロンティアオープンモデル向けの予約型推論容量サービス「プロビジョンド・スループット (Provisioned Throughput)」の提供を開始した。本サービスは、トークンベースの料金体系と99%の稼働時間サービス品質保証契約 (SLA) を提供し、企業が予測可能で信頼性の高い推論能力を利用できるよう設計されている。
tech-insider.orgは7月5日(現地時間)、Z.ai(ジー・エーアイ)が開発した大規模言語モデル「GLM-5.2」が、最新ベンチマーク結果でSWE-bench Proのオープンウェイト部門において62.1%のスコアを記録し、首位に立ったと報じた。GLM-5.2はArtificial Analysis Intelligence Indexでもオープンモデルで1位、総合で4位に位置している。一方、DeepSeek V4-ProはSWE-bench Verifiedで80.6%を達成し、Gemini 3.1 Proと同率首位となった。
Don't Worry About the Vase (Zvi) は6月29日(現地時間)、ウォールストリート・ジャーナル (Wall Street Journal) 紙が中国のAIがAnthropic のAIモデルに匹敵するサイバーセキュリティー能力を獲得したと報じた記事に対し、ズヴィ・モウショウィッツ (Zvi Mowshowitz) 氏が「明白な誤報」であると批判したと伝えた。同氏は、この記事が誤解を招く内容であり、既存の誤った認識を助長する恐れがあると指摘している。
openrouter.aiは2026年6月26日(現地時間)、オープンウェイトモデルに関する分析レポートを公開した。同レポートによると、DeepSeek V4 Flash、GLM 5.2、MiniMax M3といったモデルがコーディング関連の性能指標で注目を集めている。オープンウェイトモデルの性能は、米国の主要なAI研究機関のモデルに追随しており、過去18カ月以上にわたり3〜6ヶ月の差を維持していると指摘した。
Zhipu AI(チープーAI)は6月17日(現地時間)、同社の言語モデル「GLM-5.2」が「Artificial Analysis Intelligence Index v4.1(アーティフィシャル・アナリシス・インテリジェンス・インデックス v4.1)」でオープンウェイトモデルのトップに立ったと発表した。GLM-5.2は同指標で51点を獲得し、競合のMiniMax-M3(ミニマックス-M3)やDeepSeek V4 Pro max(ディープシーク V4 プロマックス)の44点を上回った。プロプライエタリモデルが優位なベンチマークにおいて、自由利用可能なウェイトを持つ同モデルの成果が注目される。
GLM-5.2は6月16日(現地時間)、機械学習モデルの共有プラットフォームHugging Faceに公開された。この大規模言語モデルは、Mixture-of-Experts(MoE)アーキテクチャを採用し、MIT Licenseの下で提供される。特定のオープンモデル評価指標において、最先端の性能を達成したとされている。
Zhipu AIは2026年6月13日(現地時間)、最新のオープンソースモデル「GLM-5.2」を発表した。同モデルは1Mコンテキストウィンドウを搭載し、長期にわたる複雑なタスクで高い性能を発揮する。「徹底した開放性」を重視する方針を示しており、AI技術の民主化への貢献を目指す。現在、GLM Coding Planのユーザーが利用可能であり、APIは来週公開される予定である。
Zhipu AIは6月13日(現地時間)、大規模言語モデル「GLM 5.2」を、コーディング向けサービス「GLM Coding Plan」の全4ティア(Lite、Pro、Max、Team)に展開したと発表した。新モデルは1Mトークンのコンテキストウィンドウに対応する。次週にはAPI版とMITオープンウェイト版の公開も予定されており、開発者コミュニティへの浸透を目指す戦略的な動きと見られる。