Together AIは2026年10月5日(現地時間)、IBMおよびNVIDIAと協力し、企業向けのAI推論能力を拡張すると発表した。IBM Cloud上にNVIDIA B300 GPUの専用大規模推論クラスタを構築し、NVIDIA Spectrum-X Ethernet networkingと組み合わせることで、オープンモデルの生産規模での運用を可能にする。Together AIがこのクラスタの最初の顧客となる。
今回の協力体制において、Together AIは推論レイヤーの運用を担い、IBMはクラウドインフラを提供、NVIDIAはB300 GPUとSpectrum-X Ethernet networkingを含むシリコンおよびネットワーキング技術を提供する。この専用クラスタは、IBM Cloud上で初めての大規模推論に特化したインフラストラクチャとなる。
Together AIは、企業やAIネイティブ企業がオープンモデルを選択する理由として、データ主権の保持と、閉鎖型モデルの数分の一のコストでフロンティアレベルの性能を提供できる点を挙げている。同社は月間数百兆トークンを百万以上の開発者に提供しており、トークン需要の急増に対応するため、将来を見据えた計画の一環として今回の提携を進める。
この協力関係により、企業は信頼性、セキュリティ、およびガードレールを備えたエンタープライズグレードの推論を大規模に利用できるようになる。Together AIは、オープンソースAIが閉鎖型モデルと同様に、あらゆる場所で大規模に、高速かつ信頼性高く動作する必要があるとの見解を示している。
参考: Together AI Blog — 2026年10月6日 09:00 (JST)
原文ハイライト"enterprise-grade inference at massive scale"