Hugging FaceがHF JobsでvLLMサーバー提供開始、単一コマンドで利用可能に
Hugging Faceは6月25日(現地時間)、同社のHugging Face Jobs上で、vLLMサーバーを単一コマンドで迅速に起動できる新機能を発表しました。この導入により、ユーザーはHugging Faceのインフラストラクチャを活用し、プライベートなOpenAI互換の**大規模言語モデル(LLM)**エンドポイントを効率的に展開・運用できるようになります。利用料金は秒単位の従量課金制です。
Tag
5 件の関連記事
Hugging Faceは6月25日(現地時間)、同社のHugging Face Jobs上で、vLLMサーバーを単一コマンドで迅速に起動できる新機能を発表しました。この導入により、ユーザーはHugging Faceのインフラストラクチャを活用し、プライベートなOpenAI互換の**大規模言語モデル(LLM)**エンドポイントを効率的に展開・運用できるようになります。利用料金は秒単位の従量課金制です。
Hugging Face Blogは2026年6月6日(現地時間)、第2回Build Small Hackathonのレポートとして、複数の研究機関の異なる小型モデルを統合した金融ドラマシミュレーション「Thousand Token Wood v2」のエンジニアリング詳細を報告した。このプロジェクトでは、OpenAI、OpenBMB、NVIDIA製の小型モデルや、ファインチューニングされたQwenモデルがエージェントとして組み込まれている。
Hugging Face Blogが2026年6月5日(現地時間)付けで報じたところによると、同社は30億パラメータモデル「Qwen2.5-3B」を用いたマルチエージェント経済シミュレーション「Thousand Token Wood」を開発した。これは、少数のAIエージェントがリアルタイムで取引を行う仮想経済システムであり、同社の「Build Small Hackathon」におけるフィールドレポートとして公開された。
Hugging Faceは2026年5月27日(現地時間)、ブログを通じて、ロボット「Reachy Mini」の会話アプリケーションを完全にローカルで実行できるようになったと発表した。これにより、オーディオデータが外部サーバーに送信されることなく、全ての処理がユーザーのデバイス上で完結する。クラウドサービスやAPIキーは不要となる。
Mistralは2026年5月18日(現地時間)、次世代のオープンマルチモーダル・多言語AIモデル「Mistral 3」ファミリーを発表した。このファミリーには、14B、8B、3Bの3種類の密なモデルと、これまでのモデルで最も高性能なスパース混合エキスパート(MoE)モデル「Mistral Large 3」が含まれる。Mistral Large 3は410億のアクティブパラメータと6750億の総パラメータで訓練されており、全モデルがApache 2.0ライセンスの下で公開される。