【速報】Mistral、ポリシー適応型安全分類器「Shieldstral」を公開
Mistralは2026年8月3日(現地時間)、オープンウェイトのマルチモーダル安全分類器「Shieldstral」を発表した。この3Bモデルは、コンテンツモデレーションをポリシー適応型の質問応答タスクとして扱うことで、最大7倍の規模のモデルを上回る性能を発揮する。従来のガードレールモデルとは異なり、再トレーニングなしで推論時に平易な言語のポリシーを受け入れ、テキストと画像の安全評価を統合する。
Tag
2 件の関連記事
Mistralは2026年8月3日(現地時間)、オープンウェイトのマルチモーダル安全分類器「Shieldstral」を発表した。この3Bモデルは、コンテンツモデレーションをポリシー適応型の質問応答タスクとして扱うことで、最大7倍の規模のモデルを上回る性能を発揮する。従来のガードレールモデルとは異なり、再トレーニングなしで推論時に平易な言語のポリシーを受け入れ、テキストと画像の安全評価を統合する。
arXiv cs.CLが2026年7月28日(現地時間)に公開した論文「Shieldstral」は、30億パラメータのポリシー適応型マルチモーダル安全分類器を導入しました。このモデルは、テキスト安全ベンチマークにおいて約7倍のサイズを持つ既存モデルと同等かそれ以上の性能を発揮し、マルチモーダル安全分類において新たな最高水準(State of the Art)を樹立したとされています。