テキスト-画像生成の安全性限界を幾何学分析、新手法CALMを提案
arXiv cs.AI は2026年10月4日(現地時間)、テキスト-画像生成システムにおける安全性確保の課題に関する研究論文を発表した。NaHyeon Park氏らが執筆したこの論文は、既存の「グローバルな安全性」に基づく防御策が抱える限界を幾何学的分析で明らかにし、新しい手法「CALM (Counterfactual Adaptive Local Modulation)」を提案。不適切なコンテンツの抑制と、良性プロンプトの有用性保持を両立させる狙いがある。