リサーチ・論文

大規模言語モデル、情報不足時のベイズ事前分布活用メカニズムを解明

arXiv cs.LGは2026年9月1日(現地時間)、大規模言語モデル (LLMs) が情報不足時にトレーニングコーパスのユニグラム分布をベイズ事前分布として活用するメカニズムを解明する研究論文「The Geometry of Ignorance: LLMs Know When to Temper Bayesian Priors」を公開した。同論文は、その根底にあるunembedding geometryの存在と、この構造が複数のモデルファミリーに共通していることを指摘している。

ベンダー・製品

【速報】Meta、Llama Startup Program第1期コホートを発表

Metaは2026年8月10日(現地時間)、Llama Startup Programの第1期コホートを発表した。1,000件を超える応募の中から、ヘルスケア、マーケティング、金融、法律、ソフトウェア、スポーツなど多岐にわたる業界の初期段階のスタートアップが選出された。これらの企業は、Llamaを活用してイノベーションを推進する。

リサーチ・論文

Wikipedia編集、大規模言語モデルの挙動を形成:研究発表

arXiv cs.CLは4月29日(現地時間)、研究論文を提出し、Wikipediaでの小規模な編集活動が大規模言語モデル(LLM)の挙動に測定可能な影響を与えることを明らかにした。特に動物福祉に関する内容の編集が、LLMの特定のトピックに対する応答に影響を及ぼすという。この研究は、WikipediaがLLMの訓練データセットにおいて重要な役割を果たしていることを強調している。

リサーチ・論文

小型言語モデルCoT算術、数コピーの「読み出しショートカット」判明

arXiv cs.LGは2026年5月20日(現地時間)、Ming Liu氏が発表した論文「The Readout Shortcut: Positional Number Copying Dominates Arithmetic CoT Readout in Small Language Models」の内容を報じた。この論文は、小型言語モデルが思考連鎖 (CoT) プロンプティングを用いた算術演算を行う際、「読み出しショートカット」と呼ばれる特異な現象が性能に影響を与えることを指摘している。モデルが中間推論内容にかかわらず、回答区切り記号の前の末尾にある数値を最終的な答えとしてコピーする傾向が明らかになった。