交通行動予測にLLM適用、arXiv論文がエージェント手法提示
Narges Ahmadi氏らの研究チームは2026年8月20日(現地時間)、arXiv上で、交通行動モデリングと天候に敏感な需要予測にエージェント的アプローチを用いる研究論文を発表した。同研究は、会話型データ収集、構造化データ処理、行動予測を統合する「3エージェントワークフロー」を提案。テキストのみのゼロショット大規模言語モデル (LLM) が69.9%の5クラス精度を達成し、視覚ベースの構成では71.5%の精度に達した。
Tag
19 件の関連記事
Narges Ahmadi氏らの研究チームは2026年8月20日(現地時間)、arXiv上で、交通行動モデリングと天候に敏感な需要予測にエージェント的アプローチを用いる研究論文を発表した。同研究は、会話型データ収集、構造化データ処理、行動予測を統合する「3エージェントワークフロー」を提案。テキストのみのゼロショット大規模言語モデル (LLM) が69.9%の5クラス精度を達成し、視覚ベースの構成では71.5%の精度に達した。
日本経済新聞は2026年8月13日(現地時間)、日本政府が高性能の人工知能(AI)の急速な普及に対応するため、省庁横断で包括的な対策を講じる方針を固めたと報じた。この動きは、知的財産(知財)保護に関する情報開示ルールの策定、サイバー防御の強化に向けた法整備、諸外国との連携などを視野に入れている。政府はAIの利活用を促進しつつも、その悪用に対する備えを強化する狙いがあり、検討は「生成AI事業者の透明性確保」「重要インフラの防御」「関連法制度の点検」「国際ルール形成」の4本柱で進められる。
arXivが2026年7月30日(現地時間)付けで報じたところによると、AIアプリケーションに利用されるシステムプロンプトをユーザー視点で体系的に監査するフレームワーク「Artificial Intelligence System Prompt Assurance (AISPA)」(エイスパ)が発表された。本フレームワークは、AIシステムの広範な展開における信頼性と説明責任のギャップに対処することを目的としている。
arXiv cs.AIは7月30日(現地時間)、コンピュータ利用エージェント(CUA)の評価に用いられるビジョン言語モデル(VLM)の信頼性を体系的に評価する新しいベンチマーク「OSリワード (OSReward)」を発表した。この包括的な評価の結果、最先端のVLMでも理想的な評価者には及ばず、失敗した実行を成功と誤認する「寛大さバイアス」を持つことが指摘された。また、信頼性の高いVLMはコストが高く、手頃な価格のオープンモデルは性能が大幅に劣る現状も浮き彫りになった。
OpenAIとAnthropicは7月29日(現地時間)、人工知能(AI)開発が過度に加速した場合に備え、米国政府がその進展ペースを調整する方策を見出すよう求める書簡を支持すると発表した。数百人のAI企業従業員が署名したこの書簡を、主要なAI開発企業である両社が支持したことで、AI技術の潜在的リスクに対する業界内の慎重な見方が示された。
Moonshot AIは7月26日(現地時間)、主力AIモデル「Kimi K3」のウェイトを一般向けに公開する方針を示した。同社はこれにより、開発者が同モデルをダウンロード、調整、ホストすることを可能にし、利用者の裾野を広げる。創業者のヤン・ジーリン氏は、オープン性と可用性を重視することで、プロプライエタリシステムを提供する競合他社との差別化を図り、ユーザーベースの拡大を目指す考えだ。
Anthropic は2026年6月30日(現地時間)、科学研究者および製薬企業向けに最適化されたアプリケーション「Claude Science」の提供開始を発表しました。同社のダリオ・アモデイ (Dario Amodei) CEOは、生物学の複雑な課題に対し、人工知能 (AI) が強力なツールとなり得る可能性に言及。大規模言語モデル (LLM) を活用したこの新たな研究開発支援ツールが、科学研究のあり方に影響を与えるとみられます。
クアルコム (Qualcomm) は6月30日(現地時間)、人工知能(AI)モデルのチップ間実行を支援するソフトウェアスタートアップ、モジュラー (Modular) の買収を発表した。AIインフラへの投資が活発化する中、GVのマネージングパートナーであるデイブ・ムニチェロ (Dave Munichiello) 氏は、半導体スタートアップのサンバノバ (SambaNova) がGeneral Atlantic主導で8億ドルの資金調達を完了した動きと合わせ、AIソフトウェアの重要性を解説した。ムニチェロ氏は、モジュラーとサンバノバ双方に早期投資し、取締役を務めている。
cfr.orgが2026年6月9日(現地時間)付けで報じたところによると、ドナルド・トランプ大統領は6月5日、米国家安全保障機関に人工知能 (AI) 導入の加速を指示し、ジョー・バイデン大統領政権が課した特定の制限を撤回する国家安全保障大統領覚書11 (NSPM-11) に署名した。本覚書は、繰り返し政府による技術利用を制限するAI企業との契約終了や、国防総省への自律型兵器政策更新を要求。AI利用の責任は外部規制機関ではなく、軍の指揮系統内に位置付けられる。
ホワイトハウスは2026年6月5日(現地時間)、ドナルド・J・トランプ大統領が国家安全保障における人工知能 (AI) に関する国家安全保障大統領覚書に署名したと発表した。この覚書は、最新のセキュアで信頼性の高いAIシステムを米国の兵士や情報専門家に提供し、その責任ある利用を保証する新しい枠組みを確立する。
arXiv cs.AIは2026年6月2日(現地時間)、「Visual Graph Scaffolds for Structural Reasoning in Large Language Models」と題する論文を発表した。この研究は、大規模言語モデル (LLM) が複雑な構造化推論を行う際、グラフが単なる外部知識源としてだけでなく、推論プロセスを整理する内部的な足場 (スキャフォールド) としても機能する可能性を示唆している。人間がマインドマップを用いて思考を整理する仕組みから着想を得ており、LLMの推論能力向上に新たな視点を提供する。
Anthropicは2026年6月2日(現地時間)、同社の最先端AIモデル「Claude Mythos Preview」のアクセスを拡大したと発表した。同社は、このモデルが悪用された場合、既存のサイバーセキュリティ概念を破壊する可能性を秘めていると指摘。Project Glasswing構想を通じて、電力、水、医療、通信、ハードウェア産業など15カ国の150組織にモデルへのアクセスを提供し、これらの組織が多数の政府機関に依存されるコードベースを維持していることから、大規模なサイバー攻撃の標的となる可能性を懸念している。
Adam J. Thorpe氏らは2026年5月28日(現地時間)、科学論文プレプリントサービス「arXiv cs.AI」に掲載された論文で、身体化された人工知能(Embodied AI)のワールドモデルには物理的実現可能性が不可欠であると提言した。彼らは、既存の観測予測型ワールドモデルが、視覚的にはもっともらしいものの物理的に誤ったシミュレーション結果(ロールアウト)を生成する問題を指摘している。
arXiv cs.AIは2026年4月3日(現地時間)、研究論文で、大規模言語モデル(LLM)の自信と実際の正答率の間に乖離があることを明らかにした。この乖離はタスクの難易度によって変動し、LLMが平均的に自身を過信する傾向にある一方で、「hard-easy effect」と呼ばれる現象により、難しいタスクでは過信が強まり、簡単なタスクでは過小評価を示すと報告されている。モデルのキャリブレーション評価のため、新たなテスト「LifeEval」も開発された。
バチカンは2026年5月25日(現地時間)、ローマ教皇レオ14世による新回勅「Magnifica Humanitas of His Holiness Pope Leo XIV on Safeguarding the Human Person in the Time of Artificial Intelligence」を発表した。これは、人工知能(AI)が現代社会にもたらす倫理的課題に対し、教会の社会教義に基づいた包括的な指針を示すもの。レオ14世は、初の産業革命期に社会問題に取り組んだ先人レオ13世に敬意を表し、その教皇名を継承したと説明している。
arXiv cs.AI が2026年5月21日(現地時間)付けで報じたところによると、大規模言語モデル (LLM) ベースのマルチエージェントシステムにおける安全なキーバリュー (KV) キャッシュ共有のためのフレームワーク「LCGuard (Latent Communication Guard)」が発表された。LCGuardは、KVキャッシュを介した潜在的な情報漏洩を防ぎつつ、タスク関連情報の効率的な伝達を目指す。このフレームワークは、共有されるKVキャッシュを潜在的な作業記憶として扱い、キャッシュアーティファクトがエージェント間で転送される前に表現レベルの変換を適用する。
arXiv cs.AIは2026年5月11日(現地時間)、大規模言語モデル (LLM) の性能におけるデータの役割を根本的に理解するため、新しい手法「データプローブ」の開発を提唱するポジションペーパーを発表した。この手法は、適切に定義されたランダムプロセスから合成シーケンスを生成し、LLMの振る舞いを体系的に観察することで、データ特性がモデル性能、汎化、堅牢性 (robustness) に与える影響を解明することを目指す。
arxiv.orgは2025年5月15日(現地時間)、論文「Interpretable Risk Mitigation in LLM Agent Systems」を公開し、大規模言語モデル (LLM) を搭載した自律エージェントの行動における予測不可能性が安全上の懸念を引き起こす問題に対し、解釈可能なリスク軽減手法を提案したと発表した。研究では、スパースオートエンコーダから抽出された「善意交渉」特徴を用いてLLMエージェントの残差ストリームを誘導。これにより、反復囚人のジレンマ環境における平均裏切り確率を28パーセンテージポイント低下させた。この手法は複数のオープンソースLLMエージェントで有効な誘導範囲を特定している。
Alina Hyk氏とSandhya Saisubramanian氏らは2026年5月12日(現地時間)、大規模言語モデル(LLM)の人間指向意思決定を大幅に改善する新フレームワーク「CLIPR (Conversational Learning for Inferring Preferences and Reasoning)」を発表した。この研究は、LLMが潜在的なユーザーの好みを効率的に学習し、曖昧な状況下でも人間と一致する解を生成する能力を高めることを目指す。これにより、少ないデータとコストで高度なパーソナライゼーションが実現する。