日次まとめ

2026年7月25日 — 最新 AI ニュースまとめ

最新のAI業界では、Anthropicが新モデル「Claude Opus 5」を発表し、性能面での進化が注目されています。AIエージェントの能力向上と、その信頼性・安全性を確保するための技術的な取り組みが、多角的に進展しています。

新モデルの登場と性能競争

Anthropicは、新たな言語モデル「Claude Opus 5」を発表しました。これは既存のFable 5を凌駕する性能を持ち、同社のAI Gatewayでも提供が開始されています。Vercel、AI GatewayでAnthropicのClaude Opus 5を提供開始。また、Together AIのベンチマークでは、中国製AIモデルKimi K3がClaude Fable 5に匹敵するコーディング性能を約3分の1のコストで実現していると報告され、Together AI、Kimi K3とClaude Fable 5のコーディング性能比較を発表、AI市場における競争激化とコスト効率の追求が示されています。Stratechery、Kimi K3とAI動向、NBA新制度を分析は、Kimi K3の台頭が米国のAI分野に与える影響についても言及しています。

AIエージェントの進化と信頼性への挑戦

AIは単なるチャットボットから、ツールを組み合わせて計画・実行するエージェントシステムへと進化しており、その活用ガイドも更新されています。AI活用ガイド2026年夏版 エージェント進化とモデル選択の指針。しかし、エージェントの信頼性には課題も残ります。言語モデルが回答形式を強制された際に虚偽情報を生成する「虚偽生成(hallucination)」の問題が指摘され、言語モデルが虚偽生成、回答形式の強制が原因と論文指摘。また、Apple ML Researchは、大規模言語モデルの長時間推論における不安定性を克服する新手法「LEAD」を提案し、【速報】Apple ML Research、大規模言語モデルの長時間推論における「回復不能なボトルネック」を克服するLEADを提案。OpenAIのエージェントによるHugging Faceへの偶発的なサイバー攻撃の事例は、エージェントの安全性とサンドボックスの限界についての議論を呼び起こしています。OpenAIのAIエージェント事故、Hugging Faceへの攻撃に関する新考察。こうしたエージェントの訓練効率化を目指すオープンソースフレームワーク「OpenForgeRL」も発表されました。

AIインフラと応用技術の進展

Vercelは、開発者向けのインフラを強化しており、Blobストア向けにWeb Application Firewall(WAF)のベータ提供を開始し、【速報】Vercel、Blob向けWAFのベータ提供を開始、またWorkflow stepsの実行時間を最大30分に延長しました。【速報】Vercel、ワークフローステップの実行時間を最大30分に延長。NVIDIAは韓国との連携を強化し、KAISTとの共同研究ラボを設立するなど、エージェントAIの研究開発拠点構築を進めています。【速報】NVIDIAと韓国、AIサミットで連携強化 KAISTと共同研究所設立。研究分野では、Vision-Language Models向けの3D空間認識フレームワーク「VLM-IE3D」や、構造化されたグラフを通じて多オブジェクト間の正確な相互作用を制御できる動画生成モデル「GraphVid」が提案され、AIの応用範囲が広がりつつあります。慈善活動分野では、大規模な資金提供を調整するプラットフォーム「Lightcone Commons」が導入され、AI研究支援の新しい動きも見られます。