GitHub、「Project HydraFusion」の研究プレビューを導入
GitHubは2026年9月(現地時間)、複数のモデルを連携させる「マルチモデルオーケストレーション」を通じて性能を向上させる「Project HydraFusion」の研究プレビューをGitHub Copilot向けに導入したと発表した。このプロジェクトは、ローカル、クラウド、複合モデル間の連携戦略において重要な役割を担う。
Tag
3 件の関連記事
GitHubは2026年9月(現地時間)、複数のモデルを連携させる「マルチモデルオーケストレーション」を通じて性能を向上させる「Project HydraFusion」の研究プレビューをGitHub Copilot向けに導入したと発表した。このプロジェクトは、ローカル、クラウド、複合モデル間の連携戦略において重要な役割を担う。
BenchLM.aiは2026年8月1日(現地時間)、ソフトウェアエンジニアリングタスクの評価ベンチマーク「SWE-bench Pro」の最新結果を公開した。AnthropicのClaude Mythos 5が80.3%のスコアでリーダーボードの首位を獲得し、Claude Fable 5が80%、Claude Opus 5が79.2%で続いた。計55モデルが評価対象となった。
Anthropicは2026年7月23日(現地時間)、生成AIモデル「Claude Opus 5」を発表した。同モデルは、同社の「Artificial Analysis Intelligence Index」において新たなリーダーとなり、独自のエージェント知識業務ベンチマーク「AA-Briefcase」でも首位を獲得した。最大努力設定でのAA-Briefcase Eloスコアは1720を記録し、これまでのリーダーだったClaude Fable 5を146ポイント上回った。また、タスクあたりのコストをClaude Fable 5から20%削減している。