GitHub、Copilotに複数AIモデルを自動連携する「Project HydraFusion」―コスト67%削減しつつ最先端品質を実現 | GameBusiness.jp

GitHub、Copilotに複数AIモデルを自動連携する「Project HydraFusion」―コスト67%削減しつつ最先端品質を実現

GitHubは、GitHub Copilot向けに複数AIモデルを自動連携する「Project HydraFusion」をリサーチプレビューとして発表しました。

ゲーム開発 人工知能(AI)
GitHub、Copilotに複数AIモデルを自動連携する「Project HydraFusion」―コスト67%削減しつつ最先端品質を実現
  • GitHub、Copilotに複数AIモデルを自動連携する「Project HydraFusion」―コスト67%削減しつつ最先端品質を実現

GitHubは9月4日(米国時間)、GitHub Copilot向けに複数のAIモデルをタスクに応じて組み合わせる「Project HydraFusion」をリサーチプレビューとして発表しました。

GitHubが提供する「Auto」がタスクに適したAIモデルを選択するのに対し、HydraFusionは複数モデルを組み合わせた実行方法まで自動で構成します。

3つの実行パターンで品質・コスト・速度を最適化

HydraFusionは、複数プロバイダーのモデルの中から適切なものを選び、タスク全体の実行プランをバックグラウンドで自動構成します。開発者は通常のモデルを選ぶのと同じ操作でHydraFusionを選択するだけでよく、以下の3つのパターンを状況に応じて使い分けます。

  • Single:選択された1つのモデルがタスクを直接処理

  • Cascade:効率的なモデルが最初に回答を作成し、品質基準を満たさない場合はより高性能なモデルへ処理を引き継ぎ

  • Critique:1つのモデルが下書きを作成し、別のモデルが独立してレビューした後、最初のモデルが内容を修正

この仕組みにより、単純なタスクは低コストのモデルで素早く処理し、複雑なタスクには高性能モデルを投入するという使い分けがシームレスに実現されます。

ベンチマークではコストを抑えつつOpus 5に迫る結果

3種類のエージェント型コーディング・ベンチマークを用いたオフライン評価では、HydraFusionはいずれもOpus 5より推定コストを抑えました。品質はTerminalBench 2.1で上回った一方、DeepSWEでは1.5ポイント、CheckpointBenchでは0.1ポイント下回っています。

とりわけTerminalBench 2.1では、「Claude Opus 5」と比較して推定コストを67%削減しながら、検証済みタスク品質スコアを4.9ポイント上回る結果を記録しています。GitHubはこの評価結果について、特定のベンチマーク条件・ワークフロー構成・モデルプール・価格前提のもとでの制御された評価であることを明示しており、リサーチプレビューを通じて実際の開発ワークロードへの適用を検証していく方針です。

Autoモードの普及を背景に複数モデルの連携へ

GitHubはこれまで、タスクに応じて適したAIモデルを自動で選択する「Auto」を展開してきました。2026年にはタスク内容に応じたモデル選択への対応を進め、GitHub.comやモバイル、Copilot CLIなどにも提供範囲を拡大しています。

HydraFusionではさらに、単一モデルの選択にとどまらず、複数モデルを組み合わせた実行方法まで自動で構成する形まで踏み込んでいます。現時点では、すべてのCopilotプランで利用でき、Copilot CLIの実験機能から有効化が可能となっています。

《GameBusiness.jp》

この記事の感想は?

  • いいね
  • 大好き
  • 驚いた
  • つまらない
  • かなしい

関連ニュース

特集

人気ニュースランキングや特集をお届け…メルマガ会員はこちら