GitHub çoklu model orkestrasyonu sunan Project HydraFusion'ı duyurdu
Öne çıkanlar
- HydraFusion, tek model, kademeli geçiş ve eleştiri odaklı üç farklı yürütme modelini otomatik olarak yönetiyor.
- TerminalBench 2.1 testlerinde Claude Opus 5'e kıyasla doğrulanan görev kalitesi 4,9 puan artarken maliyet yüzde 67 azaldı.
- Sistem, gerçek geliştirici oturumlarından türetilen CheckpointBench üzerinde Claude Opus 5 seviyesini yüzde 65 daha ucuza yakaladı.
GitHub, yazılım geliştirme görevlerinde birden fazla yapay zeka modelini dinamik olarak koordine eden Project HydraFusion adlı yeni sistemini araştırma önizlemesi olarak sundu. Sistem, GitHub Copilot kullanıcılarının tek bir model seçmek yerine iş akışını arka planda otomatik olarak planlamasına imkan veriyor. Geliştiriciler tek bir model arayüzü üzerinden işlem yaparken, arka plandaki yönlendirme katmanı görevin zorluğuna göre en uygun modeli belirliyor.
HydraFusion çalışma prensibi gereği görevleri üç farklı yürütme modeli üzerinden işliyor: doğrudan tek model kullanımı, yetersiz kalan yanıtları daha güçlü bir modele aktaran kademeli yapı ve yanıtı bağımsız bir gözden geçirmeye tabi tutan eleştiri süreci. Şirketin paylaştığı kıyaslama sonuçlarına göre sistem, TerminalBench 2.1 testinde Claude Opus 5 modeline kıyasla doğrulanan görev kalitesini 4,9 puan artırırken tahmini maliyeti yüzde 67 düşürdü. Karmaşık repo düzeyi yazılım mühendisliği görevlerini içeren DeepSWE testinde ise maliyet yüzde 36 geriledi.
Sistemin yönlendirme kuralları, gerçek GitHub Copilot oturumlarından toplanan CheckpointBench verileriyle optimize edildi. Araştırma önizlemesi şu aşamada tek istemli ve kapsamı net belirlenmiş kodlama görevlerine odaklanıyor. GitHub ekibi, gelecekte uzun ve yinelemeli çok turlu oturumlar için optimizasyon yapmayı planlıyor.
Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.