Google sesli yapay zeka modelleri Gemini 3.8 Live ve Extended Thinking'i tanıttı
Öne çıkanlar
- Gemini 3.8 Live Extended Thinking, Konuşmadan Konuşmaya Kalite İndeksi'nde 82,6 puanla ilk sıraya yerleşti.
- Modeller konuşma sırasında 97 farklı dili otomatik olarak algılayıp diller arasında geçiş yapabiliyor.
- Üretilen tüm ses içeriklerine güvenlik ve doğrulama amacıyla SynthID filigranı ekleniyor.
Google, sesli yapay zeka deneyimlerini geliştirmek amacıyla Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking modellerini duyurdu. Yeni modeller, geliştiricilerin ve işletmelerin üretim ortamına hazır sesli asistanlar oluşturmasını hedefliyor. Gemini 3.8 Live maliyet verimliliği ve akıcı diyaloğa odaklanırken, Extended Thinking sürümü çok adımlı akıl yürütme gerektiren karmaşık iş akışları için geliştirildi.
Gemini 3.8 Live Extended Thinking, Artificial Analysis tarafından hazırlanan Konuşmadan Konuşmaya Kalite İndeksi'nde 82,6 puan alarak zirveye yerleşti. Model ayrıca sesli asistan görev tamamlama testleri olan tau-Voice üzerinde yüzde 68,6 ve tau-Voice-banking üzerinde yüzde 35,1 başarı oranına ulaştı. Sistem, arka planda araç ve API çağrıları yürütürken sohbeti kesintisiz sürdürebiliyor ve 97 dil arasında anlık geçiş yapabiliyor.
Her iki model de geliştiriciler için Gemini API ve Google AI Studio üzerinden erişime açıldı. Kurumsal tarafta Gemini Enterprise önizlemesinde yer alan modeller, bireysel kullanıcılar için Arama ve Google Workspace uygulamalarına entegre ediliyor. Şirket, üretilen tüm ses içeriklerinin tespiti için SynthID filigran teknolojisinin kullanıldığını açıkladı.
Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.