Ana içeriğe geç
Yapay Zeka

Google kurumsal sesli ve görsel yapay zeka modeli Gemini 3.8 Live'ı sundu

Öne çıkanlar

  • Gemini 3.8 Live, 97 dili otomatik algılama ve konuşma desteğiyle ABD ve AB sunucularında genel erişime açıldı.
  • Model, konuşma devam ederken arka planda araç ve API çağrılarını kesintisiz şekilde yürütebiliyor.
  • Üretilen tüm ses ve görüntülere güvenlik ve şeffaflık amacıyla SynthID filigranı yerleştiriliyor.

Google, Gemini 3.8 Live modelini ve dudak senkronizasyonuna sahip görsel temsilciler üreten Live Avatar özelliğini kurumsal müşteriler için genel kullanıma açtı. Google Cloud Next 2026 etkinliğinde ön izlemesi yapılan teknoloji, doğrudan konuşmadan konuşmaya iletişim temeli üzerine kuruldu. Sistem, kullanıcıların web siteleri, mobil uygulamalar ve etkileşimli kiosklar üzerinden video tabanlı yapay zeka temsilcileriyle gerçek zamanlı etkileşime girmesini sağlıyor.

Yeni model, canlı kamera yayınlarını ve ekran paylaşımlarını eş zamanlı işleyebilen görsel anlama kabiliyetiyle çalışıyor. Arka planda araç ve API çağrıları yürütülürken sohbet kesintiye uğramadan devam ediyor. Otomatik dil algılama özelliğiyle 97 farklı dili destekleyen sistem, ABD ve Avrupa Birliği uç noktalarında kurumsal veri yönetişimi standartlarıyla kullanıma sunuldu. Güvenlik önlemleri kapsamında, üretilen tüm ses ve video akışlarına insan gözüyle fark edilemeyen SynthID filigranları ekleniyor.

Önceden tanımlanmış hazır avatar kütüphanesi tüm kullanıcılara açılırken, özel avatar üretimi kimlik doğrulama süreçleri nedeniyle izin listesine tabi tutuldu. Cox Automotive ve Equal AI gibi ilk kurumsal müşteriler, altyapıyı araç satış asistanı ve çok dilli müşteri hizmetleri operasyonlarında devreye aldı. Düşünme sürelerini uzatan Gemini 3.8 Live Extended Thinking sürümü ise kapalı ön izleme sürecinde kalmayı sürdürüyor.

Kaynak

Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.