· FikirPilot
Google, görsel bağlam ve karmaşık akıl yürütme yeteneğine sahip Gemini 3.8 Live modellerini çıkardı. Modeller Gemini API ve Workspace üzerinden erişime açıldı.
Google, sesli yapay zekâ alanında geliştirdiği Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking modellerini kullanıma sundu. Karmaşık akıl yürütme, gerçek zamanlı görsel işleme ve sohbeti kesmeden arka planda görev yürütme yeteneklerine sahip modellere Gemini API, Google Workspace ve Gemini uygulaması üzerinden erişilebiliyor.
Gemini 3.8 Live Extended Thinking, Speech to Speech Quality Index değerlendirmesinde 82,6 puan alarak genel sıralamada birinci oldu. Big Bench Audio testinde yüzde 97,7 başarıya ulaşan modeller, 97 desteklenen dil arasında otomatik geçiş yapabiliyor.
Modeller; pazarlama araçları hazırlama, rezervasyon yönetimi ve iş planı oluşturma gibi çok aşamalı iş akışlarını sesli biçimde yürütebiliyor. Yanlış bilgilendirme ve içerik taklit riskine karşı ise üretilen tüm sesler SynthID teknolojisiyle işaretleniyor.
Google, daha önce Gmail, Docs ve Keep uygulamalarına kullanıcıların konuşarak yönetim sağlamasına imkan tanıyan canlı sohbet özelliklerini eklemişti. Yeni yayımlanan modellerle birlikte bu uygulamalardaki sesli etkileşim ve görev yürütme altyapısı genişletildi.
Kaynak: FikirPilot · TRBülten tarafından derlendi