· FikirPilot
Google, önceki modelinin piyasaya çıkmasından birkaç hafta sonra Gemini 3.8 Flash’ı tanıttı. Anlaşılan, şirket, modelin karmaşık görevlerde daha fazla akıl yürütme adımı attığını ve araçları yinelemeli kullandığını belirtiyor. Açıkçası, giriş fiyatı Gemini 3.7 Flash ile aynı: milyon girdi tokenı…
Google, önceki modelinin piyasaya çıkmasından birkaç hafta sonra Gemini 3.8 Flash’ı tanıttı. Şirket, modelin karmaşık görevlerde daha fazla akıl yürütme adımı attığını ve araçları yinelemeli kullandığını belirtiyor. Giriş fiyatı Gemini 3.7 Flash ile aynı: milyon girdi tokenı başına $0.75, milyon çıktı tokenı başına $3.75. Ancak Google, özellikle yüksek çaba düzeylerinde performansı artırmak için daha fazla token kullanılabileceği konusunda uyarıyor. Token tüketimini azaltmak isteyen geliştiriciler Gemini 3.7 Flash’ı kullanmayı sürdürebilecek.
Artificial Analysis, modelin bu zekâ düzeyinde ölçtükleri en ucuz seçenek olduğunu, görev başına çıktı tokenlarında %30 artış. Daha fazla işlem turu nedeniyle Gemini 3.7 Flash’a kıyasla maliyetin yaklaşık %40 yükseldiğini aktardı. Google, yazılım mühendisliği ve otonom yapay zekâ ajanlarında önemli gelişmeler bulunduğunu; modelin DeepSWE v1.1, Vals Finance Agent V2. Harvey’s Legal Agent testlerinde rakiplerini geçtiğini açıkladı. Model, CBRN ve siber saldırı alanlarında kötüye kullanımı önleyen güvenlik önlemleriyle geliyor.
Gemini 3.8 Flash Cyber, 650 üyeli ve hükümetlerle güvenilir ortaklara açık Fairwind Programı kapsamında sunuldu. Program, CodeMender aracına da erişim sağlıyor. Gemini 3.8 Flash tüketiciler, geliştiriciler ve kurumsal kullanıcılar için erişilebilir.
Geliştiriciler açısından temel değişiklik, aynı giriş fiyatı korunurken karmaşık görevlerdeki işlem yoğunluğunun toplam maliyeti artırabilmesi. Bu nedenle model seçimi yalnızca birim token ücretine değil, görevin kaç çıktı tokenı. Bu nedenle model seçimi yalnızca birim token ücretine değil, görevin kaç çıktı tokenı ve işlem turu gerektirdiğine de bağlı hale geliyor; daha düşük tüketim isteyenler için önceki sürüm hâlâ seçenek olarak kalıyor. Yazılım mühendisliği ve otonom ajan testlerindeki sonuçlar, bu alanlarda modelin kullanımını değerlendiren ekipler için karşılaştırma zemini sunuyor. Yazılım mühendisliği ve otonom ajan testlerindeki sonuçlar, bu alanlarda modelin kullanımını değerlendiren ekipler için karşılaştırma zemini sunuyor; ancak performans verilerinin bir bölümünün Google’ın kendi açıklamalarına dayandığı görülüyor. Siber güvenlik sürümünün sınırlı bir programa açılması ise erişim kapsamını genel kullanımdan ayırıyor. Bu özel sürümün kimler tarafından, hangi koşullarda kullanılacağı sorusunu açık bırakıyor.