Google, Gemini 3.8 Flash ve Siber Odaklı 3.8 Flash Cyber Modellerini Tanıttı
Google, 2 Eylül 2026’da Gemini 3.8 Flash ve Gemini 3.8 Flash Cyber modellerini duyurdu. Yeni modeller, yazılım mühendisliği, ajan tabanlı görevler ve siber güvenlikte önemli ilerlemeler sunarken 3.7 Flash ile aynı düşük maliyet ve hız seviyesini koruyor.
Google, 2 Eylül 2026’da Gemini 3.8 Flash ve Gemini 3.8 Flash Cyber modellerini duyurdu. Her iki model de aynı temel zeka üzerine inşa edildi ve uzun süreli ajan döngüleriyle destekleniyor. Gemini 3.8 Flash, yazılım mühendisliği, otonom ajanlar ve çok adımlı akıl yürütme alanlarında 3.7 Flash’e göre belirgin iyileştirmeler gösterirken, aynı fiyatlandırmayla sunuluyor: 1 milyon giriş tokeni 0.75 dolar, 1 milyon çıkış tokeni 3.75 dolar.
Gemini 3.8 Flash Uzun Vadeli Kodlama ve Ajan Görevlerinde Öne Çıkıyor
Gemini 3.8 Flash, DeepSWE v1.1 (Uzun Ufuklu Yazılım Mühendisliği) benchmark’ında çoğu daha büyük frontier modeli geride bırakarak karmaşık mühendislik problemlerini otonom şekilde çözebiliyor. Ayrıca Vals Finance Agent V2 ve Harvey’s Legal Agent Benchmark gibi alanlarda da 3.7 Flash ve diğer frontier modellerden daha iyi performans sergiliyor. Model, HLE-Verified testinde %54.9 başarı elde etti. Karmaşık görevlerde daha fazla akıl yürütme adımı atarak ve araçları yinelemeli kullanarak performansı artırıyor. Geliştiriciler, token kullanımını azaltmak için düşük çaba seviyelerini tercih edebiliyor.
Gemini 3.8 Flash Cyber Siber Güvenlikte Frontier Performans Sunuyor
Gemini 3.8 Flash Cyber, yalnızca güvenilir savunma taraflarına açık Fairwind Programı üzerinden erişilebiliyor. CyberGym benchmark’ında frontier düzeyinde otonom güvenlik açığı keşfi performansı göstererek hem 3.5 Flash Cyber’i hem de daha büyük modelleri geçti. 20 farklı programlama dilini kapsayan iç benchmark’ta başarı oranı %70’i aştı. CWE-Bench’te pass@1 skoru %47.2 ile Pareto frontier’da yer aldı; rakip frontier model %47.8 skor alırken maliyet açısından belirgin avantaj sağlıyor.
Gerçek dünya uygulamalarında Chrome Security ekibi, modelin en iyi ticari modellerden 2.6 kat daha fazla doğru yama ürettiğini tespit etti. Wiz’in iç penetrasyon testi benchmark’ında %7.5-9.7 daha yüksek recall değeriyle 2.3-5.2 kat daha düşük maliyet elde edildi. Google Cloud Vulnerability Research ekibi ise aylar süren bir kritik açığı model sayesinde 2 saatten kısa sürede buldu.
Her iki model de Google’ın Frontier Safety Framework’ü doğrultusunda CBRN ve siber saldırılara karşı koruma mekanizmaları içeriyor. Gemini 3.8 Flash Cyber, savunma amaçlı daha geniş yetenekler sunmak üzere sınırlı kullanıcı kitlesine sunuluyor. Geliştiriciler Gemini API, Google AI Studio ve Android Studio üzerinden yeni modellerle çalışmaya başlayabilir.