· kaynak Hacker News – Front Page (native)
Google, Gemini 3.8 Flash'ı ve yalnızca savunmacılara açık Flash Cyber modelini piyasaya sürdü
Google'ın altı haftadaki üçüncü Flash sürümü, agentic kodlama modelini, güvenlik açıkları bulup yamalayan bir siber güvenlik varyantıyla birleştiriyor; bu model yalnızca yeni Fairwind Programı kapsamında incelenmiş savunmacılara sunuluyor.

Google'ın altı haftadaki üçüncü Flash sürümü
Google iki yeni model tanıttı: uzun soluklu kodlama ve otonom agentlere yönelik genel amaçlı Gemini 3.8 Flash ile güvenlik açığı keşfi ve otomatik yamalama için tasarlanmış siber güvenlik varyantı Gemini 3.8 Flash Cyber. Google'ın 2 Eylül 2026 tarihli duyurusuna göre bu, şirketin altı hafta içindeki üçüncü Flash sürümü ve 3.7 Flash'ın ardından üç hafta sonra geldi.
Her iki varyant da aynı temel modele dayanıyor. Google, bu ortak çekirdeğin siber güvenlik sorunları üzerinde yoğun şekilde eğitildiğini ve modelleri yinelemeli olarak değerlendirip geliştiren uzun soluklu agentic döngülerle rafine edildiğini söylüyor.
Genel modelin fiyatı 3.7 Flash'ın giriş seviyesinde kalıyor: milyon input token başına 0,75 dolar ve milyon output token başına 3,75 dolar. Flash Cyber açık satışta değil — yalnızca Google'ın Fairwind Programı adını verdiği yeni erişim düzeni kapsamında incelenmiş savunmacı kuruluşlara sunuluyor.
Tokenları sonuca çeviren bir model
Google'a göre 3.8 Flash'ın temel tasarım tercihi sebat: karmaşık görevlerde ek akıl yürütme adımları çalıştırıyor ve araçları yinelemeli olarak çağırıyor; bu da daha yüksek efor seviyelerinde daha fazla token tüketebiliyor. Verimliliğe en çok önem veren geliştiriciler eforu düşürebilir ya da verimliliğin en çok önemli olduğu iş yükleri için desteklenmeye devam eden 3.7 Flash'ı kullanmaya devam edebilir.
Benchmarklarda Google, 3.8 Flash'ın uzun soluklu bir yazılım mühendisliği testi olan DeepSWE v1.1'de, maliyetinin çok küçük bir bölümüyle daha büyük çoğu frontier modeli geride bıraktığını iddia ediyor. Şirket ayrıca Vals Finance Agent V2 ve Harvey's Legal Agent Benchmark'ta önde olduğunu, STEM, beşeri bilimler ve profesyonel alanlarda çok adımlı akıl yürütme için HLE-Verified'da yüzde 54,9 puan aldığını bildiriyor. Bunlar Google'ın kendi bildirdiği rakamlar.
İstismar değil yamalamaya odaklanan Cyber varyantı
Google, istismar gibi saldırı yetenekleri yerine kasıtlı olarak güvenlik açığı düzeltmeye öncelik verdiğini söylüyor. C ve C++ kodundaki güvenlik açıklarını bulmaya yönelik bir sektör benchmarkı olan CyberGym'de Flash Cyber'nin reportedly hem önceki 3.5 Flash Cyber'yi hem de önemli ölçüde daha büyük frontier modelleri aştığı bildiriliyor. 20 programlama diliyle yazılmış kod tabanlarını kapsayan iç bir benchmarkta Google yüzde 70'in üzerinde bir başarı oranı bildiriyor.
Collinear'ın yürüttüğü harici bir yamalama benchmarkı olan CWE-Bench'te Flash Cyber, yüzde 47,2 pass@1 elde etti; önde gelen bir frontier modelin puanı yüzde 47,8'di ve Google'a göre maliyeti önemli ölçüde daha düşüktü.
Google şirketten içinden ve dışından dağıtım sonuçları paylaştı. Chrome Security ekibi, Flash Cyber'nin çok daha büyük ticari modellere kıyasla 2,6 kat daha fazla doğru güvenlik açığı yaması ürettiğini buldu. Güvenlik firması Wiz, iç sızma testi benchmarkında yüzde 7,5 ila 9,7 puan daha yüksek recall bildirdi ve maliyet 2,3 ila 5,2 kat daha düşüktü. Google'ın Cloud Vulnerability Research ekibi, modeli kullanarak kritik bir temel güvenlik açığını iki saatten kısa sürede buldu; bu tür bir çalışma normalde aylar süren bir araştırma gerektiriyor.
Model kartı neler ekliyor
Aynı gün yayımlanan bir Google DeepMind model kartı teknik ve güvenlik ayrıntılarını tamamlıyor. Gemini 3.8 Flash, 3.7 Flash'a dayanıyor; metin, görüntü, ses ve video kabul ediyor; 64K token output sınırıyla 1 milyon tokena kadar bir context window'a sahip ve kalite, maliyet ve gecikme dengesini ayarlamak için ailenin özelleştirilebilir efor seviyelerini koruyor.
Kart sınırlamaları da listeliyor: halüsinasyon gibi genel temel model sorunları, ara sıra yavaşlama ya da zaman aşımı ve Mart 2026 bilgi kesim tarihi; bazı alanlarda ise geniş Gemini 3 ailesiyle uyumlu olarak etkin biçimde Ocak 2025'e kadar sınırlı.
Güvenlik tarafında kart, lansman mesajını bir miktar dengeliyor. Google'ın duyurusu Gray Swan tarafından ölçülen prompt-injection dayanıklılığında önemli bir sıçramayı öne çıkarıyor; ancak model kartı, çok dilli güvenliğin 3.7 Flash'a kıyasla 5,4 puan gerilediğini, metinden metne güvenliğin ise esasen düz kaldığını belirtiyor. Google'ın Nisan 2026 çerçevesi kapsamındaki bir Frontier Safety değerlendirmesi, 3.8 Flash'ın selefine göre anlamlı yeni yetenekler göstermediğini ve izlenen ya da kritik herhangi bir yetenek seviyesine ulaşmasının olası olmadığı sonucuna vardı. Karta göre insan red teaming çalışmaları ciddi bir endişe bulamadı.
Flash Cyber, standart modelden daha gevşek siber güvenlik azaltımlarıyla geliyor; Google'ın onu yalnızca incelediği savunmacılarla sınırlamasının nedeni de tam olarak bu.
Neden önemli
Üç nokta öne çıkıyor. Birincisi temp: altı haftada üç Flash sürümü, Google'ın orta segment modellerini artık birçok rakibin amiral gemilerini yenilediğinden daha hızlı yinelediğini ve onları agent dağıtımının gerçek iş atları olarak gördüğünü gösteriyor. İkincisi fiyat-performans: agent, kodlama ve güvenlik benchmarklarında frontier'e yakın sonuçların milyon input token başına 0,75 dolara alınması, özellikle token maliyetlerinin biriktiği uzun soluklu agentlerde rakipleri zorluyor. Üçüncüsü yönetişim: yalnızca savunmacılara açık bir güvenlik modeli, yayımlanmış benchmark ve güvenlik verileriyle birlikte, ikili kullanımlı AI yeteneklerinin geniş çaplı sunulmadan nasıl dağıtılabileceğine dair bir şablon çiziyor.
- #gemini
- #ai
- #cybersecurity
- #llm
İlgili yazılar
- Gemini 3.8 Flash değişmeyen fiyatlarla, 2027'de iki katına çıkacak tarifelerle ve erişim kısıtlı bir Cyber modeliyle geldi
- SWE-Bench ProMax: en iyi model büyük çok dilli refactoring görevlerinin yalnızca yüzde 41,2'sini çözebiliyor
- Unit 42, Meksika ve Brezilya hedeflerine yapılan LLM destekli sızma girişimlerini izledi