deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak dev.to (home feed)

Gemini 3.8 Flash değişmeyen fiyatlarla, 2027'de iki katına çıkacak tarifelerle ve erişim kısıtlı bir Cyber modeliyle geldi

Google'ın üç ay içindeki üçüncü Flash sürümü, tanıtım fiyatlarını 2026 sonuna kadar koruyor; ancak eklenen akıl yürütme adımları output-token faturalarını şişirebilir. Yalnızca savunma amaçlı bir Cyber varyantı, kısıtlı erişim programı kapsamında yayınlandı.

Gemini 3.8 Flash değişmeyen fiyatlarla, 2027'de iki katına çıkacak tarifelerle ve erişim kısıtlı bir Cyber modeliyle geldi

Üç ay içinde üçüncü Flash sürümü

Google, 2 Eylül 2026'da Gemini 3.8 Flash'ı yayınladı; bu, Gemini 3.7 Flash'tan üç hafta sonra ve aynı süre içindeki üçüncü Flash modeli. Bilgiye, dev.to'daki bir Proje Defteri yazısından ulaşıldı. Yazı, 3.6 Flash'ın tarihini 21 Temmuz, 3.7 Flash'ın ise 13 Ağustos olarak veriyor. Google'ın yeni modeli, 3.7'nin hız ve maliyet profilini korurken en güçlü akıl yürütme ve kodlama sürümü olarak konumlandırdığı bildiriliyor; duyuru, ürün yönetiminden kıdemli direktör Tulsee Doshi ve Google DeepMind'da Gemini güvenliğinden sorumlu Raluca Ada Popa imzasıyla yayımlandı.

Yayınlanan teknik özellik sayfasında model kimliği gemini-3.8-flash, bir milyon tokenlık bağlam penceresi, 64.000 tokenlık output sınırı, metin, görsel, video, ses ve PDF'yi kapsayan ve yalnızca metin çıktısı veren multimodal giriş, ayrıca function calling, search grounding ve bilgisayar kullanımı yer alıyor. Ağırlıklar kapalı kalıyor. Bilgi kesim tarihi çoğu alan için Mart 2026, ancak bazı alanlar için Ocak 2025; yazı bunu, grounding etkinleştirilmedikçe yakın zamanda yayınlanan kütüphanelerle ilgili sorularda halüsinasyon riski olarak işaretliyor.

Daha çok akıl yürütme adımı, daha büyük faturalar

Merkezi davranışsal değişiklik, modelin daha çok çalışması: karmaşık görevlerde ek akıl yürütme adımları, tek seferlik çağrılar yerine yinelemeli araç çağrıları ve ilk yanıtlarla yetinme isteğinin azalması. Bu, API kullanıcıları için iki yönlü işliyor. Thinking tokenları output oranı üzerinden, yani input oranının beş katı üzerinden faturalandırılıyor; dolayısıyla özdeş prompt'lar belirgin biçimde daha fazla faturalandırılabilir token döndürebiliyor. Yazının atıf yaptığı Artificial Analysis, modeli çok sözlü olarak nitelendiriyor ve değerlendirme seti boyunca 120 milyon output token kaydetti. Google, verimlilik öncelikli iş yükleri için daha düşük efor seviyeleri öneriyor ve bu işler için 3.7 Flash'ın tam olarak desteklenmeye devam ettiğini belirtiyor.

Hız konusunda Artificial Analysis, saniyede 304,6 output token ölçüyor; bu, endeksindeki en hızlı değer. Ancak ilk tokena kadar geçen süre 13,39 saniye; bu gecikme kullanıcılar tarafından chat arayüzlerinde hissediliyor, toplu iş (batch) hatlarında ise hissedilmiyor.

Kıyaslamalar uzmanlık ve uzun vadeli işler arasında bölünüyor

Yazıdaki, Google, Artificial Analysis ve bir OfficeChai derlemesinden alınan kıyaslama tablosu, Claude Opus 5 ve GPT-5.6 Sol'a karşı bölünmüş bir tablo çiziyor. 3.8 Flash, uzman ajan işlerinde tabloya öncülük ediyor: Vals Finance Agent v2'de yüzde 61,4, Harvey'nin hukuk ajanı kıyaslamasında Opus 5'in 6,7'sine ve GPT-5.6 Sol'un 2,5'ına karşı yüzde 10,0, HLE-Verified'da yüzde 54,9, CharXiv grafik akıl yürütmede yüzde 86,2 ve ajan tabanlı LVBench uzun video anlamadada Opus 5'in 75,4'üne karşı yüzde 87,8.

Geri kaldığı alan ise uzun vadeli otonom işler: Terminal-bench 4.0'da Opus 5'in 51,8'ine karşı yüzde 19,1, OSWorld-2.0 bilgisayar kullanımında 75,4'e karşı yüzde 59,0, DeepSWE v1.1'de her iki rakibin gerisinde yüzde 71,0 ve GDPVal-AA v2 Elo'da 1824'e karşı 1545. Kendi selefine göre kazanımlar gerçek: Terminal-bench 4.0 yüzde 11,2'den yukarı çıktı, zorlu BioMysteryBench seti yüzde 43,5'ten 56,5'e yükseldi ve AA Intelligence Index 56'dan 59'a hareket etti; bu, 195 model arasında 16. sıra. Yazı, Opus 5'in milyonda token başına 5 dolar input ve 25 dolar output maliyetiyle her iki eksende de kabaca Flash'ın 6,7 katı olduğunu, dolayısıyla kritik adımları daha büyük modele yönlendirmenin ve hacimli işleri Flash'a vermenin hâlâ ekonomik mimari olduğunu belirtiyor.

Fiyatlandırma, bozulana kadar sabit

Tanıtım API fiyatlandırması milyonda token başına 0,75 dolar input ve 3,75 dolar output olarak değişmedi; ancak 31 Aralık 2026'da sona eriyor ve 1 Ocak 2027'den itibaren 1,50 ve 7,50 dolara iki katına çıkıyor. Yazı, bunun 3.7 Flash ile aynı tarife ve son kullanma tarihi olduğunu vurguluyor ve hem Yılbaşı zammı hem de artan sözlülükten kaynaklanan token enflasyonu için bütçe yapmayı öneriyor.

Flash Cyber yeni bir erişim kapısının ardında yayımlandı

Aynı gün ikinci bir model geldi: Otonom güvenlik açığı keşfi için ayarlanmış, 3.5 Flash Cyber'ın yalnızca savunma amaçlı halefi olan Gemini 3.8 Flash Cyber. Google, 20 programlama dilinde gerçek dünya güvenlik açığı keşfinde yüzde 70'in üzerinde başarı, CWE-Bench yamalamada yüzde 47,2 pass@1, geliştirilmiş Gray Swan prompt enjeksiyonu sağlamlığı ve CyberGym'de selefinin ve daha büyük sınır modellerinin önünde zafer iddia ediyor. Alıntılanan saha raporları arasında, Chrome güvenlik ekibinin önde gelen ticari modellere kıyasla 2,6 kat daha fazla doğru yama gördüğü, Wiz'in 2,3 ila 5,2 kat daha düşük maliyetle yüzde 7,5 ila 9,7 daha yüksek hatırlama bildirdiği ve Google Cloud'un güvenlik açığı araştırma ekibinin kritik bir hatayı iki saatten kısa sürede bulmasını modele atfettiği yer alıyor. Standart bir API anahtarıyla çağrılamıyor: erişim, yazının da içinde hükümet otoritelerinin bulunduğunu söylediği yeni Fairwind Programı aracılığıyla güvenilir savunucularla sınırlı.

Neden önemli

API kullanıcıları için bu sürüm bir fiyat hamlesinden çok iki son tarih ve bir gizli maliyet hakkında. Ana oran değişmedi, ancak 1 Ocak 2027'de iki katına çıkıyor ve daha ağır akıl yürütme, o tarihten önce output-token harcamasını sessizce artırabiliyor. Kıyaslama bölünmesi mimariyi de şekillendiriyor: 3.8 Flash, fiyat sınıfında finans, hukuk, grafik ve uzun video ajan işleri için en güçlü model; uzun vadeli terminal ve bilgisayar kullanımı görevleri ise Opus 5 için kabaca yedi kat daha fazla ödemeyi hâlâ haklı kılıyor. Bu arada Flash Cyber, Google'ın en güçlü güvenlik modellerini genel API erişiminden ayırdığını gösteriyor; ajan tabanlı güvenlik araçları olgunlaştıkça izlenmesi gereken bir örüntü.

  • #gemini
  • #google
  • #llm
  • #api-pricing
  • #benchmarks
  • #cybersecurity

İlgili yazılar