deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak dev.to (home feed)

Google, Gemini 3.8 Flash'ı değişmeyen fiyatlarla piyasaya sürdü ama görevler daha çok token tüketiyor

Google, 2 Eylül'de Gemini 3.8 Flash'ı yayınladı; token başına fiyatlandırma 3.7 Flash ile aynı. Benchmarklar iyileşse de model daha ağır akıl yürütüyor ve görev başına kabaca %30 daha fazla çıktı tokenı tüketiyor.

Google, Gemini 3.8 Flash'ı değişmeyen fiyatlarla piyasaya sürdü ama görevler daha çok token tüketiyor

Neler yayımlandı

Dev.to'da yayımlanan iki karşılaştırma yazısına göre Google, Gemini 3.8 Flash'ı 2 Eylül 2026'da, Gemini 3.7 Flash'tan üç hafta ve 3.6 Flash'tan altı hafta sonra piyasaya sürdü. Yeni model, öncülüyle birebir aynı token başına fiyatlarla geliyor: milyon girdi tokenı başına 0,75 dolar ve milyon çıktı tokenı başına 3,75 dolar, düşünme dahil; bu fiyatlar 31 Aralık 2026'ya kadar geçerli olacak, ardından standart oran olan 1,50 ve 7,50 dolar uygulanacak. Model kimliği gemini-3.8-flash ve Google, sürümü hem fiyat hem hız açısından 3.7 Flash ile eşit olarak tanımlıyor.

Devralınan özellikler

Belirtimin büyük bölümü değişmedi. Girdi 1.048.576 tokenla sınırlı ve 65.536 çıktı tokenı sunuluyor; kabul edilen girdiler metin, görüntü, video, ses ve PDF olarak kalıyor, çıktı ise yalnızca metin. Context cache okumaları yayımlanma döneminde milyon token başına 0,075 dolara mal oluyor, batch işlemdeki %50 indirim korunuyor ve aylık 5.000 ücretsiz Google Search grounding isteği Gemini 3.x ailesi genelinde paylaşılıyor. Hem Interactions API hem de eski generateContent ucu tam olarak desteklenmeye devam ediyor.

Hız eski modele yakın. Artificial Analysis, yüksek düşünme seviyesinde saniyede 302,1 çıktı tokenı ölçtü; ancak ilk tokena kadar geçen süre 13,3 saniye oldu, çünkü model cevap yazmaya başlamadan önce akıl yürütüyor.

Gerçekten değişen ne

Fark davranışsal. Google, 3.8 Flash'ı uzun vadeli yazılım mühendisliği, otonom agentlar ve karmaşık kurumsal iş akışlarına odaklanan en yetkin Flash modeli olarak konumlandırıyor. Zor görevlerde daha çok akıl yürütme adımı atıyor, bunları daha küçük birimlere bölüyor, araçları tekrar tekrar çağırıyor ve çalışma sırasında kendi çıktısını doğruluyor.

Google'ın yayımladığı 3.7 Flash'a göre benchmark artışları mütevazı ama tutarlı: Vals Finance Agent v2'de yüzde 61,4'e karşılık 59,0; HLE-Verified'da 54,9'a karşılık 53,6; Harvey hukuk agent benchmarkında ise 10,0'a karşılık 8,8. Üçünde de 3.8 Flash, Google'ın karşılaştırma tablosunda Claude Opus 5 ve GPT-5.6 Sol dahil olmak üzere daha pahalı frontier modelleri de geride bıraktı.

Artificial Analysis, 3.8 Flash'a yüksek çaba düzeyinde 59'luk bir Intelligence Index veriyor; bu değer 3.7 Flash için 56, 3.6 Flash için 52 idi. τ³-Banking araç kullanımı benchmarkında yeni model yüzde 45'e ulaşıyor; bu 12 puanlık sıçrama, agent iş yükleri için ana endeksten daha önemli olabilir. Google ayrıca 3.8 Flash'ın uzun ve belge ağırlıklı iş akışlarında 3.7 Flash'ın üç katından fazla görev tamamladığını iddia ediyor; ancak bu, kamuya açık bir test ortamı olmayan dahili bir değerlendirme, bu yüzden yönlendirici olarak alın.

Kodlama verileri eksik. 3.7 Flash için DeepSWE v1.1 puanı yüzde 65,3 ve 3.6 Flash için yüzde 49,0 olarak kayıtlarda var; 3.8 Flash'ın kesin değeri yalnızca bir grafikte görünüyor ve SWE-Bench Pro, Terminal-Bench ya da OSWorld için metin tabanlı rakam yayımlanmamış.

Güvenlik tarafında Google, Gray Swan prompt injection testlerinde önemli bir sıçrama bildiriyor ancak genel bir puan yayımlamıyor. 3.7 Flash ile karşılaştırıldığında çok dilli güvenlik 5,4 puan arttı, metinden metne güvenlik 0,4 düştü ve haksız reddetmeler 1,1 arttı; bu da hafifçe daha fazla fazla-red eğilimine işaret ediyor.

Aynı token fiyatı, daha yüksek görev faturası

Token başına maliyetler sabit ama tüketim değil. Artificial Analysis, 3.8 Flash için görev başına ortalama kabaca 48.000 çıktı tokenı ölçtü; bu, 3.7 Flash'tan yaklaşık %30 daha fazla. Görev başına bazda yüksek düzeydeki 3.7 Flash 2,2 dakikada 0,40 dolara mal olurken, 3.8 Flash düşük çabada 0,24 dolar (0,8 dakika), orta çabada 0,41 dolar ve yüksek çabada 0,58 dolar (2,5 dakika) tutuyor. Dolayısıyla yüksek çabadaki 3.8, görev başına yaklaşık %45 daha pahalı ve %14 daha uzun sürüyor; orta çaba, yüksek düzeydeki 3.7'ye yakın; düşük çaba ise gecikmeye duyarlı yollar için en ucuz ve en hızlı seçenek. Kaliteyi maliyet ve gecikmeye karşı dengelemenin ana ayarı düşünme seviyesi.

İki kırıcı değişiklik

Birincisi, minimal düşünme seviyesi kaldırıldı. 3.8 Flash yalnızca low, medium (varsayılan) ve high kabul ediyor; minimal kullanan yapılandırmalar artık doğrulamada başarısız oluyor ve geçiş öncesi low'a eşlenmeli.

İkincisi, Interactions API'de fonksiyon sonuçları hem call_id hem de name içermek zorunda; generateContent üzerindeki functionResponse da eşleşen tanımlayıcıyı ve fonksiyon adını döndürmeli. Sonuçları yalnızca fonksiyon adıyla eşleyen sistemler, bir araç döngüsünün ikinci turunda bozulabilir.

Google'ın geçiş kılavuzu, yeniden kontrol etmeye değer mevcut Gemini 3 kurallarını da yineliyor: temperature'ı varsayılan 1,0'da tutun, tam sayı bir thinking_budget yerine thinking_level kullanın, candidate_count'u bırakın ve thought signature'ları aldığınız gibi aynen geri döndürün.

Neden önemli

Google, 3.7 Flash'ın kullanımdan kaldırma tarihi açıklanmaksızın tam olarak desteklenmeye devam ettiğini ve 3.8 Flash'ın bilgi kesim tarihinin Mart 2026 olduğunu söylüyor; yani geçiş acil değil. Asıl hikaye fiyatlandırma deseni: sabit token oranlarıyla birleşen daha ağır görev başına tüketim, maliyet tartışmasını oranlardan iş yüküne kaydırıyor. Çok adımlı agent çalıştıran ekipler, geçmeden önce kendi trafiğiyle benchmark yapmalı; ayrıca iki API değişikliği, basit bir model dizisi değişikliğinin bile test edilmeden üretime çıkarsa başarısız olabileceği anlamına geliyor.

  • #gemini
  • #google
  • #llm
  • #ai-agents
  • #api

İlgili yazılar