deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak The Verge

Google, Gemini 3.8 Flash'ı token başına değişmeyen fiyatlarla ve daha derin akıl yürütmeyle yayınladı

Google'ın Gemini 3.8 Flash'ı, 3.7 Flash'ın ardından sadece birkaç hafta sonra geldi; daha fazla akıl yürütme adımı ve yinelemeli tool çağrıları sunuyor. Token başına fiyatlar değişmedi, ancak daha yüksek token kullanımı gerçek maliyetleri artırabilir.

Google, Gemini 3.8 Flash'ı token başına değişmeyen fiyatlarla ve daha derin akıl yürütmeyle yayınladı

Google, Gemini 3.8 Flash'ı yayınladı; bu model, selefi Gemini 3.7 Flash'ın ardından yalnızca birkaç hafta sonra gelen hızlı bir takip sürümü. The Verge'in haberine göre Google, yeni modeli "daha çok çalışan" bir model olarak tanımlıyor: karmaşık görevlerde daha fazla akıl yürütme adımı atıyor ve tek bir geçişle yetinmek yerine tool'ları yinelemeli olarak çağırıyor.

Daha fazla akıl yürütme, zincirlenmiş tool çağrıları

Öne çıkan değişiklik davranışsal. The Verge, Google'ın 3.8 Flash'ı yazılım mühendisliği ve otonom agent'lar için "önemli iyileştirmeler" sunduğu şeklinde konumlandırdığını bildiriyor — çok adımlı akıl yürütmenin ve tool'ların tekrar tekrar çağrılmasının en çok fark yarattığı iki alan. Uygulamada model, yanıt vermeden önce daha çok çaba ve daha çok token harcayacak şekilde ayarlanmış.

Token başına fiyatlar sabit, toplam maliyetler öyle olmayabilir

Fiyatlandırma giriş seviyesinde değişmedi: 3.7 Flash ile aynı şekilde milyon giriş token'ı başına 0,75 dolar ve milyon çıkış token'ı başına 3,75 dolar. Ancak Google'ın kendisi de modelin performansı en üst düzeye çıkarmak için, özellikle daha yüksek çaba ayarlarında, daha fazla token tüketebileceği konusunda uyarıyor.

The Verge'in aktardığına göre kıyaslama şirketi Artificial Analysis bu etkiyi rakamlarla ortaya koydu: token başına ücretler aynı olmasına rağmen, 3.8 Flash ile tipik bir görevin maliyeti 3.7 Flash'a kıyasla yaklaşık %40 daha yüksek; bunun nedeni görev başına kabaca %30 daha fazla çıkış token'ı ve agent değerlendirmelerindeki ek tur lar. Buna rağmen Artificial Analysis, modeli bu zekâ seviyesinde ölçtüğü en ucuz model olarak nitelendiriyor. Token kullanımını — ve faturaları — düşük tutmak isteyen geliştiriciler Gemini 3.7 Flash'ta kalabilir.

Benchmark sonuçları ve ilk izlenimler

Google, yeni modelin DeepSWE v1.1 yazılım mühendisliği benchmark'ında selefini ve diğer frontier modelleri geride bıraktığını söylüyor; model, Anthropic'in Fable 5'inin önünde tamamladı — Fable 5, hafta içinde cache'lenmiş veri kullanımının fiyatını düşüren bir yükseltme aldı. The Verge ayrıca Vals Finance Agent V2 benchmark'ı ve Harvey'nin Legal Agent benchmark'ında da başarılar bildiriyor.

İlk tepkiler olumluydu. Aigora.ai CEO'su John Ennis, modeli Anthropic'in kadrosuyla olumlu bir şekilde kıyaslayarak "Opus 5 kodlama kalitesini ama maliyetin çok küçük bir bölümüyle ve süper hızlı" sunduğunu söyledi ve Remotion videoları üretmek için iyi bir uyum olacağını öngördü.

Sürüm ayrıca kimyasal, biyolojik, radyolojik ve nükleer (CBRN) alanlarında kötüye kullanıma karşı önlemlerle ve saldırgan siber operasyonlara karşı korumalarla geliyor.

Hükümetler için ayrı bir Cyber modeli

Genel sürümün yanı sıra Google, hükümetlere ve şirketin güvenilir ortakları dediği kurumlara sınırlandırılmış bir varyant olan Gemini 3.8 Flash Cyber'ı yayınladı. Erişim, The Verge'in haberine göre üyeleri arasında CrowdStrike ve Center for Internet Security'ın bulunduğu yeni Fairwind Program üzerinden yürütülüyor. Üyeler, Flash Cyber'a ve Google'ın kritik altyapıyı, kamu hizmetlerini ve ulusal güvenliği korumak için zafiyetleri otonom olarak bulup giderebilen bir agent olan CodeMender'a erişiyor.

Kullanılabilirlik

Gemini 3.8 Flash, şu anda Google AI Pro veya Ultra aboneliğine sahip tüketiciler için ve geliştiriciler ile kurumsal müşteriler için Google'ın API'si aracılığıyla kullanılabilir.

Neden önemli

Geliştiriciler için iki şey öne çıkıyor. Birincisi yayın temposu: öncekinden yalnızca birkaç hafta sonra gelen anlamlı bir güncelleme, Google'ın Flash kademesinde ne kadar hızlı ilerlediğini ve ekiplerin herhangi bir sürümde istikrar sağlamak için ne kadar az zamanı olduğunu gösteriyor. İkincisi, fiyatlandırmanın iktisadığı sessizce değişiyor. Sabit token başına ücretler 3.8 Flash'ı benimsenmesi ücretsiz gösteriyor, ancak daha uzun akıl yürüten ve daha fazla agent turu atan modeller görev başına daha fazla token harcıyor — Artificial Analysis burada yaklaşık %40 daha fazla ölçtü. API harcaması planlayan herkes token başına maliyete değil, görev başına maliyete göre plan yapmalı. Genel modele ek olarak yalnızca hükümetlere açık bir Cyber varyantıyla birlikte gelen bölünmüş sürüm, sağlayıcıların frontier yetenekleri müşteri türüne göre giderek daha çok segmentlere ayırdığının da sinyalini veriyor — bu modelin sektör genelinde yayılması muhtemel.

  • #google
  • #gemini
  • #llm
  • #ai-agents
  • #api

İlgili yazılar