deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak Hacker News – Front Page (native)

Google, Gemini 4 Argon frontier modelini duyurdu; ilk erişimi güvenlik onayından geçmiş siber savunmacılarla sınırladı

Google, uzun vadeli kodlama ve siber güvenlik çalışmalarında lider olduğunu iddia ettiği frontier modeli Gemini 4 Argon'u tanıttı; daha güçlü güvenlik önlemleri beklenirken ilk erişim güvenilir siber savunmacılarla sınırlı tutuluyor.

Google, Gemini 4 Argon frontier modelini duyurdu; ilk erişimi güvenlik onayından geçmiş siber savunmacılarla sınırladı

Kasıtlı olarak dar kapsamlı ilk sürüm

Google, yeni frontier yapay zekâ modeli Gemini 4 Argon'u duyurdu; ancak geniş çaplı bir lansman yerine şirket, ilk erişimi güvenlik onayından geçmiş bir siber savunmacı grubuyla sınırladı ve genel kullanıma açılma, ek güvenlik çalışmalarının ardından gelecek.

Google'ın duyurusuna göre Argon, şirketin Fairwind Programı aracılığıyla güvenilir siber savunmacılardan oluşan bir gruba sunuluyor. Google, bu düzeydeki frontier yeteneklerin yayımlanmasının aşamalı bir yaklaşım gerektirdiğini ve kullanılabilirliği kademeli olarak genişletirken ABD hükümetinin model öncesi erişim için gönüllü sürecine katıldığını belirtiyor. The Verge, bu sözleri Ağustos'ta DeepMind liderliğini devralan Google'ın baş yapay zekâ mimarı ve DeepMind kıdemli başkan yardımcısı Koray Kavukcuoglu'na ait olarak aktarıyor.

Google, Argon'u geliştiricilere, kurumlara ve tüketicilere açmadan önce erken testçilerden geri bildirim toplayacağını ve güvenlik önlemleri üzerinde yineleme yapacağını söylüyor. The Verge, yapılmakta olan koruma önlemlerinin arasında kötüye kullanıma ve prompt enjeksiyonu saldırılarına karşı savunmalar ile uyumsuzluk belirtilerinin izlenmesinin bulunduğunu aktarıyor.

Google, modelin neler yapabileceğini iddia ediyor

Google, Argon'u uzun vadeli akıl yürütme için inşa edilmiş bir model olarak konumlandırıyor: tek seferlik yanıtlar üretmek yerine derin, çok adımlı çalışmayı sürdürebiliyor. Çıktı token sınırı, önceki nesildeki 64K'dan 1 milyon tokena yükseliyor; Google'a göre bu, modele zor problemleri tek bir çalışma içinde çözme alanı tanıyor.

Benchmarklarda Google, en iyi sonuçları bildiriyor: gerçek dünyadaki uzun vadeli yazılım mühendisliğini ölçen DeepSWE v1.1'de yüzde 77,9; finans, kodlama, hukuk ve vergi performansını ABD GSYH'ye katkısına göre ağırlıklandıran Vals Index'te lider konum; Zapier'ın AutomationBench'inde yüzde 51,3 ile ilk sıra; ve uzun video anlama testi LVBench'te yüzde 91,7. The Verge, Google'ın ayrıca Gemini 4'ü OpenAI ve Anthropic'in rakip modellerinin önüne yerleştiren karşılaştırma grafikleri yayımladığını; bunun da hafta başında X'te sızdığı görünen benchmark sonuçlarının dolaşıma girmesinin ardından geldiğini not ediyor.

Google, modelin halihazırda şirket içinde kullanımda olduğunu söylüyor. İleri sürülen örnekler arasında altyordam optimizasyonu sırasında yayımlanmış bir kuantum hesaplama referans değerini yüzde 40 geride bırakmak; ajan destekli optimizasyonlarla veri merkezi belleğinden 300 TiB'den fazla alan boşaltmak ve toplam tasarrufun 500 TiB ile 1 PiB arasında olduğu tahmin ediliyor; ve ölçekli C/C++-tan-Rust geçişleri — Fuchsia OS Zircon çekirdeği için 800.000 satırdan fazla satır, önceki Rust portundan 2,7 kat daha hızlı çalışan yeniden yazılmış bir libgav1 video çözücüyle birlikte.

Argon geniş çapta kullanıma açıldığında, giriş başına milyonlarca token başına 2 dolar ve çıktı tokenları için milyonlarca token başına 10 dolarlık bir tanıtım fiyatına sahip olacak; önbelleğe alınmış giriş tokenlarında yüzde 95 indirim uygulanacak.

Siber güvenlik boyutu

Lansmanın en alışılmadık öğesi siber savunma. Google, Argon'un kritik yazılım güvenlik açıklarını özerk biçimde bulabildiğini, doğrulayabildiğini ve yamalayabildiğini, güvenilir savunmacılar ve Google'ın kendi iç ekipleri için ise tam yeteneklerin kullanılabilmesi amacıyla siber koruma önlemleri olmadan yayımlandığını söylüyor.

Wiz, Argon'u kritik kamu altyapısındaki yüksek riskli maruziyetleri ücretsiz olarak bulup gideren Scan for Good girişimi üzerinden halihazırda kullanıma sunuyor. Google, erken bir gösterimde modelin dünya çapındaki hastanelerde kullanılan sağlık yazılımında hassas kişisel bilgileri ifşa eden kritik bir güvenlik açığını ortaya çıkardığını — önceki frontier modellerin gözünden kaçan ciddi bir risk — söylüyor.

Neden önemli

Bu lansmanı olağan benchmark yarışının ötesinde bir sinyal yapan iki şey var. Birincisi, kısıtlamanın kendisi: bir frontier modelin, savunmacı — ve ima edilen biçimde saldırgan — siber yetenekleri açıkça sunulmak için fazla riskli kabul edildiği için genel kullanıma açılmaması, laboratuvarların çift kullanımlı yapay zekâyı nasıl ele aldığına dikkat çekici bir örnek oluşturuyor. İkincisi, Google'ın ne kadar gayriresmî olursa olsun ABD hükümetinin gönüllü sürüm öncesi inceleme sürecine katılımı, büyük laboratuvarlar ile devlet arasında şekillenen bir yayım normunun taslağını çiziyor.

Rekabet zamanlaması bu noktayı keskinleştiriyor. The Verge'nin de belirttiği gibi, Argon, OpenAI'nin Dots yapay zekâ ajanını ve GPT-6.1 Sol modelini tanıttığı — ve ayrıca güvenlik endişeleri nedeniyle planlanan GPT-6.1 Astra modelini yayımlamayacağını doğruladığı — DevDay'in tam bir gün ardından geliyor. İki önde gelen laboratuvar artık yetenek ve kısıtlamayı aynı lansman hikâyesinin parçaları olarak görünür biçimde ele alıyor; Google'ın Argon erişimini ne kadar hızlı genişleteceği ise bu kısıtlamanın sürüp sürmeyeceğinin bir testi olacak.

  • #google
  • #gemini
  • #ai-safety
  • #cybersecurity
  • #frontier-models

İlgili yazılar