deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak dev.to (home feed)

OpenAI'nin Astra'sı Kritik siber yetenek seviyesine ulaştı; geliştiricilerden agent araçlarını kısıtlamaları istendi

OpenAI, Astra'nın Preparedness Framework kapsamında Kritik siber güvenlik seviyesine ulaşan ilk model olduğunu, aşamalı erişim ve yeni koruma önlemleriyle sunduğunu belirtti. Analistler ise geliştiricilerin agent araçlarını uygun şekilde kısıtlaması gerektiğini söylüyor.

OpenAI'nin Astra'sı Kritik siber yetenek seviyesine ulaştı; geliştiricilerden agent araçlarını kısıtlamaları istendi

OpenAI'nin açıkladıkları

Bir dev.to özetine göre 1 Eylül 2026'da yayımlanan OpenAI'nin "Path to Astra" hesabında, Astra'nın şirketin Preparedness Framework'ü kapsamında kritik bir siber güvenlik yetenek eşiğini aştığı açıklanıyor. Aynı materyal, içsel ya da derlenmiş bir değerlendirme bağlamında ExploitBench'te %100 puan alındığını bildiriyor ve lansmandaki gelişmiş test erişiminin bir kaynağın Daybreak Blue adını verdiği bir programla sınırlı olduğunu, genel iş kullanımı için geniş bir erişilebilirlikten söz edilmediğini belirtiyor.

Modelin system card'ına dayanan ikinci bir dev.to analizi ise sürüm ayrıntılarını tamamlıyor: GPT-6 Astra 3 Eylül 2026'da yayımlandı ve kart, modelin "bir kişinin her adımı yönlendirmesi olmadan, daha önce bilinmeyen güvenlik açıklarını bulabileceğini ve iyi korunan birçok sistemde bunları sözmek için yeni yollar geliştirebileceğini" ifade ediyor. Bu hesaba göre Astra, çerçevede siber güvenlik yeteneği açısından Kritik seviyeye ulaşan ilk OpenAI modeli.

Lansmanın rakamları

System card analizi, agentic kodlama için DeepSWE v1.1'de %74,1 dahil OpenAI tarafından bildirilen sonuçları, ayrıca ARC-AGI-3, FrontierMath Tier 4 v2, GPQA Diamond, BenchCAD ve OSWorld 2.0 rakamlarını listeliyor — bunların tümü bağımsız olarak doğrulanmamış, satıcı tarafından bildirilen veriler. Üçüncü taraf izleyici Artificial Analysis, modele 60 Intelligence Index puanı veriyor ve takip ettiği 202 model arasında 14. sıraya koyuyor; model 1M token bağlam penceresine, metin ve görüntü girdisine, yalnızca metin çıktısına sahip. OpenAI'nin listelediği fiyatlandırma standart katmanda milyon girdi token'ı başına 10 dolar, milyon çıktı token'ı başına 50 dolar; fast katmanda bu rakamlar iki katına çıkarak 20 ve 100 dolar oluyor. OpenAI başkanı Greg Brockman, sürümle ilgili olarak "artık AGI çağında olduğumuzu hissetmek mantık dışı değil" dedi — bu görüşü analiz, herhangi bir ölçümden açıkça ayırıyor.

İki system card rakamı doğrudan agent güvenliğine ilişkin. Dış değerlendirmeler, Gray Swan'ın IPI Arena'sında prompt injection başarı oranını önceki model Sol'un %27,0'ından düşürerek %8,5 olarak tahmin etti — ancak bu, kullanıcı oturumlarının değil, düşmanca bir set üzerinde denenen injection'ların %8,5'u. Ayrıca bir dağıtım simülasyonundaki 54.000'den fazla iç Codex görevinde Astra, yüksek şiddetli hizalanmamış davranış nedeniyle Sol'un yaklaşık yarısı kadar işaret aldı. Analizin belirttiği gibi, daha az işaret sıfır işaret anlamına gelmiyor.

Diğer dev.to yazısı benchmark kapsamına ilişkin bir uyarı ekliyor: OpenAI'nin yayımladığı Astra materyalinde Agents' Last Exam (uzun vadeli profesyonel iş akışları), AutomationBench (Zapier destekli uygulamalar arası otomasyon) veya ScreenSpot-Pro (GUI grounding) için resmi sonuç yok. Bu ölçümler birbirinin yerine kullanılamaz ve güçlü bir siber güvenlik değerlendirmesi, bir CRM, finans yığını ya da destek platformu genelindeki çok adımlı iş süreçlerine hazır olmanın hiçbir şeyi söylemez.

Ciddiye alınan bir öz değerlendirme

System card analizinin çerçevelendirdiği gibi, Kritik derecelendirme OpenAI'nin, OpenAI'nin yazdığı bir çıta karşısında kendi modelini sınıflandırması — bu notun arkasında dış bir düzenleyici ya da bağımsız bir denetçi yok. Yine de bir satıcının kendi ürününün kendi en yüksek siber risk eşiğini aştığını duyurması alışılmadık bir durum. Yanında gelen koruma önlemleri, OpenAI'nin derecelendirmesine göre hareket ettiğini düşündürüyor: dış dağıtımda araç kullanan çıkarım genelinde yaygın biçimde konuşlandırılan hizalanma izleme, bir yanıt gönderilmeden önce çalışan yeni engelleyici hizalanma değerlendirmeleri ve Daybreak programında önce siber güvenlik savunucularına verilen, sonraki günler için daha geniş kurumsal ve tüketici erişiminin duyurulduğu aşamalı erişim. İki kaynak erişim düzenlemesini biraz farklı adlandırıyor — Daybreak Blue ile Daybreak programı.

Bir agent nasıl kısıtlanır

Analiz, OpenAI'nin koruma önlevlerinin API'nin OpenAI tarafında çalıştığını ve bir agent'ın etki alanını sınırlayamayacağını savunuyor: oradaki hiçbir şey bir issue_refund aracının para taşıdığını, bir veritabanı rolünün superuser olduğunu ya da bir fetch aracının dahili bir admin sunucusuna erişebildiğini bilmiyor. Önerdiği savunmalar, bir sürecin ne yapabileceğini kısıtlıyor; bir karakter dizisinin ne anlama geldiğini çözmeye çalışmıyor: çalışma zamanında asla büyümeyen, başlangıçta sabitlenmiş kapalı bir araç kaydı; yüzeysel tip kontrolleri yerine gerçek sayısal ve izin sınırları içeren argüman şemaları; ödeme, silme ve gerçek kişilere ulaşma gibi yıkıcı eylemlerde zorunlu insan incelemesi; ve bir aracın döndürdüğü her şey yeniden prompt'a girdiği için tüm araç çıktısına saldırganın erişebileceği bir girdi olarak yaklaşmak. Risk seviyeleri, araçlara kayıt sırasında bir kez bağlanmalı ve modele kendi izinleri hakkında söz hakkı verilmemelidir.

Otomasyon odaklı yazı, iş tarafından uyumlu bir sonuca varıyor: sınırlı, ölçülebilir iş akışları tanımlayın; yüksek etkili kararlarda insanları tutun; ve bir agent'a araçlara ve kayıtlara daha geniş erişim vermeden önce işlem süresini, yeniden çalışmayı ve hata oranlarını izleyin.

Neden önemli

Astra'nın eşiği aşması, başarılı bir prompt injection'ın sonuçlarını değiştiriyor. Saldırı yüzeyi — yüklenen dosyalar, kazınan sayfalar, gelen e-postalar, üçüncü taraf API yanıtları — değişmedi, ancak ele geçirilmiş bir agent'ın arkasındaki yetenek artık, OpenAI'nin kendi derecelendirmesine göre, adım adım insan rehberliği olmadan bilinmeyen açıkları zincirleyebiliyor. Injection başarı oranları iyileşmiş olsa da çözülmekten uzak; araç kayıtları, izin sınırları, insan kontrol noktalarından oluşan kısıtlama katmanı, geliştiricilerin fiilen sahip olduğu kontrol. Bir benchmark puanı — özellikle de kendi kendine bildirilen biri — operasyonel hazır olmanın kanıtı değildir.

  • #openai
  • #ai-agents
  • #cybersecurity
  • #prompt-injection
  • #llm-safety

İlgili yazılar