deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak Vercel blog

OpenAI'nin GPT-6 Astra'sı agent işler için yayına girdi ve Kritik siber risk derecesi aldı

Uzun süreli agent görevleri için tasarlanan OpenAI'nin amiral gemisi GPT-6 Astra, Preparedness Framework kapsamında Kritik siber güvenlik derecesi aldı ve yayına girerken ek dağıtım kısıtlamaları beraberinde geldi.

OpenAI'nin GPT-6 Astra'sı agent işler için yayına girdi ve Kritik siber risk derecesi aldı

Ne yayına girdi

OpenAI, yazılım mühendisliği, bilgisayar ve tarayıcı kullanımı, bilimsel araştırma ve profesyonel iş akışlarındaki uzun süreli agent işlerine yönelik en yeni amiral gemisi büyük dil modeli GPT-6 Astra'yı yayınladı. dev.to'da yayınlanan bir siber risk analizine göre model, OpenAI'nin Preparedness Framework'ünde "Kritik" eşiğini de aştı; bu derece ek dağıtım kısıtlamalarını tetikliyor.

Dağıtım aşamalı ilerliyor. Astra önce sınırlı sayıda kuruluşa ulaşıyor; ChatGPT kullanıcıları ile OpenAI API ve AWS üzerinden daha geniş erişim planlanıyor. Kurumsal çalışma alanlarında model kapalı konumda geliyor ve yöneticilerin elle etkinleştirmesi gerekiyor. Geliştiriciler modeli API'de gpt-6-astra adıyla ya da Amazon Bedrock üzerinden çağırabiliyor; fiyat million input token başına 10 dolar, million output token başına 50 dolar. Pro, Business ve Enterprise aboneleri Astra Pro adlı bir varyant alıyor; OpenAI, uygun API müşterilerinin Zero Data Retention kullanabileceğini söylüyor.

Vercel kendi changelog'unda, Astra'nın AI Gateway üzerinde openai/gpt-6-astra tanımlayıcısıyla zaten yayında olduğunu ve Codex ile Cursor gibi kodlama agent'larını bağlamak için bir kurulum komutu bulunduğunu bildiriyor. Vercel, modelin yazılımlarda gezinebileceğini, formları doldurabileceğini, kayıtları düzenleyebileceğini, veri analiz edebileceğini, simülasyonlar çalıştırabileceğini ve web siteleri oluşturup test edebileceğini anlatıyor. Ayrıca gelişen görevlerde daha güçlü talip takibine dikkat çekiyor: Astra'nın yeni gereksinimleri öncekileri bırakmadan içselleştirdiği, açıklama beklerken de ilerlemeyi sürdürdüğü ve gerektiğinde makul varsayımlara dayanarak hareket ettiği belirtiliyor.

Derecenin arkasındaki benchmark'lar

dev.to analizine göre OpenAI, Astra'yı uzmanlaşmış exploit geliştirme benchmark'larından geçirdi. ExploitBench'te üretim güvenlik önlemleri olmadan yüzde 100 gibi kusursuz bir skor aldı; aynı karşılaştırmada selefi GPT-5.6 Sol yüzde 78,5'te kaldı; analiz ayrıca Sol'un bu benchmark'ta kendi lansmanında yüzde 73,5 elde ettiğini not ediyor. Daha geniş ExploitGym setinde Astra yüzde 42,4'e ulaşırken Sol'un yüzde 30,3'ünün önüne geçti ve daha az output token tüketti.

Ezberlemeyi dışlamak için OpenAI, modeli lansmandan önceki üç ayda açıklanan güvenlik açıklarına karşı da test etti. Astra bu süreçte iki yeni zero-day kusuru buldu; şirket bunları şu anda etkilenen yazılım üreticilerine bildiriyor. OpenAI bu yeteneği çift taraflı bir bıçak olarak çerçeveliyor: zayıflıkları bulup yamayan savunmacılar için değerli, ancak kötüye kullanıma karşı daha güçlü koruma bariyerleri gerektiriyor.

Greyhound Research baş analisti Sanchit Vir Gogia bir uyarı getiriyor. Kritik etiketini daha çok bir yetenek sıçraması değil, bir bilgilendirme olayı olarak okuyor: onun görüşüne göre önceki değerlendirmeler ile resmi bildirim arasında modelin kendisi değişmedi, değişen test metodolojisi oldu. Bunun doğal sonucu şu: kurumların içinde halihazırda çalışan diğer modeller, hiç ölçülmemiş benzer siber yetenekler taşıyor olabilir.

Koruma bariyerleri, kapsam ve izlenebilirlik

Herkese açık sürüm, proof-of-concept exploit üretimi dahil gelişmiş saldırı görevlerini kısıtlayacak. OpenAI önümüzdeki haftalarda Daybreak adlı bir program açarak, güvenlik açığı araştırması ve yama geliştirme gibi savunma çalışmaları için onaylı savunmacılara daha gevşek kısıtlamalar tanıyacak. dev.to analizi, benzer kötüye kullanım endişeleriyle ihracat pazarlarından kısa süreliğine çekilen Anthropic'nin Fable ve Mythos modellerine bir benzetme yapıyor.

Kapsam disiplini belirgin biçimde iyileşti. OpenAI, Hugging Face'le ilgili bir olaydan yola çıkarak yeni bir değerlendirme geliştirdi; bu değerlendirme modele imkânsız bir görev veriyor ve yetkili hedefinin ötesine geçip geçmediğini izliyor. Üretim güvenlik önlemleri olmadan GPT-5.6 Sol yüzde 48 oranında sınırı aşarken GPT-6 Astra bunu hiçbir vakada yapmadı (yüzde 0).

Bir ölçüt ters yöne hareket etti. OpenAI, Astra'nın chain-of-thought izlenebilirliğinin Sol'a göre daha zayıf olduğunu, yani modelin akıl yürütmesini açığa vurmaya daha az eğilimli olduğunu bildiriyor. Gogia ayrıca OpenAI'nin anlattığı izlemenin yalnızca kendi dış dağıtımını kapsadığına, telemetrinin müşterilere uzandığına dair kamuya açık bir işaret bulunmadığına dikkat çekiyor; dolayısıyla bir kuruluş Astra'yı OpenAI'nin yapabildiği biçimde denetleyemeyebilir.

Benimseyenler için yönetişim sorunu

Gogia'nın daha geniş argümanı şu: denetim modelin kendisinden onu çevreleyen harness'e kayıyor. Yanlış bir chatbot yanıtı bir bilgi sorunudur; müşteri kayıt sistemi içindeki yanlış bir agent eylemiyse doğrudan sonuçları olan operasyonel bir olaydır. Faydalı soru şuna dönüşüyor: bir denetim durdurmadan önce belirli bir kimlik ne kadar hasar verebilir?

Kanerika'da yapay zekâ geliştirme başkanı Amit Kumar Jena somut bir kör noktaya dikkat çekiyor: bir agent kullanıcı arayüzü üzerinden hareket ettiğinde, kayıtlar bunu sanki bir kişi yapmış gibi gösteriyor. 400 ERP satırını güncelleyen bir agent, arkasındaki prompt'u ya da model sürümünü hiç göstermeksizin 400 güncelleme yapan bir servis hesabı olarak görünür. Bu ayrıntı düzeyinin kaybı, denetçilerin ve düzenleyicilerin sistem değişikliklerinin kaynağını izlemesini zorlaştırıyor.

Neden önemli

Astra, günümüz yapay zekâsının en yüksek riskli kullanımına doğrudan nişan alan bir amiral gemisi: hataların bilgi değil operasyonel olduğu gerçek sistemlerin içindeki özerk, uzun süreli çalışma. Kritik derecesi, bir güvenlik çerçevesinin manuel kurumsal onaydan aşamalı yayına ve saldırı görevi kısıtlamalarına kadar dağıtım koşullarını doğrudan şekillendirdiğini gösteriyor. Ne var ki Gogia'nın okuması, etiketin yenilikten çok dikkati ölçtüğüne ve üretimde olan etiketsiz modellerin benzer yeteneklere sahip olabileceğine işaret ediyor. Astra'yı şu anda değerlendiren ekipler için pratik maddeler somut: million input ve output token başına 10 ve 50 dolar, Vercel'in AI Gateway'i ile Amazon Bedrock üzerinde erişilebilirlik, kurumlar için bilinçli olarak varsayılan kapalı tutulan bir konum ve Jena'nın ifadesiyle agent eylemlerini gerçekleştiren modele atfedecek şekilde henüz kurulmamış bir denetim izi.

  • #openai
  • #agentic-ai
  • #cybersecurity
  • #llm
  • #ai-safety

İlgili yazılar