· kaynak dev.to (home feed)
GPT-6 Astra API'ye ulaştı, ChatGPT Work Snowflake, BigQuery ve Redshift için Data Agent kazandı; traderlar ise Anthropic'e oynuyor
OpenAI, GPT-6 Astra'yı API müşterilerine açtı ve ChatGPT Work için Snowflake, BigQuery ve Redshift'i destekleyen bir Data Agent çıkardı; ancak Polymarket traderları en iyi yapay zekâ modeli piyasalarında hâlâ Anthropic'i açık ara önde fiyatlıyor.

OpenAI ne çıkardı
dev.to'daki bir analize göre OpenAI'nin 2026'daki en yoğun sürüm dönemi iki ürün etrafında şekillendi. GPT-6 Astra, şirketin bugüne kadarki en büyük eğitim çalışmasının ardından 3 Eylül'de API'ye ulaştı; gönderiye göre bu çalışmada Teksas'taki Stargate tesisinde 100.000'den fazla GPU kullanıldı. Girdi fiyatı milyon token başına 10 dolar ve gönderiye göre bu fiyat Claude Fable 5.1 ile tamamen aynı.
Bir hafta sonra, 10 Eylül'de, ChatGPT Work doğal dille sorulan analitik sorularını Snowflake, BigQuery ve Redshift bağlantıları üzerinden yanıtlayan bir Data Agent kazandı. Gönderinin çoğu haberciliğin gözden kaçırdığını savunduğu bir ayrıntı: agent, Astra değil GPT-5.6 üzerine inşa edilmiş. Sam Altman ayrıca, eylül ortası olarak vaat edilen lansman bir hafta kaydıktan sonra, 29 Eylül'deki DevDay için yeni duyurulara imada bulundu.
Traderlar Anthropic'e desteği sürdürdü
Gönderinin merkezindeki gözlem, lansman yağmuruna rağmen Polymarket'in "en iyi yapay zekâ modeli" piyasalarının neredeyse hiç kımıldamaması. 18 Eylül itibarıyla gönderi, Anthropic'in Eylül için yüzde 98'e karşı OpenAI'nin yüzde 1, Ekim için yüzde 88'e karşı yüzde 2 ve 2026 yıl sonu için yüzde 72'ye karşı yüzde 10 seviyesinde fiyatlandığını bildiriyor. Anthropic'in Ekim oranları lansman haftasında tam 16,5 puan yükseldi. Gönderi, üç vadeli piyasadaki toplam likiditeyi kabaca 3,1 milyon dolar, günlük işlem hacmini ise yaklaşık 51.000 dolar olarak veriyor ve bunu, Temmuz'daki GPT-5.6 Sol'ün ardından art arda üçüncü, oranları değiştiremeyen OpenAI amiral gemisi lansmanı olarak sayıyor.
Benchmark'lar nerede duruyor
Gönderiye göre GPT-6 Astra, Artificial Analysis Intelligence Index'te 61 puan alırken Claude Fable 5.1 66 puan alıyor. Arena'nın en çok izlenen metin ve genel kategorilerinde Astra'nın hiç puanı yokken, Fable 5.1 1.231 puanla önde ve Claude Opus 5 Max 1.505 Elo ile genel liderlik tablosunun zirvesinde. Astra, 1.797 puanla WebDev Arena'da lider ve gönderi, Ekim WebDev piyasasının OpenAI'nin önde olduğu tek Polymarket yapay zekâ piyasası olduğunu, yüzde 62 ile, belirtiyor.
Bir de maliyet boyutu var: gönderiye göre Astra, görev başına kabaca yüzde 60 daha düşük maliyetle Fable 5.1'in coding-agent performansına ulaşıyor; bu, yüksek hacimli iş yükleri için gerçek bir avantaj, ancak tahmin piyasaları "en ucuz"u değil "en iyi"yi izliyor.
Geliştiriciler nasıl tepki verdi
Gönderiye göre Hacker News'teki Astra lansmanı tartışması Claude'un tahtından indirilmesinden çok fiyatlandırma ve siber güvenliğe odaklandı; sitede 178 puanla trend olan bir harness tasarımı çalışması ise bir modelin çevresindeki altyapının modelin kendisi kadar önemli olduğunu savundu. Analiz ayrıca OpenAI kurucu ortağı Andrej Karpathy'nin Anthropic'in geliştirici deneyimini bir paradigma değişimi olarak nitelemesine değiniyor ve Mayıs'a ait Ramp kart harcama verilerine atıf yapıyor: kurumsal harcamaların Anthropic'e giden kısmı yüzde 34,4 iken OpenAI'ninki yüzde 32,3 ve Anthropic benimsenmesi yıllık dört kat arttı.
Neden önemli
dev.to gönderisi, yapımcıların lansman duyurularını sinyal olarak görmeyi bırakması ve bunun yerine kör değerlendirme liderlik tablolarına ile SWE-Bench, LiveBench ve Intelligence Index gibi kurumsal benchmark'lara yaslanması gerektiğini savunuyor. Bu okumaya göre lansman haftasında kımıldamayan bir tahmin piyasasının kendisi bir bilgi ve Astra'nın görev başına daha düşük maliyeti bir geliştiricinin yine de onu seçmesinin pratik nedeni. Gönderi kendi düşüş senaryosunu da kabul ediyor: Polymarket hangi modelin kör testleri kazandığını ölçüyor, oysa OpenAI'nin Data Agent'ları, ChatGPT Work entegrasyonları ve kabaca 400 milyon aylık kullanıcısı bir liderlik tablosunun yakalayamayacağı dağıtım hamleleri. DevDay 29 Eylül'de yapılacak ve geliştiriciler bu rekabetin en iyi model mi yoksa en iyi platform mu hakkında olduğuna dair yakında yeni bir veri noktası edinecek. Bu haberin tek bir yorum gönderisine dayandığını, dolayısıyla piyasa ve benchmark rakamlarının bağımsız olarak doğrulanmış sayılar değil, gönderinin kendi raporlaması olduğunu unutmayın.
- #openai
- #gpt-6
- #anthropic
- #prediction-markets
- #chatgpt
- #api
İlgili yazılar
- OpenAI'ın ChatGPT'te Rakip Görüntü ve Ses Yapay Zekası Reklamlarını Engellediği İddia Ediliyor
- Dario Amodei, yapay zeka geliştirmenin 'sınırını tempolu ilerletmek' için bağımsız değerlendiriciler öneriyor
- Makale, GPT'nin cinsiyet önyargısının modeller güvenli hale geldikçe daha ince biçimlere dönüştürüldüğünü savunuyor