· kaynak dev.to (home feed)
OpenAI'ın GPT-6.1 Sol'u önbelleğe alınan girdi fiyatını yarıya indirdi, none reasoning effort desteğini kaldırdı
OpenAI, GPT-6.1 Sol'u DevDay 2026'da yayınladı; önbelleğe alınan girdi fiyatı milyonda token başına 0,20 dolardan 0,10 dolara düştü. Gpt-6-sol'dan geçiş çoğunlukla bir model ID değişimi olsa da, reasoning.effort artık none veya minimal değerlerini kabul etmiyor.

OpenAI ne yayınladı
OpenAI, 29 Eylül 2026'daki DevDay etkinliğinde GPT-6.1 Sol'u tanıttı; dev.to'da yayımlanan geliştirici rehberleri bunu aktarıyor. Bu sürüm, yeni bir model ailesi değil, GPT-6 Sol'a yönelik artımlı bir güncelleme: standart fiyatlandırma, bağlam penceresi, endpoint'ler ve hız limitleri aynen korunuyor. İki somut değişiklik var: önbelleğe alınan girdi fiyatının yarıya indirilmesi ve daha önce desteklenen iki değeri kaldıran sıkılaştırılmış bir reasoning-effort API'si.
Fiyatlandırma: tek sayı değişiyor
OpenAI'nin model ve fiyatlandırma sayfalarını derleyen dev.to rehberleri, milyonda token başına şu ücretleri bildiriyor. Standart girdi 2 dolarda, çıktı 10 dolarda kalıyor; GPT-6 Sol ile aynı. Önbelleğe alınan girdi 0,20 dolardan 0,10 dolara düşerken, önbellek yazma ücreti 2,50 dolarda sabit kalıyor. Bağlam penceresi, maksimum girdi ve maksimum çıktı sırasıyla 1.050.000, 922.000 ve 128.000 token olarak değişmedi.
Dev.to dökümüne göre kademeli fiyatlandırma aynı yapıyı koruyor: Batch ve Flex için girdi 1 dolar, önbelleğe alınan girdi 0,05 dolar, önbellek yazma 1,25 dolar ve çıktı 5 dolar; Fast için girdi 4 dolar, önbelleğe alınan girdi 0,20 dolar, yazma 5 dolar ve çıktı 20 dolar. Çok uzun prompt'lara bir ek ücret uygulanıyor: 272.000 girdi tokenını aşan istekler, isteğin tamamı için girdi ve önbellek ücretlerinin iki katı, çıktı ücretinin 1,5 katı üzerinden faturalanıyor.
Hız limitlerine dokunulmadı: Tier 1 dakikada 500 istek ve 500.000 token, Tier 5 ise 15.000 RPM ve 40 milyon TPM.
Breaking change: reasoning.effort
Mevcut kod için temel uyumluluk sorunu, GPT-6.1 Sol'un reasoning.effort için artık none veya minimal değerlerini kabul etmemesi. Dev.to rehberlerinin aktardığı OpenAI yönlendirmesi, her ikisini de low ile eşlemek ve none'a dayanan pipeline'ları yeniden değerlendirmek yönünde. Kabul edilen değerler artık low, medium (varsayılan), high, xhigh ve max.
Bu durum function calling ile etkileşime giriyor. GPT-6 Sol'da Chat Completions, yalnızca reasoning_effort none olarak ayarlandığında tool call'ları destekliyordu. GPT-6.1 Sol'da buna denk bir kombinasyon yok; dolayısıyla araç kullanan her iş akışı Responses API'ye geçmek zorunda, Chat Completions yalnızca araç içermeyen istekler için kullanılabilecek.
Geliştiriciler ayrıca effort none olmadığında sampling parametrelerini (temperature, top_p, top_logprobs ve Chat Completions'taki logprobs) kaldırmalı. Daha önce temperature'ı reasoning_effort none ile birlikte kullanan kodlarda bu eşleştirmenin çıkarılması gerekiyor.
Bir davranışsal kaydırma daha: bilgi kesim tarihi (knowledge cutoff) 20 Nisan'dan 30 Nisan 2026'ya taşındı; bu nedenle tarihe duyarlı değerlendirmeler geçişten sonra yeniden çalıştırılmalı.
Dört adımda geçiş
Dev.to rehberleri, gpt-6-sol'dan geçişi dört kod değişikliğine indiriyor:
- Model ID'yi gpt-6.1-sol olarak değiştirin; geri alma tek bir düzenleme olsun diye bunu konfigürasyonda veya bir ortam değişkeninde tutun.
- none ve minimal değerlerini low ile eşleyin, sonra trafiği kaydırmadan önce temsili değerlendirmeler çalıştırın.
- Yukarıda listelenen uyumsuz sampling parametrelerini kaldırın.
- Araç çağıran akışları Chat Completions'tan Responses API'ye taşıyın.
Rehberler ayrıca bilinmesinde yarar olan operasyonel ayrıntıları vurguluyor: istekler gpt-6.1-sol model dizesiyle /v1/responses endpoint'ine gidiyor; OpenAI'nin reasoning dokümantasyonu, denemeler sırasında reasoning ve çıktı için en az 25.000 token ayırılmasını öneriyor; yanıtlar, görünür metin üretmeden önce max_output_tokens nedeniyle incomplete olarak dönebiliyor. Prompt cache'i geçersiz kılmadan konuşma ortasında effort'ı değiştirmek için rehberler, istek düzeyinde reasoning.effort'u değiştirmek yerine bir configuration_update girdi öğesi kullanılmasını öneriyor. Kullanım raporlaması cached_tokens, cache_write_tokens ve reasoning_tokens değerlerini ortaya koyuyor; bu da daha ucuz önbelleği doğrudan ölçülebilir kılıyor.
Bildirilen benchmark sonuçları
Rehberler, GPT-6.1 Sol için OpenAI'nin lansman rakamlarına atıf yapıyor. Low effort'ta, kullanıcıların işaretlediği konuşmalarda gerçek bilgilendirici hata içeren yanıt oranı GPT-6 Sol'daki %11,4'ten %7,7'ye düşüyor. Medium'da AutomationBench 1.0.6, kabaca üçte bir maliyetle Claude Opus 5.5'e karşı 2,2 puanlık ve aynı konfigürasyonda GPT-6 Sol'a karşı 4,8 puanlık kazanç gösteriyor. Max'ta OSWorld 2.0, GPT-6 Sol'a karşı maliyetin yarısından azıyla 7 puan iyileşiyor ve Terminal-Bench Science 0.1 görev başına 5,47 dolara mal olurken, Opus 5.5 için bu 23,21 dolar, GPT-6 Astra için 23,80 dolar.
Rehberler iki uyarı ekliyor: gerçeklik (factuality) seti tipik trafikten ziyade daha önce işaretlenmiş konuşmalardan oluşuyor ve Terminal-Bench Science'ta en yüksek puanı hâlâ %68,1 ile GPT-6 Astra alıyor; OpenAI, en zor bilimsel işler için Astra'yı öneriyor.
Neden önemli
Halihazırda GPT-6 Sol kullanan ekipler için bu, gerçek bir maliyet kaldıracı sunan düşük sürtünmeli bir sürüm. Milyonda token başına 0,10 dolarlık önbelleğe alınan girdi, prompt caching'i agresif şekilde ödüllendiriyor; bu da büyük sistem prompt'larını yeniden gönderen agentic ve uzun bağlamlı iş yükleri için en çok önem taşıyor. Sürtünme tek bir yerde yoğunlaşıyor: reasoning_effort none üzerine kurulan her şey — özellikle Chat Completions function calling — bir dize değişikliği değil, yeniden çalışma gerektiriyor. Low effort'ta yeniden değerlendirme yapan ve araçlarını Responses API'ye taşıyan ekipler sürpriz yaşamadan fiyat indiririmini alırken, değişmeyen hız limitleri ve bağlam penceresi kapasite yeniden planlaması gerektirmediği anlamına geliyor.
- #openai
- #llm
- #api
- #pricing
- #developer-tools
İlgili yazılar
- GPT-6.1 Sol token fiyatlarını sabit tutuyor, cache'lenmiş girdiyi yarıya indiriyor, none effort seviyesini kaldırıyor
- OpenAI'nin GPT-6.1 Sol ile Claude Sonnet 5.5 fiyatta eşit, bir gün arayla çıktı, benchmark paylaşmadılar
- OpenAI DevDay, ChatGPT'e ofis paketi özellikleri, uygulama pluginleri ve kalıcı Codex cloud ortamları getiriyor