· kaynak dev.to (home feed)
OpenAI'nin GPT-6.1 Sol ile Claude Sonnet 5.5 fiyatta eşit, bir gün arayla çıktı, benchmark paylaşmadılar
OpenAI'nin GPT-6.1 Sol ile Anthropic'in Claude Sonnet 5.5'i bir gün arayla, birim başına $2/$10 token fiyatıyla aynı maliyetle piyasaya çıktı; ancak iki taraf da doğrudan bir karşılaştırma benchmark'ı yayınlamadı.

Aynı etiket fiyatı, bir gün arayla
Anthropic, Claude Sonnet 5.5'i 28 Eylül 2026'da yayınladı; OpenAI ise ertesi gün, 29 Eylül'de GPT-6.1 Sol ile yanıt verdi. dev.to'da yayımlanan bir karşılaştırmaya göre her iki model de milyon input token başına $2 ve milyon output token başına $10 fiyatıyla listeleniyor; batch oranları da $1/$5 olarak eşit. Bu yakın zamanlamaya rağmen iki şirketten hiçbiri modelleri doğrudan karşılaştırmadı: OpenAI, GPT-6.1 Sol'u GPT-6 Sol, GPT-6 Astra, Claude Opus 5.5 ve Claude Fable 5.1 ile karşılaştırırken Anthropic, Sonnet 5.5'i Sonnet 5, Opus 5.5 ve GPT-6 Sol ile ölçtü — GPT-6.1 Sol, Anthropic ölçümlerini yaparken henüz mevcut olmadığı için önceki OpenAI modeli.
Faturaların gerçekten ayrıştığı yerler
Özdeş liste fiyatları özdeş faturalar anlamına gelmiyor. dev.to yazısı çeşitli ayrışmalara dikkat çekiyor:
- Cache okuma maliyeti GPT-6.1 Sol'da milyon token başına $0.10, Sonnet 5.5'te ise $0.20; bu, uzun system prompt'ları yeniden kullanan iş yüklerinde OpenAI lehine. Cache yazma GPT-6.1 Sol'da $2.50; Anthropic ise beş dakikalık cache için $2.50, bir saatlik için $4 alıyor.
- 272.000 input token'ın üzerindeki prompt'lar GPT-6.1 Sol'da isteğin tamamında daha yüksek oran tetikliyor — $4 input, $15 output — buna karşılık Sonnet 5.5, bir milyonluk token penceresinin tamamında standart fiyatlandırmayı koruyor. 5.000 token'lık yanıtlı 400.000 token'lık bir prompt, cache olmadan GPT-6.1 Sol'da yaklaşık $1.68, Sonnet 5.5'te $0.85 tutuyor.
- OpenAI, $4/$20 fiyatlı ücretli bir Fast katmanı satıyor ve bir "Ultrafast" katmanı duyuruldu; Sonnet 5.5'in hız katmanı yok.
- Context window'lar neredeyse eşit — GPT-6.1 Sol'da 922.000 input sınırıyla 1.050.000, Sonnet'te 1M — ve ikisi de output'u 128.000 token'da sınırlıyor, ancak Sonnet batch'te bir beta header ile 300K'ya ulaşıyor. Sonnet'in bilgi kesim tarihi Haziran 2026 olup GPT-6.1 Sol'un 30 Nisan 2026'sından sonra.
- Dağıtım farklı: GPT-6.1 Sol OpenRouter'da; Sonnet 5.5 ise Bedrock, Google Cloud, Microsoft Foundry ve AWS üzerindeki Claude Platform'da sunuluyor.
Uyuşmayan kurulumlarla çakışan iddialar
OpenAI, GPT-6.1 Sol'u Astra'nın standart token fiyatının beşte birine "Astra'ya yakın zekâ" sunduğu olarak konumlandırıyor. Lansman yazısı; orta efor.AutomationBench 1.0.6'yı (Opus 5.5'e karşı yaklaşık üçte bir maliyetle +2.2 puan, GPT-6 Sol'ye karşı +4.8), maksimum eforda Terminal-Bench Science 0.1'i (görev başına $5.47'ye karşılık Opus 5.5 için $23.21; GPT-6 Astra %68.1 ile hâlâ zirvede) ve çevrimdışı OSWorld 2.0'ı (yarı maliyetin altında GPT-6 Sol'ye karşı +7 puan) kaynak gösteriyor.
Anthropic'in öne çıkan iddiaları, Sonnet 5'e kıyasla %30'dan fazla hız ve görev başına %30'a varan daha düşük maliyet. Cognition tarafından yürütülen FrontierCode 1.1'de Sonnet 5.5, xhigh'ta %52.1 ve maksimumda %46.2 skor aldı; GPT-6 Sol ise %49.3'tü. Anthropic'e göre yüksek eforda Sonnet, GPT-6 Sol'nin en iyi skorunu yaklaşık beşte bir maliyetle eşliyor. Artificial Analysis'ın yürüttüğü GDPval-AA v2.1 ve AA-Briefcase v1.1'de Sonnet 5.5, 1487'ye karşı 1844 ve 1483'e karşı 1811 skor aldı.
dev.to'ya göre bu rakamlar tek bir tabloda birleştirilemiyor: OpenAI, AutomationBench'i kendi harness'inde orta eforla koşarken Anthropic'in özet tabloları Claude modelleri için maksimum efor kullanıyor; Anthropic, Sonnet 5.5 için Terminal-Bench Science'ta %59.9 raporlarken OpenAI, GPT-6.1 Sol'a ilişkin ham bir skor yayınlamadı; ve OpenAI çevrimdışı OSWorld 2.0'ı kullanırken Anthropic OSWorld 2.1 kullandı.
Üçüncü taraflar hâlâ eski OpenAI modelini test ediyor
En kapsamlı bağımsız karşılaştırma olan ve on değerlendirmeyi toplayan Artificial Analysis'ın Intelligence Index v4.3.2, Sonnet 5.5'i GPT-6.1 ile değil GPT-6 Sol ile eşleştiriyor. Sonnet her efor seviyesinde daha yüksek skor alıyor ancak aynı seviyede görev başına daha maliyetli: orta eforda görev başına $0.59 ile 41 indeksten, maksimumda $7.60 ile 56'ya kadar; GPT-6 Sol ise $0.25'te 40'tan $1.05'te 48'e. Maksimum eforda Sonnet saniyede 138 output token üretirken GPT-6 Sol için bu 76. dev.to'ya göre daha adil bir çapraz-efor eşleştirmesi, Sonnet 5.5'i yüksek eforda (indeks 47, $1.08) GPT-6 Sol'nin maksimumuyla (indeks 48, $1.05) karşılaştırıyor. OpenAI, GPT-6.1 Sol'un eşit veya daha düşük eforla GPT-6 Sol'yi geçtiğini iddia ettiğinden, bağımsız olarak ölçüldüğünde bu rakamlar değişebilir.
Neden önemli
Aynı liste fiyatıyla bir gün arayla çıkan iki frontier model, hiçbir satıcının gerçekte yapmadığı doğrudan bir karşılaştırmayı davet ediyor. Token başına fiyat ile görev başına maliyet arasındaki fark — token tüketimi, farklı varsayılan efor seviyeleri, caching ve uzun prompt ek ücretleriyle şekillenen — daha ucuz modelin tamamen iş yüküne bağlı olduğu anlamına geliyor. Değerlendiriciler GPT-6.1 Sol'u test edene kadar, dev.to'nun da belirttiği gibi tek güvenilir seçim yolu, ikisini kendi görevlerinizde çalıştırıp token başına değil, başarılı görev başına maliyeti ölçmek.
- #ai
- #llm
- #benchmarks
- #pricing
- #openai
- #anthropic