deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak TechCrunch

OpenAI, GPT-6 Sol ve Luna'yı yarı fiyatla ve daha az gerçek hatasıyla kullanıma sundu

OpenAI'nin güncellenen GPT-6 Sol ve Luna modelleri, 5.6 serisinin yarısı kadar fiyata sunuluyor ve gerçek hataları kabaca yarıya indiriyor; modeller, Anthropic'in Opus 5.5 sürümünden 90 dakika sonra geldi.

OpenAI, GPT-6 Sol ve Luna'yı yarı fiyatla ve daha az gerçek hatasıyla kullanıma sundu

OpenAI, GPT-6 ailesini daha küçük Sol ve Luna modellerinin yenilenmiş sürümleriyle genişletti; şirkete göre bu modeller öncüllerinin yarısı kadar işletme maliyetine sahip ve daha az hata yapıyor. TechCrunch'a göre lansman, bu ayın başında yayınlanan ve OpenAI tarafından şimdiye kadarki en güçlü model olarak konumlandırılan GPT-6 Astra'nın ardından geldi.

İki tür iş için iki kademe

Yıl başında tanıtılan Sol ve Luna, OpenAI'nin model hiyerarşisinde farklı noktalarda yer alıyor. Sol, kodlama gibi zorlu işler için tasarlanırken Luna, OpenAI'nin ofis işi tarzı olarak tanımladığı görevlere odaklanıyor: belgeleri özetlemek, belirli bilgileri çıkarmak veya hızlı soruları yanıtlamak gibi sonucu net tanımlanmış, yüksek hacimli görevler.

Açıklamasında OpenAI, yeni sürümleri Astra'nın ötesine geçen bir sıçrama değil, onun bir uzantısı olarak çerçeveledi. Şirket, amiral gemisi modelin "yeni bir zeka nesli sunduğunu" ve bu modellerin bu zekayı "daha verimli ve erişilebilir" hale getirdiğini belirtti.

Fiyat yarıya indirildi

Geliştiriciler için öne çıkan değişiklik maliyet. TechCrunch'ın haberine göre GPT-6 serisi Sol ve Luna, 5.6 serisinin yarısı fiyatına sunuluyor; OpenAI bu indirimi caching ve çıkarım (inference) alanındaki gelişmelere bağlıyor. Yüksek hacimli API çağrıları çalıştıran ekipler için bu kadar geniş bir fark, üretime çıkmada hangi modellerin ekonomik olduğu hesabını değiştirebilir.

OpenAI'nin kendi ölçümlerine göre daha az hata

OpenAI doğruluk kazanımları da iddia ediyor. Şirket, yeni modellerin daha gerçekçi doğru yanıtlar ürettiğini ve kodlama görevlerinde daha düşük hata oranına sahip olduğunu söylüyor. OpenAI, gerçekçilik iddiasını, kullanıcıların modellerinin hatalarını işaretlediği kimliği anonimleştirilmiş gerçek diyaloglardan oluşturulmuş dahili bir değerlendirmeyle ölçüledi. OpenAI, bu ölçekte GPT-6 Sol'ün öncülüne kıyasla kabaca yarısı kadar hata yaptığını ve "çok daha düşük maliyetle Astra seviyesinde güvenilirliğe" ulaştığını söyledi.

Bunlar OpenAI'nin kendi rakamları. Duyuruda bağımsız ölçek (benchmark) sonuçlarına yer verilmediği için karşılaştırmalar satıcı iddiası olarak okunmalı.

Anthropic yarışında doksan dakikalık fark

Önceki lansmanlarda olduğu gibi OpenAI, yeni Sol ve Luna modellerinin başlıca rakibi Anthropic'in en üst modellerinden — özel olarak Fable ve Opus'tan — önemli ölçüde daha iyi görevler yerine getirdiğini öne sürdü. Rekabetçi zamanlamanın gözden kaçması zor: TechCrunch'a göre Anthropic, Opus 5.5'in yeni bir sürümünü OpenAI'nin lansmanından tam doksan dakika önce yayınladı ve bu durum iki şirketin birbirlerinin lansman döngülerini ne yakından izlediğini gözler önüne seriyor.

Modeller nerede kullanılabiliyor

Güncellenen Sol ve Luna şu anda ChatGPT Work ve Codex'te çoğu ücretli hesap için ve ChatGPT API üzerinden kullanılabiliyor. Luna ayrıca masaüstü uygulamasına ve Free ile Go kullanıcılarına da ulaşıyor. OpenAI, modellerin gün boyunca ChatGPT uygulamasına ve web sitesine kademeli olarak yayılmasını beklediğini söyledi.

Neden önemli

İki şey bu sürümü rutin bir ara dönem yenilemesinden fazlası yapıyor. Birincisi, Sol ve Luna'nın API fiyatının yarıya indirilmesi, üretim yapay zeka iş yükleri için maliyet tabanını düşürüyor; bu da ölçekli çalışan hatlarda küçük modellerin pahalı amiral gemilerinin yerini alıp alamayacağını tartan geliştiriciler için önemli. İkincisi, güvenilirlik — burada kullanıcıların gerçek hataları yakalama oranı olarak ölçülüyor — dil modellerinin ofis ve kodlama iş akışlarında devreye alınmasının önündeki başlıca engellerden biri olmaya devam ediyor. OpenAI'nin dahili rakamları laboratuvar dışında da tutarsa, Sol'ün artık çok daha düşük bir maliyetle Astra seviyesinde güvenilirlik sunduğu iddiası, çok geniş bir uygulama yelpazesi için değer denklemini değiştirir. Anthropic'in bir saat içinde karşılık vermesiyle model yarışının hızı da yavaşlama belirtisi göstermiyor.

  • #openai
  • #gpt-6
  • #large-language-models
  • #api
  • #anthropic

İlgili yazılar