deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak dev.to (home feed)

Z.ai'nin gizli ox-alpha modeli, milyon token başına sent fiyatla GLM-5.3-Flash olarak yayına girdi

OpenRouter ve OpenCode üzerinde trilyonlarca önizleme tokenı sunan ücretsiz gizemli model, Z.ai'nin açık ağırlıklı GLM-5.3-Flash'ı olarak yayına girdi; barındırma fiyatı milyon girdi tokenı başına 0,07 dolar.

Z.ai'nin gizli ox-alpha modeli, milyon token başına sent fiyatla GLM-5.3-Flash olarak yayına girdi

Gizli önizleme GLM-5.3-Flash'a dönüşüyor

OpenRouter.AI ve OpenCode.AI üzerinde "ox-alpha" etiketiyle ortaya çıkan markasız model, Z.ai'den yeni bir açık ağırlıklı sürüm olan GLM-5.3-Flash olarak ortaya çıktı. 28 Ağustos 2026'da yayımlanan bir dev.to yazısına göre, geliştirici simbo1905 kullanıcıların ücretsiz önizlemenin çok modlu bir Z.ai modeli olduğunu çoktan çözdüğünü; asıl bilmeceyi bir bedava dağıtımın bu trafiği nasıl karşılayabildiğinin oluşturduğunu belirtiyor. Yazar, tek günlük önizleme kullanımının kabaca 5,8 trilyon prompt tokenı ve yaklaşık 94 milyar tamamlama tokenı olduğunu aktarıyor.\n Model yayına girdiğine göre onun açıklaması şu: Bu kadar verimli bir Flash sınıfı modeli sunmak gerçekten çok pahalıya mal olmuyor.

Fiyatlandırma ve barındırma

GLM-5.3-Flash, San Francisco merkezli OpenCode.AI firmasının işlettiği ABD donanımında barındırılıyor. Dev.to yazısı, girdi fiyatını milyon token başına 0,07 dolar, çıktı fiyatını ise milyon token başına 0,25 dolar olarak listeliyor. Model açık ağırlıklı olduğundan, işletmeciler tek bir sağlayıcıya bağlı kalmak yerine modeli kendi altyapılarında da çalıştırabilir.

Şaka testi

Yazının en sıra dışı iddiası şakalarla ilgili. Yazar, modeli Rust tabanlı, Apache-2.0 lisanslı bir kodlama ajanının kişisel fork'u üzerinden test ederek ondan bir şaka istemiş ve modelin anında bir şaka uydurduğunu — ama sırıttığını belirtiyor. Onun deneyiminde, mevcut modellerin çoğu hangi araçta çalışırlarlarsa çalışsınlar bu prompta aynı ezberlenmiş birkaç şakayla karşılık veriyor.

Bu başarısızlığı olumlu bir sinyal olarak okuyor: Bilinen malzemeyi tekrarlamak yerine yeni bir kurulum deneen model, arka planda farklı bir şey yapıyor demektir ve yazar bu davranışı kusur değil özellik olarak nitelendiriyor. Bu kontrollü bir benchmark değil, tek bir geliştiricinin gayri resmi deneyi; ancak benzer yardımcılar arasındaki davranışsal farkları sınamanın ucuz bir yolu.

Cebinizdeki bozuk parayla gece boyu ajanlar

Yazıdaki pratik mesele maliyet. Yazar, OpenCode.AI'nin kodlama ajanını mevcut projelerinin tamamında bütün gece çalıştırdığını, bunlara on iki saatten fazla süren büyük bir depo temizliğinin de dahil olduğunu anlatıyor. Tek bir hata düzeltme görevinde 0,02 dolardan fazla harcamadığını, bu koşu için toplam 0,47 dolar ödediğini ve daha önceki bir gece seansının, mahallesindeki Gail's Bakery'den alınan bir kahveden daha ucuza mal olduğunu söylüyor.

Karşılaştırma asıl burada ortaya çıkıyor. Kimi K3'e işi incelettiğini ve yalnızca git diff'e bakmanın bile on kat fazla tuttuğunu belirtiyor. Yazı ayrıca Theo.gg'den, ox-alpha'yı uzun süreli ajan görevlerinde Claude Opus ve OpenAI Sol ile yan yana koyan 45 dakikalık bir incelemeye işaret ediyor.

Neden önemli

Ucuz açık ağırlıklı modeller ajan temelli kodlamanın ekonomisini değiştiriyor. Yazarın aktardığı gibi, bir dolardan ucuza mal olan on iki saatlik otonom bir koşu, her zaman açık ajanları bireyler ve küçük ekipler için tipik token başına frontier fiyatlandırmasının hiç olmadığı biçimde gerçekçi kılıyor. Ayrıca doğrulamayı izlenecek bütçe kalemi haline getiriyor: İncelemeyi yapan model, işi yapan modelden bir mertebep pahalıysa, inceleme adımı sürecin pahalı parçası oluyor.

Bu lansman aynı zamanda gizli önizleme taktiğini de sergiliyor. Markasız bir modeli ücretsiz dağıtmak, trilyonlarca tokenlık gerçek dünya kullanımı ve kökenine dair topluluk tahminleri üretti; böylece resmi duyuru hazır bir izleyici kitlesiyle karşılandı.

Uyarılar geçerli. Buradaki her rakam tek bir geliştiricinin birinci elden anlatımından geliyor ve uydurma şaka anekdotu genel bir özelliğin kanıtı değil, tek bir veri noktası. Ancak GLM-5.3-Flash erken incelemecilerinin iddia ettiği kalite düzeyini korursa, fiyatlandırması kapalı modelli mevcut oyuncular üzerinde gerçek bir baskı yaratıyor.

  • #z-ai
  • #glm
  • #open-weights
  • #openrouter
  • #coding-agents

İlgili yazılar