deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak Vercel blog

Alibaba'nın 1M token bağlam pencereli Qwen 3.8 Flash modeli Vercel AI Gateway'de

Alibaba'nın çok modlu modeli Qwen 3.8 Flash, 1 milyon tokenlık bağlam penceresi ve 65 bin tokenlık çıktı kapasitesiyle artık Vercel'in AI Gateway'i üzerinden, inference üzerine hiçbir ek ücret olmadan kullanılabiliyor.

Alibaba'nın 1M token bağlam pencereli Qwen 3.8 Flash modeli Vercel AI Gateway'de

Neler yayına alındı

Vercel, Alibaba'nın Qwen 3.8 Flash modelini AI Gateway üzerinden sunulan modellere ekledi. Vercel bloguna göre model hem metin hem de görsel girdisi alıyor, 1 milyon tokenlık bir bağlam penceresi sunuyor ve tek bir yanıtta 65.000 token'a kadar çıktı verebiliyor. Alibaba, modeli kodlama, araç kullanımı ve çok adımlı agent iş akışları için öneriyor; bu da onu, gateway altyapısının giderek daha fazla hizmet verdiği agent ağırlıklı iş yükleri için doğal bir seçim haline getiriyor.

Nasıl kullanılır

Geliştiriciler, AI SDK içinde modeli alibaba/qwen3.8-flash tanımlayıcısıyla çağırıyor. Vercel'in örneği, ne kadar az kod gerektiğini gösteriyor: model dizesi ve bir prompt ile streamText çağrısı yapmak — örneğin modelden bir sonuç endpoint'ine sayfalama (pagination) eklemesini istemek — çıktıyı akışla almaya başlamak için yeterli.

Kodlama agent'ları için Vercel, kodlama agent'ları rehberine işaret ediyor ve Claude Code, Codex, OpenCode, Cursor ile Pi gibi araçları bağlayan vercel ai-gateway coding-agents setup kurulum komutunu sunuyor. Kurulumun ardından agent içinden alibaba/qwen3.8-flash'ı seçiyorsunuz. Modeli üretim koduna bağlamadan önce denemek için bir model playground'u da mevcut.

AI Gateway etrafına neler ekliyor

AI Gateway, Vercel'in birden çok sağlayıcıdan model çağırmak için sunduğu birleşik API katmanı. Vercel bloguna göre, kullanım ve maliyet takibi, yeniden denemeler (retry), failover ve sağlayıcıya doğrudan bağlanmaktan daha yüksek çalışma süresi (uptime) sağlamayı hedefleyen performans optimizasyonlarını üstleniyor. Ek özellikler arasında yerleşik özel raporlama, Zero Data Retention desteği, bireysel API anahtarlarına göre belirlenen bütçeler ve yönlendirme kuralları yer alıyor.

Fiyatlandırma konusunda Vercel, gateway'in sağlayıcı fiyatlarını ek ücret olmadan yansıttığını ve inference üzerinden hiçbir platform ücreti almadığını söylüyor — bu, geliştiricilerin kendi sağlayıcı kimlik bilgilerini kullandığı Bring Your Own Key istekleri için de geçerli.

Neden önemli

1 milyon tokenlık bir bağlam penceresi ile 65.000 tokenlık bir çıktı bütçesinin bir araya gelmesi, agent geliştiricileri için pratik bir kombinasyon. Uzun konuşma geçmişleri, geniş kod tabanları ve çok adımlı araç çağrılarının biriken izleri bağlamı hızla tüketiyor; 1M tokenla Qwen 3.8 Flash, bu malzemeyi modele göndermeden önce kesme, özetleme veya parçalara bölme ihtiyacını azaltıyor. Büyük bir çıktı tavanı da önemli; çünkü tam dosya yeniden yazımı veya kapsamlı diff'ler gibi kod üretme görevleri tek bir turda uzun sürebiliyor.

Dağıtım kanalı, modelin kendisi kadar önemli. AI Gateway'e gelmesiyle Qwen 3.8 Flash, model trafiğini zaten Vercel üzerinden yönlendiren herkes için hazır bir seçenek haline geliyor: benimsenmesi yeni bir entegrasyon değil, yalnızca model dizesinde yapılacak bir değişiklik; bütçeler, yönlendirme kuralları ve failover gibi gateway özellikleri ise ilk günden itibaren geçerli. Kodlama ve agent işleri için model değerlendiren ekipler için bu, deneme maliyetini düşürüyor. Alibaba içinse Qwen'i, aksi halde daha iyi bilinen Batlı sağlayıcılara yönelme eğiliminde olabilecek bir geliştirici kitlesinin önüne çıkarıyor.

  • #alibaba
  • #qwen
  • #vercel
  • #ai-gateway
  • #llm
  • #coding-agents

İlgili yazılar