· kaynak dev.to (home feed)
Amazon Nova 2, Bedrock'ta Lite, Pro ve Omni sürümleriyle rakip modellerin altında fiyatla geldi
Amazon'un ikinci nesil Nova modelleri — Lite, Pro ve Omni — Bedrock'ta yayında; 1M token bağlam seçeneği, ayarlanabilir akıl yürütme derinliği ve rakip frontier modellerin oldukça altında token fiyatları sunuyor.

Amazon, Nova temel modellerinin ikinci neslini kullanıma sundu ve aileyi — Lite, Pro ve Omni — geliştiricilerin Amazon Bedrock üzerinden çağırabileceği üç varyanta ayırdı. dev.to'da yayımlanan bir geliştirici rehberine göre AWS, aileyi çıkarım maliyeti, throughput ve çok modlu (multimodal) işlemenin ham yetenek kadar önemli olduğu üretim yapay zekâ uygulamalarına yönelik konumlandırmış.
İş yüküne göre bölünmüş bir aile
Üç model, maliyet ve yetenek spektrumunun farklı noktalarında konumlanıyor. Nova 2 Lite yüksek hacimli, düşük maliyetli iş yükleri için ayarlanmış; Nova 2 Pro daha derin akıl yürütme ve karmaşık çok modlu görevlere odaklanıyor; Nova 2 Omni ise AWS'nin Any-to-Any dediği, bir moddaki girdinin birkaç farklı modda çıktı üretebildiği işleme için tasarlanmış.
Rehbere göre aile genelinde ilk Nova serisine kıyasla daha uzun bağlam pencereleri, 200'den fazla dil desteği, daha yüksek throughput, daha düşük çıkarım maliyetleri ve konuşma anlama yeteneği sunuluyor. Ortak yeni bir özellik ise extended thinking: geliştiricilerin istek başına akıl yürütme derinliğini yukarı veya aşağı ayarlamasına, yanıt kalitesini hız ve maliyetle takas etmesine imkân veriyor.
Hacim için Lite, akıl yürütme için Pro
Lite günlük iş yüklerine yönelik: chatbotlar, müşteri desteği, sınıflandırma, özetleme, belge işleme, içerik üretimi ve basit agent otomasyonu. Rehbere göre önceki Lite'tan en dikkat çekici değişiklik, extended thinking eklenmesi.
Kıyaslama iddiaları dev.to'nun aktardığı üzere Amazon'dan geliyor: Nova 2 Lite'ın 15 kıyaslamadan 13'ünde Claude Haiku 4.5 ile eşit ya da daha iyi performans gösterdiği, GPT-5 Mini'yi 17'de 11, Gemini Flash 2.5'i 18'de 14 kez geçtiği bildiriliyor. Rehber, sonuçların göreve, değerlendirme metodolojisine, prompting'e ve yapılandırmaya büyük ölçüde bağlı olduğunu, dolayısıyla bunların evrensel üstünlük kanıtı değil, Lite'ın hangi model kategorisinde yarıştığının göstergesi olduğu uyarısını yapıyor.
Daha üst kademe olan Pro; metin, görüntü, video ve konuşmayı kabul ediyor ve bir milyon token'lık bir bağlam penceresi taşıyor — uzun belgeler, kurumsal bilgi tabanları, büyük kod tabanları, araştırma iş akışları ve çok adımlı agentlar için yeterli. Ayrıca bilgi damıtımı (knowledge distillation) için öğretmen model olarak da kullanılabiliyor ve daha küçük, uzmanlaşmış modeller üretilmesine yardımcı olabiliyor. Amazon'un karşılaştırmalarına göre Pro; 16 kıyaslamadan 10'unda Claude Sonnet 4.5 ile eşit ya da daha iyi, GPT-5.1'de 16'nın 8'inde, Gemini 2.5 Pro'da 19'un 15'inde ve Gemini 3 Pro Preview'da 18'in 8'inde daha iyi.
Omni her-yerden-her-yere gidiyor
Omni farklı bir yol izliyor. Salt daha güçlü bir akıl yürütme modeli olmaktan ziyade, metin gibi bir girdinin metin, görüntü, konuşma veya video çıktılar üretebildiği iş akışları için tasarlanmış. Rehber aday kullanım alanları olarak görsel anlama, video analizi, görüntü düzenleme, medya hatlarını ve çok modlu agentları sayıyor ama Omni'nin varsayılan seçim olmadığını açıkça belirtiyor: metin ağırlıklı, maliyete duyarlı uygulamalar Lite'a, akıl yürütme ağırlıklı uygulamalar Pro'ya uyuyor. Omni ancak modların karışımı ürünün merkezindeydeğinde değer katıyor.
Asıl vaat fiyat
dev.to'nun aktardığı bir GoML karşılaştırmasına göre Nova 2 Lite milyonda girdi token'ı için yaklaşık 0,30 dolar, milyonda çıktı token'ı için 2,50 dolara mal olurken, Nova 2 Pro sırasıyla yaklaşık 1,25 ve 10 dolar. Aynı karşılaştırma Claude 4.5 Sonnet'i iki tarafta da milyonda token başına 12 dolar üstünde, GPT-5 Mini ve 5.1'i 8–10 dolar aralığında, Gemini 3 Pro'yu ise yaklaşık 18 dolarda listeliyor. Rehber, fiyatların zamanla değiştiği uyarısını yaparak geliştiricilerin bir maliyet modeli kurmadan önce güncel Bedrock fiyatlarını doğrulaması gerektiğini söylüyor.
Rehber ayrıca token başına etiket fiyatının tüm hikâye olmadığını savunuyor: latency, throughput, çıktı kalitesi, yeniden deneme oranları, araç çağrısı güvenilirliği ve başarılı görev başına maliyet de önemli. Bir işi doğru şekilde tamamlamak için birkaç denemeye ihtiyaç duyan ucuz bir model, ilk denemede başaran daha pahalı bir modelden fazla maliyetle sonuçlanabilir.
Odakta agent iş akışları
Rehberin öne çıkardığı keskin kullanım alanlarından biri agentic AI. Bilgi getirmesi, sonuçlar üzerinde akıl yürütmesi, harici araçlar çağırması, belge veya görüntüleri incelemesi ve sonraki adımına karar vermesi gereken bir agent, eski ve küçük modelleri zorluyor. Rehber, Nova 2'nin kontrollü akıl yürütmesinin bu çok adımlı zincirleri daha uygulanabilir kıldığını ve birleşik çok modlu desteğin iş akışı başına birbirine dikilen ayrı model sayısını azalttığını öne sürüyor — sınırlı akıl yürütme, daha az dil, daha küçük bağlam, az ya da hiç konuşma desteği ve parçalı mod işleme sunan Nova 1'e göre pratik yükseltme bu.
Neden önemli
Amazon, Bedrock iş yükleri için yalnızca başlık yeteneği değil fiyat-performans üzerinden yarışıyor. Lite ve Pro iddia edilen kıyaslama paritesini korursa — rakamlar satıcıdan geldiği için ekipler kendi görevlerinde yeniden test etmeli — Anthropic, OpenAI ve Google modellerine karşı token fiyatı farkı, yüksek hacimli uygulamaların maliyet modellerini yeniden şekillendirecek kadar geniş. Üç kademeli bölünme ekiplere daha temiz bir yükseltme yolu da veriyor: Lite ile başlayın, bağlam uzunluğu veya akıl yürütme derinliği darboğaz haline geldiğinde Pro'ya geçin ve Omni'ye ancak mod karışımının ürünün kendisi olduğu durumda uzanın.
- #amazon-bedrock
- #aws
- #foundation-models
- #llm
- #multimodal