deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak Vercel blog

OpenAI Decisions API, metin yerine tipli seçimler ve güven skorları döndürüyor

OpenAI'nin Decisions API'si sınırlı soruları sabit bir seçenek listesinden bir seçim ve bir güven değeriyle yanıtlıyor; Vercel'in AI Gateway'i de artık bunu GPT-6 Luna Decisions ile birlikte sunuyor.

OpenAI Decisions API, metin yerine tipli seçimler ve güven skorları döndürüyor

Vercel, OpenAI'nin Decisions API'sini AI Gateway'e ekledi; böylece geliştiriciler, sınırlı ve tipli soruları üretilmiş düz metin yerine yapılandırılmış çıktıyla yanıtlayan bir model arayüzüne kavuştu. Bu hamle, yapay zekâ uygulama tasarımındaki büyüyen bir boşluğa işaret ediyor: Bugün chat modellerine yaptırılan işlerin önemli bir kısmı aslında bir sınıflandırma问题idir ve metin üretimi bunun için verimsiz bir zemin.

Decisions API ne döndürüyor

Vercel'in changelog kaydına göre decision modelleri, ortak bir girdi hakkındaki tipli soruları yanıtlıyor ve serbest biçimli metin yerine olasılıklar, seçimler ve skorlar döndürüyor; şirket bunun yönlendirme (routing), triyaj, guardrail ve rubrik puanlamaya uygun olduğunu söylüyor. Tek bir istek, aynı girdiye karşı üç soru türü taşıyabiliyor: predicate (evet/hayır), choice ve score.

AWS'nin dev.to'da yayımladığı bir anlatım, agent geliştiricileri için en önemli özelliği vurguluyor: Döndürülen seçim, her zaman sizin sağladığınız seçeneklerden biri. Bir girdi ve sabit bir aday seçenek listesi geçiriyorsunuz; her seçeneğin bir değeri ve açıklaması var ve API bunlardan birini bir güven değeriyle birlikte döndürüyor. Ayrıştırılacak üretilmiş metin yok ve modelin var olmayan bir seçenek uydurma riski de yok.

AI Gateway üzerindeki kullanılabilirlik

Vercel, API'yi AI Gateway üzerinde OpenAI uyumlu bir /v1/decisions endpoint'i üzerinden sunuyor; GPT-6 Luna Decisions veya katalogdaki diğer decision modelleriyle kullanılabiliyor. Vercel'e göre openai/gpt-6-luna-decisions, openai/gpt-6-luna'dan ayrı bir model kimliği;后者 metin üretimi için bir dil modeli olarak kalıyor. Decisions kimliğine yapılan istekler Decisions API'ye yönlendiriliyor ve onun tarifeleri üzerinden faturalandırılıyor.

Vercel, çağırmanın birkaç yolunu listeliyor: OpenAI SDK, AI SDK, /v1/evaluate üzerinde bir HTTP API veya AI CLI. Sürüm gereksinimleri geçerli — decisions.create için JavaScript'te OpenAI SDK 7.30.0 veya üzeri, Python'da 3.26.0 veya üzeri gerekirken, AI SDK'nın experimental_decide yardımcısı ai 7.0.128 veya üzerini gerektiriyor. AI SDK'da sorular isme göre anahtarlanıyor, evet/hayır türü boolean olarak adlandırılıyor ve yanıtlar soru sırasına göre bir dizi olarak geri geliyor; her biri ilgili sorunun adını taşıyor. Gateway'deki diğer decision modelleri arasında Jev, Liquid d1 ve Laya var.

Sahadan iki agent deseni

dev.to anlatımı, API'yi Strands Agents'a iki şekilde bağlıyor; her ikisi de aynı tek çağrı üzerine kurulu.

İlki, model çalışmadan önce araç kutusunu daraltıyor. 40 örtüşen araca sahip küçük bir model yanlış aracı seçebilir veya var olmayan bir isim halüsinasyonu görebilir; ayrıca her araç tanımı her turda token maliyeti getiriyor. Bir Strands hook'u (BeforeModelCallEvent) önce Decisions API'ye danışıyor ve agent'ın araç kaydını yalnızca seçilen tek araçla değiştiriyor. Demoda, 40 araçlık bir havuz üzerinde get_hotel_room_rates ve get_weather_forecast gibi seçimler 0.97 ile 1.00 arasında güven değerleriyle geri döndü.

İkinci kullanım, modelin kendisini seçiyor. Strands'ın ModelRouter'ı takılabilir bir yönlendirme stratejisi kabul ediyor; anlatım bunlardan birini, adaylarının API'nin seçimleri haline geldiği bir strateji uyguluyor ve decision modeli, her adayın açıklamasına dayanarak o turu hangi modelin hizmet etmesi gerektiğine karar veriyor. Rutin aramalar küçük modele, bir migration tasarlama veya kilitleme stratejilerini karşılaştırma gibi daha zor istekler ise daha güçlü modele düştü; güven değerleri 0.98 ile 1.0 arasındaydı.

Benimsemeden önce kontrol edilmesi gereken bir ayrıntı: dev.to örnekleri modeli OpenAI client üzerinden doğrudan gpt-6-luna olarak çağırırken, Vercel'in gateway'i decision varyantını ayrı bir -decisions model kimliği altında katalogluyor. Hangi dizgiyi kullanacağınız, hangi yüzezi hedeflediğinize bağlı.

Neden önemli

Seçim problemleri — hangi araç, hangi model, hangi kuyruk, bu istek güvenli mi — agent mimarilerinin merkezinde yer alıyor ve bugün genellikle bir chat modele prompt verip metnini ayrıştırarak çözülüyor. Sağlanan bir listeden bir seçimi, eklenmiş kalibre edilmiş bir güven değeriyle garanti eden bir API, hem ayrıştırma kırılganlığını hem de uydurulmuş seçenekler başarısızlık modunu ortadan kaldırıyor. Ayrıca faturalandırmayı ve model semantiğini ayırıyor: sınırlı kararlar için ucuz, hızlı bir seçici ve gerçek üretim için ayrılmış üreticiler. Vercel'in bunu AI Gateway üzerinde çok modelli desteğin yanında sunmasıyla, yönlendirme ve triyaj mantığı artık bir metin modelini ilkel gibi davlanmaya ikna etmek yerine, amacına göre yapılmış bir primitive üzerine inşa edilebilir.

  • #openai
  • #vercel
  • #ai-gateway
  • #ai-agents
  • #llm-routing
  • #api

İlgili yazılar