· kaynak dev.to (home feed)
TypeSafe AI'ın Jev'i Yanıtlayabileceklerini Kısıtlayarak Sıfır Halüsinasyon Vaat Ediyor
Erken erişime açılan TypeSafe AI Jev modeli, metin yerine olasılık dağılımlarıyla birlikte tipli kararlar döndürüyor ve sıfır halüsinasyon iddiası bu kapalı cevap uzayına dayanıyor.

TypeSafe AI, yeni modeli Jev'i 15 Eylül 2026'da erken erişime açtı ve ürün sayfası dikkat çekici bir ikiliyle başlıyor: göz alıcı gecikme ve maliyet rakamlarının yanında "Sıfır Halüsinasyon" ifadesi. TypeSafe'ın lansman duyurunu, dokümantasyonunu, API sözleşmesini, SDK'larını ve başarısızlık senaryoları notlarını inceleyen miruky'nin dev.to'da yayımladığı ayrıntılı bağımsız inceleme, iddianın gerçek olduğunu ama kulağa geldiğinden çok daha dar kapsamlı olduğunu savunuyor.
Bir karar motoru, üretici değil
Jev, TypeSafe'ın amiral gemisi modeli olarak konumlandırılıyor ve şirketin "System One modelleri" diye adlandırdığı kategorinin ilk üyesi; bu ad, Daniel Kahneman'ın düşünmedeki hızlı ve yavaş ayrımına bir gönderme. İsim, iktisatçı William Stanley Jevons'tan geliyor ve TypeSafe bunu Jevons paradoksuyla bağlıyor: daha ucuz zeka, zekaya yapılan harcamayı azaltmak yerine toplam talebi artırabilir.
Asıl hikaye arayüzün kendisi. dev.to incelemesine göre Jev, bir durum (bir metin, bir JSON nesnesi veya metin değerlerinden oluşan bir dizi) artı bir ya da daha fazla tipli soru alıyor ve olasılık dağılımlarıyla birlikte tipli yanıtlar döndürüyor. 19 Eylül 2026 itibarıyla jev-latest, jev-1.13.0'a çözümleniyor; model yalnızca metinle çalışıyor, 64.000 token'lık bir istek bütçesi ve durum artı en uzun soru için ek 32.000 token'lık bir paya sahip.
Model yalnızca üç soru biçimini yanıtlıyor. Choice, çağıran tarafın sağladığı seçenekler arasından bir seçim yapıyor ve seçileni, her seçenek için bir olasılığı ve bir güven değerini döndürüyor. Score, bir şeyi sıralı bir ölçüte yerleştiriyor ve düzey olasılıklarıyla birlikte olasılık ağırlıklı bir puan döndürüyor. Noul, belirtilen bir koşulun geçerli olma olasılığını 0 ile 1 arasında döndürüyor. Jev e-posta yazmıyor, kod yazmıyor ve kendi bir sonraki eylemini belirlemiyor; aynı duruma yönelik birden fazla soru birbirinden bağımsız ve paralel olarak değerlendiriliyor.
Dar okunduğunda sıfır halüsinasyon iddiası
Üretken bir LLM token'ları tahmin eder ve herhangi bir metin çıkarabilir; yapılandırılmış çıktı modları üretimi bir şemaya kısıtlar ama sonuçları yine de bir dil modeli arayüzü üzerinden üretir. Jev ise kapalı bir cevap uzayından yola çıkar — isteğin kendisi kullanılabilir seçenekleri ve anlamlarını tanımlar. Bu yüzden şema dışında bir değer uyduramaz ve sıfır halüsinasyon ifadesi yalnızca bu sınırlı anlamda geçerlidir.
dev.to analizinin üzerinde titizlikle durduğu üç iddia var ve bunların ayrı tutulması gerekiyor: bir yanıtın beyan edilen tipiyle eşleşmesi, bir cevabın anlamsal olarak doğru olması ve bir uygulamanın buna dayanarak harekete yetkili olması. Jev birincisini yapısal olarak garanti eder, ikincisini yalnızca tahmin eder. Yine de izin verilen yanlış bir seçeneği seçebilir, kötü bir olasılık atayabilir ya da kötü yazılmış bir soruyu kelimenin tam anlamıyla yanıtlayabilir.
TypeSafe'ın kendi Jev 1.13 "jaggedness" sayfası, aritmetik, sayma, tarih karşılaştırma, katmanlı dolaylılık, alakasız bağlam, düşmanca metin, çelişen ölçütler ve metin üretimi konularındaki başarısızlık senaryolarını belgeliyor ve matematiksel işlemleri kodda tutmayı, üretilecek metin olduğunda üretken bir model kullanmayı açıkça öneriyor. Kalibrasyon da aynı şekilde toplu bir özellik: bir değerlendirme seti boyunca 0.8 olarak derecelendirilen olaylar yaklaşık yüzde 80 sıklıkla gerçekleşse de, tek bir 0.8 tahmini yine de yanlış olabilir. TypeSafe'ın kılavuzu, geliştiricilerin kendi verilerinde güven eşiği belirlemesini ve yanlış bir eylemin maliyeti arttıkça bu eşikleri yükseltmesini söylüyor.
Politikayı kod yönetiyor
İncelemeciye göre daha etkileyici fikir hızdan çok mimari. TypeSafe'ın tasarım kılavuzu, geliştiricilere sıradan bir yazım iş akışı kurmalarını ve Jev'i yalnızca bulanık anlamsal bir yargı gerektiği yerlere eklemelerini söylüyor. Kontrol akışını, aritmetiği, yetkilendirmeyi, eşikleri ve yan etkileri kod elinde tutuyor; üretimi ve uzun akıl yürütmeyi hâlâ bir LLM üstleniyor; düşük güvenli, yüksek etkili istisnaları ise bir insan ele alıyor.
TypeSafe ayrıca, geleneksel LLM API'leri üzerinde aynı soru-cevap arayüzünü sunan bir System One Adapter ile birlikte geliyor; yapılandırılmış çıktı, olasılık prompting'i, normalizasyon ve düzeltici yeniden denemeler kullanıldığından geliştiriciler her iki sistemi aynı iş akışı üzerinde ölçebiliyor. Şirket, dahili olarak yeni bir mimari, paralel bir örnekleyici ve Reinforcement Learning for Calibrated Decisions adlı bir eğitim yöntemi geliştirdiklerini söylüyor; ancak kamuya açık materyaller parametre sayılarını, ağırlıkları, temel mimariyi, eğitim derlemini veya bağımsız yeniden üretim için yeterli eğitim tarifini açıklamıyor. dev.to yazarının erken erişim anahtarı olmadığından tüm performans rakamları satıcı tarafından bildirilmiş ve doğrulanmamış durumda.
Neden önemli
Jev, yapay zekanın bir uygulamadaki yerini yeniden çerçevelendiriyor: bir paragraflık politika kararı veren bir kâhin olarak değil, bir kararla birlikte belirsizliğini de döndüren sınırlı bir yargı servisi olarak. Tedarikçinin rakamları bağımsız testlerden başarıyla çıkarsa, yönlendirme, puanlama ve kapı görevleri daha ucuz, daha hızlı ve daha denetlenebilir hale gelebilir; politika prompt'larda değil, gözden geçirilebilir kodda yaşayabilir. Risk pazarlamada yatıyor: "sıfır halüsinasyon" ifadesi okuyucuları tip güvenliğini doğrulukla karıştırmaya davet ediyor. Üçüncü taraf karşılaştırmaları ortaya çıkana kadar Jev, ana iddiasının künyesine ihtiyaç duyan ilginç bir mimari bahis olarak görülmeli.
- #ai
- #llm
- #machine-learning
- #api
- #product-launch
İlgili yazılar
- LLM'ler 45 denemenin tamamında zaten optimal kodu yeniden yazdı; tek bir prompt satırı hatayı yarıya indirdi
- Microsoft yöneticisi yapay zekâ ile veri kazımanın tarihin en büyük emek hırsızlığı olduğunu söylediği iddia ediliyor
- Açık kaynak Laya modelleri 33ms kalibre edilmiş kararlar ve Jev'den 7,8 kat hız vaat ediyor