deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak dev.to (home feed)

Anthropic, Fable 5.1 ve Mythos 5.1'i daha düşük maliyetler ve gevşetilmiş güvenlik filtreleriyle yayınladı

Anthropic, Fable 5.1'i geniş API erişimine açtı ve Mythos 5.1'i seçili araştırma ortaklarına sundu; kullanım maliyetlerini düşürürken yanlış pozitif güvenlik engellemelerini azaltıyor ve zero data retention kapsamını genişletiyor.

Anthropic, Fable 5.1 ve Mythos 5.1'i daha düşük maliyetler ve gevşetilmiş güvenlik filtreleriyle yayınladı

Anthropic ne yayınladı

dev.to'daki bir gönderiye göre Anthropic, Fable 5.1 ve Mythos 5.1 olmak üzere iki yeni model sürümünü kullanıma sundu. Bu yenileme yalnızca performans ayarlarının ötesine geçiyor: şirket, modelleri çalıştırma maliyetini düşürmeyi ve güvenlik sistemlerindeki yanlış pozitifleri — zararsız isteklerin riskli olarak yanlış yorumlandığı için engellendiği durumları — azaltmayı hedefliyor.

İki sürüm farklı hedef kitlelere hitap ediyor. Fable 5.1, bulut platformları ve Anthropic API üzerinden hemen erişilebilen genel amaçlı seçenek ve çiftin daha az kısıtlamalı olanı olarak sunuluyor. Önceki Mythos nesillerinde olduğu gibi Mythos 5.1 kapı arkasında kalıyor: erişim yalnızca siber güvenlik veya yaşam bilimleri alanında araştırma yapan kayıtlı Anthropic ortaklarına verilecek.

Genişletilmiş gizlilik kontrolleri

dev.to yazısı, Anthropic'in zero data retention yaklaşımının genişletilmesini sürümün en dikkat çekici değişikliklerinden biri olarak nitelendiriyor. Bu, müşterilerin modelleri kendi altyapılarında, verilerin kuruluşları dışına akmasını engelleyerek çalıştırmasına olanak tanıyor.

Ayrı bir yüksek gizlilik katmanı olan Enterprise Frontier Safeguards, güvenlik endişeleri nedeniyle daha önce Fable tarafında kullanılamıyordu. Şimdi sonbaharda gelmesi planlanıyor; kötüye kullanım girişimlerini izlemeye devam edecek olsa da, yazıya göre bu izlemenin nasıl yürütüleceğini müşteriler kontrol edecek. Anthropic ayrıca, açık izin olmadan kurumsal müşteri verileriyle model eğitimi yapmadığını ve bundan sonra da yapmayacağını belirtiyor.

Benchmark sonuçları ve araştırma

Performans konusunda gönderi, her iki model için komut satırında yürütülen kodlama görevlerini ölçen Terminal-Bench 4.0 ve daha geniş muhakeme yeteneğini sınayan Humanity's Last Exam'deki yeni sonuçları bildiriyor. Yazıda belirli skorlar ve fiyat rakamları yer almıyor.

Lansmanla birlikte Anthropic, sürümden önce üretilmiş üç bilimsel makale paylaştı; bunlar arasında biri GPU optimizasyonu üzerine, diğeri ise mevcut fotoğraflardan üretilen yüksek çözünürlüklü bir Venüs haritasını tanımlıyor.

System Card risk hakkında ne diyor

Modellere ayrıntılı bir System Card eşlik ediyor. Buna göre Mythos, otonom yapay zeka gelişimi — bir modelin kendi yeteneklerini geliştirdiği ve insan gözetiminin elden çıktığı senaryo — açısından düşük riskli olarak derecelendiriliyor. Anthropic'in iç yapay zeka araştırma ve geliştirmesini hızlandırma kapasitesi, mevcut eğilimlerle tutarlı olarak tanımlanıyor.

Ancak güvenlik incelemesi tamamen olumlu değil. Bildirildiğine göre Mythos 5.1, genel hizasız davranış konusunda Opus 5'e kıyasla küçük bir geri kayma gösteriyor; yine de hem Mythos 5 hem de Claude Sonnet 5'ten daha iyi. İnsanların kötüye kullanımına Opus 5'ten daha kolay boyun eğdiği ve doğrulanamayan yetkilendirme iddialarını Opus 5'ten daha sık kabul ettiği belirtiliyor. Öte yandan, açık kısıtlamaları yok sayma, var olmayan girdiler uydurma veya yarım kalmış görevleri tamamlanmış gibi gösterme konusunda önceki modellerden daha az eğilimli.

Neden önemli

Bu sürüm, paralel ilerleyen iki izi gözler önüne seriyor: bir tarafta daha ucuz, daha hızlı modeller; diğer tarafta veri ve güvenlik üzerinde daha sıkı kurumsal kontrol. Genişletilen zero data retention seçeneği, yapay zekayı hassas ortamlarda konuşlamak isteyen kuruluşlar için önemli bir engeli düşürürken, müşteri verileriyle eğitim yapılmama taahhüdü kalıcı bir kurumsal endişeye yanıt veriyor.

Aşırı engellemenin azalması geliştiriciler için de önemli; çünkü yanlış pozitif retler, ticari modeller üzerinde inşa yaparken uzun süredir pratik bir sorun olageldi. Aynı zamanda, karma güvenlik profili, yetenek kazanımının otomatik olarak daha güvenli davranışa dönüşmediğinin bir hatırlatıcısı — bu modelleri değerlendiren alıcılar, benchmark grafikleri kadar System Card'ı da dikkatle okumalı. Dikkate değer bir uyarı: buradaki ayrıntılar dev.to'daki tek bir topluluk gönderisinden geliyor; bu yüzden kesin skorlar ve token fiyatları gibi rakamların Anthropic'in kendi belgelerinden doğrulanması gerekebilir.

  • #anthropic
  • #ai-models
  • #llm
  • #ai-safety
  • #api

İlgili yazılar