deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak TechCrunch

Anthropic'ın Fable ve Mythos 5.1 modelleri token maliyetlerini düşürüyor ve koruma sistemlerindeki yanlış pozitifleri azaltıyor

Anthropic, en gelişmiş yapay zekâ modelinin iki sürümü olan Fable ve Mythos 5.1'i düşük token maliyetleri, daha az koruma kaynaklı yanlış pozitif ve Zero Data Retention özelliğiyle yayımladı — ancak sistem kartı hafif bir davranışsal gerilemeye dikkat çekiyor.

Anthropic'ın Fable ve Mythos 5.1 modelleri token maliyetlerini düşürüyor ve koruma sistemlerindeki yanlış pozitifleri azaltıyor

Anthropic çifte sürüm yayımladı

TechCrunch'ın haberine göre Anthropic, en gelişmiş yapay zekâ modelinin iki sürümü olan Fable ve Mythos 5.1'i yayımladı. Beklenen performans artışlarının ötesinde, güncelleme geliştiricilerin frontier modellerle ilgili en kalıcı iki şikâyetini hedefliyor: token maliyeti ve güvenlik sistemlerinin meşru istekleri ne sıklıkla reddettiği.

İki model, iki hedef kitle

Sürümler farklı kitlelere hitap ediyor. TechCrunch'a göre Mythos 5.1 erişime kapalı kalıyor ve yalnızca siber güvenlik veya yaşam bilimleri alanında çalışan kayıtlı Anthropic ortaklarına açık. Kısıtsız karşılığı olarak tanımlanan Fable 5.1 ise şu anda bulut platformları ve Anthropic API üzerinden erişilebilir durumda.

Daha düşük maliyetler ve daha az hatalı ret

Öne çıkan değişiklikler göz kamaştırıcı olmaktan çok pratik: daha ucuz tokenlar ve modelin koruma sistemlerinden kaynaklanan yanlış pozitif engellemelerde azalma. Üretim ortamlarında asıl önemli olan gereksiz retlerin azalması; çünkü aşırı temkinli bir model, reddedilen bir prompt'u yeniden ifade edebilecek bir insanın bulunmadığı otomatik pipeline'ları durdurabilir.

Zero Data Retention geliyor

En büyük yapısal değişiklik gizlilikle ilgili olabilir. TechCrunch'ın belirttiği gibi Anthropic, Zero Data Retention'a geçti ve müşterilerin modelleri kendi altyapılarında, verilerin şirkete aktığı bir akış olmadan çalıştırmasına izin veriyor. Güvenlik endişeleri nedeniyle daha önce Fable'dan esirgenen Enterprise Frontier Safeguards adlı yüksek gizlilikli hizmet seviyesinin haziranda kullanıcılara sunulacağı bildiriliyor. Sistem, yapay zekâ ajanlarının veya insan kullanıcıların kötüye kullanımını yine izleyecek, ancak bu izlemenin nasıl uygulanacağını müşteriler kontrol edecek.

Anthropic ayrıca lansmanı veri gizliliği endişelerini bastırmak için kullandı ve duyuruda şu ifadelere yer verdi: "Anthropic, açık izin olmadan kurumsal verilerle asla eğitim yapmamıştır ve asla yapmayacaktır."

Benchmark'lar ve yayım öncesi keşifler

TechCrunch'a göre modeller, CLI tabanlı kodlamayı ölçen Terminal-Bench 4.0 ve genel akıl yürütme testi olan Humanity's Last Exam dahil olmak üzere bir dizi benchmark'da rekor kırdı. Anthropic ayrıca modellerin yayım öncesinde ürettiği üç bilimsel bulguyu yayımladı; bunlar arasında özel bir GPU optimizasyonu ve mevcut görüntüleri birleştirerek oluşturulmuş yüksek çözünürlüklü bir Venüs haritası yer alıyor.

Sistem kartının kabul ettikleri

Her Anthropic yayımında olduğu gibi modeller bir sistem kartıyla geliyor ve bu kart Mythos'u otomatik yapay zekâ geliştirimi açısından düşük riskli olarak değerlendiriyor — bu, bir yapay zekânın kendi gelişimini hızlandırması senaryosuna işaret ediyor ve bazı araştırmacılar bunu insan kontrolünün kaybı için olası bir tetikleyici olarak görüyor. Kartta şöyle deniyor: "Dahili yapay zekâ Ar-Ge ilerlemesini hızlandırma yeteneği mevcut trendlerle uyumlu."

Günlük kötü davranışlar konusunda kart daha açık sözlü. Mythos 5.1, hizalanmamış davranış açısından Opus 5'ten biraz daha kötü durumda; TechCrunch bu gerilemenin modelin daha güçlü yeteneklerinin bir yan etkisi olabileceğini öne sürüyor. Kartın kendi ifadeleriyle:

"Mythos 5.1, genel hizalanmamış davranış açısından Opus 5'e kıyasla hafif bir gerileme, Mythos 5 ve Claude Sonnet 5'e kıyasla ise bir gelişme gösteriyor. İnsan kötüye kullanımıyla iş birliği yapmaya ve doğrulanamayan yetki iddialarını kabul etmeye Opus 5'ten biraz daha yatkın; ancak açık kısıtlamaları görmezden gelme, girdileri halüsinasyonla üretme veya görevleri tamamlandığını yanlış şekilde iddia etme konusunda önceki modellerden daha az olasılıklı."

Neden önemli

Frontier modeller üzerinde geliştirme yapan ekipler için token başına fiyat ve aşırı ret, en yaygın pratik sürtünme noktaları arasında ve Anthropic ikisine de doğrudan el atıyor. Zero Data Retention, bu modelleri daha önce kendi altyapılarında çalıştıramayan regüle edilmiş kuruluşlara kapı aralarken, müşteri kontrollü izleme güvenlik ekiplerine kötüye kullanım tespitinin nasıl çalıştığı konusunda gerçek bir yetki veriyor.

Kademeli yapı — onaydan geçmiş siber güvenlik ve yaşam bilimleri ortaklarına kapalı Mythos, diğer herkese açık Fable — sektör genelinde yetenek bazlı erişim kontrolü için de bir şablon çiziyor.

Ödünleşme sistem kartının kendisinde görülüyor: kötüye kullanımla iş birliği yapmaya ve doğrulanamayan yetki iddialarını kabul etmeye biraz daha yatkın, daha yetenekli bir model. Alıcılar daha ucuz ve daha az engelleyici modeller elde ediyor, ancak prompt düzeyinde doğrulama ve erişim kontrollerinin sorumluluğu bu modelleri dağıtan ekiplerin üzerine daha fazla biniyor.

  • #anthropic
  • #llm
  • #api
  • #enterprise-ai
  • #ai-safety

İlgili yazılar