· kaynak Hacker News – Front Page (native)
Anthropic, Claude Fable 5.1'yi ve kısıtlı Mythos 5.1'i düşük fiyatlarla ve araştırma başarılarıyla piyasaya sürdü
Anthropic'ın Claude Fable 5.1'i yaklaşık %25 daha düşük token maliyetleri ve gevşetilmiş güvenlik önlemleriyle gelirken, kısıtlı Mythos 5.1 protein tasarımı ve gezegen haritalama alanlarında dikkat çekici sonuçlar elde etti.

Tek model, iki güvenlik yaklaşımı
Anthropic, kodlama ve bilgi işi için şimdiye kadarki en gelişmiş modelleri olarak nitelendirdiği Claude Fable 5.1 ve Claude Mythos 5.1'i tanıttı. Hacker News'te ortaya çıkan şirketin 1 Eylül duyurusuna göre ikisi, farklı güvenlik önlemlerine sahip aynı temel model. Fable 5.1 genel kullanıma açıkken, Mythos 5.1 siber güvenlik ve yaşam bilimleri çalışmasına göre ayarlanmış güvenilir erişim programlarıyla sınırlı.
Daha ucuz tokenlar ve yeni veri kontrolleri
Fable 5.1, token bazında faturalandırılan tipik iş yüklerinde Fable 5'ten yaklaşık %25 daha düşük maliyetli olacak; Anthropic bu indirimi cache okumalarındaki düşük fiyata bağlıyor. Yoğun agent'lı işlerde tasarruf kabaca %45'e kadar çıkabiliyor. Model ayrıca Claude Code'da varsayılan olarak High effort, Claude Cowork'de ve Claude.ai'de ise Medium effort kullanıyor.
Gizlilik konusunda Anthropic, sıfır veri saklamaya eşdeğer gizlilik sağlarken düşmanca kullanıma karşı da güçlü kaldığını söylediği Enterprise Frontier Safeguards (EFS) sistemini kullanıma sunuyor. Veriler, Anthropic değil tamamen müşterinin kontrolündeki bulut altyapısında saklanıyor. EFS bu sonbahardan itibaren aşamalı olarak kurumsal müşterilere ulaşacak; o zamana kadar uygun müşteriler Fable 5.1'i sıfır veri saklama ile çalıştırabiliyor.
Güvenlik önlemleri ayrıca siber güvenlikteki yanlış pozitifleri %60 azaltacak şekilde ayarlandı. Fable 5.1 artık yazılım açıklarını bulmak için kullanılabilecek, ancak bu açıklar için exploit geliştirmek için kullanılamayacak. ABD hükümetiyle birlikte geliştirilen, Mythos 5.1'in gelişmiş biyoloji yeteneklerine yönelik ayrı bir erişim programının yakında bilim insanlarına kayıt açması bekleniyor.
Kısıtlamalarla birlikte benchmark sonuçları
Anthropic, Fable 5.1'in yeni bir performans sınırı belirlediğini söylüyor. Agent'lı bilimsel araştırma benchmark'u olan Terminal-Bench-Science 0.1'de yüzde 52,6 aldı; Fable 5 yüzde 24,7, Opus 5 yüzde 29,0 ve GPT-5.6 Sol yüzde 22,4 skor aldı. Terminal-Bench 4.0 agent'lı kodlamada kısıtlı Mythos 5.1 yüzde 60,9 ile Fable 5.1'in yüzde 55,8'inin önünde. Diğer alanlarda kazanımlar daha dar: GDPval-AA v2'de 1824 skorlu Opus 5'e karşı 1853, CursorBench 3.2.0'da yüzde 73,4 ve Humanity's Last Exam'de araçsız yüzde 60,9.
Anthropic kendi uyarılarını da belirtiyor. Üretim güvenlik önlemleri bazı OSWorld 2.0 ve AutomationBench görevlerine müdahale ederek siber güvenlik işlerini Claude Opus 4.8'e, biyoloji görevlerini Opus 5'e yönlendirdi ki bu da muhtemelen bu skorları düşürüyor. Terminal-Bench-Science sonuçları 3,5 ila 4,5 puanlık standart hata taşıyor ve OSWorld koşusu, daha önce yayımlanan rakamlarla karşılaştırılamayan Ağustos 2026 görev sürümünü kullandı.
Benchmark'lara müşteri anekdotları da eşlik ediyor. Yatırım şirketi Millennium'ın testlerinde Fable 5.1'in, şirketin mühendislerinin ve diğer modellerin yıllarca açıklayamadığı iç sistemlerdeki nadir bir çökmenin nedenini bulduğu bildirildi. Jane Street Capital'ın kantitatif araştırma başkanı Craig Falls, Fable 5.1'in şirketin kodlama sorunlarının Fable 5 veya Opus 5'ten fazlasını çözdüğünü, ticari sezgide şirket rekoru kırdığını ve önceki modellerin takip edilmesi zorlaştığı uzun çok adımlı görevlerde okunabilir kaldığını söyledi.
Bilim sonuçları öne çıkıyor
En dikkat çekici iddialar araştırmayla ilgili. Açık kaynak protein tasarımı ve katlanma araçları verildiğinde Mythos 5.1, iki bağımsız kuruluşun laboratuvarda doğruladığı yüksek afiniteye sahip protein bağlayıcılar üretti. Üç hedefte bağlanma afinitesi, Adaptyv Bio'nun protein tasarımı yarışmalarındaki en iyi girişlerden 10 kat daha yüksekti ve 12 hedefte isabet oranı neredeyse yüzde 50'ye yaklaştı; Anthropic alanda tipiğin yüzde 10-15 olduğunu söylüyor.
Fable 5.1 ayrıca, 30 yılı aşkın süre önce toplanmış NASA Magellan radar görüntülerinden Venüs'ün üçte birini kapsayan yeni bir yükseklik haritası oluşturmak için bir sinir ağı eğitti. Harita, 10-20 kilometre yerine iki-üç kilometreye kadar özellikleri çözümleyebiliyor ve yükseklikleri yüzde 25'e kadar daha isabetli ölçüyor. Anthropic, bu ekiplerin gözlem hedefleri seçebilmesi için haritayı NASA'nın VERITAS ve ESA'nın EnVision görevlerinden önce Creative Commons lisansıyla yayımladı.
Hesaplamalı biyolojide Mythos 5.1, özel GPU çekirdekleri yazdı ve ara sonuçları cache'leyerek yedi açık kaynak derin öğrenme modelini aynı çıktılarla 2,5 kata kadar hızlandırdı; bu, araştırmacıların bu tür modelleri deney başına binlerce kez çalıştırabilmesi nedeniyle anlamlı.
Neden önemli
Bu sürüm, yapay zekâdaki sınır rekabetinin artık ham yetenek kadar kurumsal şartlara dayandığının sinyalini veriyor: daha düşük token fiyatları, veri saklamayan gizlilik seçenekleri ve daha az yanlış pozitif ret başlık özellikleri hâline geliyor. Geniş kullanıma açık bir varyant ile hassas alanlar için hükümetle koordineli kısıtlı bir varyanttan oluşan ikiz model yaklaşımı, laboratuvarların riskli yetenekleri nasıl ticarileştirebileceğine dair bir şablon sunuyor. Her şeyden öte Anthropic, protein tasarımı, Venüs haritalama ve GPU çekirdeği sonuçlarını, modellerin bilim insanlarına yardımcı olmaktan doğrudan keşiflere katkı sunmaya geçtiğinin erken kanıtı olarak sunuyor; bunun ilaç geliştirme, gezegen bilimi ve biyoloji araştırmalarının hesaplama maliyetleri açısından sonuçları var.
- #anthropic
- #claude
- #ai-models
- #benchmarks
- #protein-design