· kaynak dev.to (home feed)
Arena, 3,1 milyar dolarlık valuasyonla 200 milyon dolar yatırım aldı ve yapay zeka güvenlik endeksini önizledi
Kitle kaynaklı yapay zeka liderlik tablosu Arena, 200 milyon dolarlık Series B turunu 3,1 milyar dolarlık bir valuasyonla kapattı; on ay içinde değerini neredeyse ikiye katladı ve modelleri güvenli olmayan davranışlara göre puanlayan yeni bir endeks başlattı.

Kullanıcıların hangi yapay zeka modelinin daha iyi yanıt ürettiği konusunda oy verdiği platform Arena, şirketi 3,1 milyar dolar değerine ulaştıran 200 milyon dolarlık bir Series B turu gerçekleştirdi. TechCrunch'a atıf yapan dev.to'daki bir habere göre tur, Lightspeed Venture Partners ve Khosla Ventures ortak liderliğinde yürütüldü ve 8 Ekim 2026'da duyuruldu. Valuasyon, yatırımcıların yaklaşık on ay önce ödedikleri bedelin neredeyse iki katı.
Tur
Arena anlaşmayı kendi blog yazısında duyurdu. Series B turuna katılan yeni yatırımcılar arasında Salesforce Ventures, 01 Advisors, Dell Technologies Capital ve Endeavor Catalyst yer alıyor. Arena'nın duyurusuna göre, mevcut destekçiler a16z, Felicis, AMP PBC, QuantumLight ve The House Fund da tura katıldı.
Şirketin valuasyonu hızlıca yükseldi. Felicis ve UC Investments liderliğindeki 150 milyon dolarlık Series A turu, 6 Ocak 2026'da 1,7 milyar dolarlık post-money valuasyonla kapandı. TechCrunch bu rakamı Haziran ayında bildirmişti. Arena, yeni sermayeyi ürün çalışmalarına devam etme ve işe alımların ötesinde nasıl kullanacağına dair ayrıntı vermedi.
Arena nasıl para kazanıyor
Şirket, 2023'te yapay zeka modellerinin kitle kaynaklı sıralamalarını derleyen bir UC Berkeley araştırma projesi olarak başladı ve TechCrunch'ın daha önce bildirdiği gibi Nisan 2025'te şirket olarak kuruldu. Kurucu ortakları, chief executive Anastasios Angelopoulos ve chief technology officer Wei-Lin Chiang. Aynı zamanda Databricks'in kurucu ortaklarından olan UC Berkeley profesörü Ion Stoica, şirketleşmeden önce projeye danışmanlık etti.
Herkese açık liderlik tablosunun kendisi ücretsiz: kullanıcı bir prompt gönderir, iki model yanıt verir ve kullanıcı daha iyi yanıtı seçer. Arena, platformun 150'den fazla ülkeden katılımcıyla 350 milyon oturum ve 62 milyon oy kaydettiğini söylüyor.
Gelir, model üreticilerine ve kuruluşlara ayrıntılı analiz sunan ve Eylül 2025'te başlatılan ücretli ürün AI Evaluations'tan geliyor. Arena, TechCrunch'a göre yıllıklaştırılmış gelirinin, Ocak turundaki 30 milyon dolarlık seviyeden yükselerek 100 milyon doları aştığını şimdi açıklıyor. Angelopoulos, fiyatlandırmayı yinelenen abonelik geliri yerine kullanım bazlı olarak tanımladı.
Arena, TechCrunch'a Haziran ayında doğrudan rakibinin olmadığını, ancak Mercor, Surge ve Scale AI gibi veri odaklı firmalarla "aynı dolar için" rekabet ettiğini söyledi.
Güvenli olmayan davranış için yeni bir endeks
Yatırım haberinin yanı sıra Arena, modelleri üç sinyale göre puanlayan Arena Alignment Index'inin önizlemesini yayımladı: Unauthorized Action, False Attribution ve Deceptive Completion. Bunlar, bir modelin izinsiz hareket etmesini, yanlış kaynağa atıfta bulunmasını ve tamamlamadığı bir işi tamamlamış gibi göstermesini kapsıyor gibi görünüyor. Arena, tanımların model risklerini belgelemek için OpenAI ve Anthropic tarafından yayımlanan system card'lara dayandığını söylüyor.
TechCrunch'ın bildirdiğine göre, ön sonuçlarda OpenAI modelleri endeksin zirvesinde yer alırken Claude Opus 5.5 altıncı ve Claude Fable dokuzuncu sırada. Arena, sektörün bu tür bir ölçüme ihtiyacı olduğu savunarak "Yapay zeka, onu değerlendirme yeteneğimizin ilerisinde hızla gelişiyor" yazıyor ve kendisini "yapay zekanın fiilen ne kadar güvenli ve hizalı olduğunu ölçen tarafsız bir üçüncü taraf" olarak konumlandırıyor.
Neden önemli
Bu tur, yapay zeka değerlendirmesine duyulan yatırımcı güveninin yalnızca bir araştırma faaliyeti değil, bir iş kategorisi olarak güçlü bir göstergesi. Arena, kitle kaynaklı tercih verilerini, şirket olarak geçirdiği yaklaşık bir yılda dokuz haneli gelirli bir operasyona dönüştürdü ve valuasyonu on ayda neredeyse ikiye katlandı.
Alignment Index geliştiriciler için de önemli. Modellerin özerk hareket ettiği agentic ürünler geliştiren herkes, tam olarak endeksin ölçtüğü hata modlarıyla, örneğin izinsiz eylemler ve bir görevin tamamlandığına dair yanlış iddialarla karşı karşıya. Bu davranışlar için herkese açık bir puan, önizleme formunda bile faydalı.
Ayrıca akılda tutulması gereken uyarılar var. Arena'nın sıralamaları kalabalığın tercihlerini yansıttığından, model seçerken birkaç girdiden biri olarak ele alınmalı. Ücretli değerlendirme servisi, sıraladığı modellerin sahibi olan yapay zeka laboratuvarlarına satılıyor; sonuçları okurken bunu hatırlamakta fayda var. Endeksin etkisinin gerçek sınavı, model üreticilerinin kendi lansman duyurularında ona atıfta bulunmaya başlayıp başlamayacağı olacak.
- #ai
- #startups
- #venture-capital
- #llm-evaluation
- #ai-safety
İlgili yazılar
- Arizona temyiz mahkemesi, yapay zekâyla üretilmiş mağdur af videosu nedeniyle cezayı bozdu
- Instinct, Meta'nın Muse'ü ve OpenAI'nin Dots'ı yapay zeka ajanı pazarını doldururken ayakta kalmayı başarıyor
- Oxide, kârlılığa geçtikten sonra 445 milyon dolarlık D Serisi yatırım aldı; AMD stratejik yatırımcı olarak katıldı