· kaynak Hacker News – Front Page (native)
Thomson Reuters, 40 milyon dolara frontier düzeyinde sonuçlar iddia ettiği şirket içi LLM'i Thomson'u duyurdu
Thomson Reuters, ilk tescilli LLM'i Thomson'u açık kaynak bir temel üzerine yaklaşık 40 milyon dolara inşa etti ve modelin profesyonel hukuk ve vergi görevlerinde frontier modellere rakip olduğunu iddia ediyor.

Thomson Reuters kendi modelini inşa ediyor
Thomson Reuters, tamamen şirket içinde geliştirilen ilk tescilli büyük dil modeli Thomson'u piyasaya sürdü. Şirketin 24 Ağustos 2026 tarihli basın bültenine göre model, güçlü bir açık kaynak temel modelle yola çıkılarak ve yetenek ile işlem gücü üzerinden kabaca 40 milyon dolar yatırımla inşa edildi — bu, frontier laboratuvarların eğitim süreçlerine ve altyapıya döktüğü milyarların çok altında bir tutar.
Şirkete göre sonuç, tamamen kendi mülkiyetinde olan ve frontier ölçeğindeki sistemlerde tipik olan yüksek inference maliyetlerini taşımayan bir model. CEO Steve Hasker, erken değerlendirmelerin Thomson'u çok çeşitli görevlerde en yeni frontier modellerle aynı seviyeye koyduğunu iddia ediyor. Bu sonuçlar şirketin kendi ölçümlerine dayanıyor ve daha geniş kapsamlı bağımsız doğrulama hâlâ sürüyor.
Ölçek yerine uzmanlaşma
Basın bülteni Thomson'u, sektörün "daha fazla ölçek" şeklindeki varsayılan cevabına karşı bir argüman olarak konumlandırıyor. Thomson Reuters ham büyüklük yerine, on yıllara yayılan tescilli içeriğine — Westlaw, Practical Law, Checkpoint ve Reuters — eğitim hedeflerinin tasarımından son değerlendirmelere kadar dahil olan yüzlerce konu uzmanıyla birlikte mid-training ve post-training yoluyla uyguladı.
Şu ana kadar model, Thomson Reuters içeriğinin yüzde 10'undan azıyla eğitildi ve şirket bir sonraki aşamanın modele sadece daha fazla veri beslemek değil, uzmanlaşmanın yeni türlerini keşfetmek olduğunu söylüyor.
Açıklanan kazanımlar arasında, temel modele kıyasla talimat takibinde — karmaşık, çok parçalı profesyonel talimatları hassas biçimde uygulamada — anlamlı bir iyileşme ve yoğun, alana özgü materyal üzerindeki akıl yürütmede daha da büyük bir artış yer alıyor. Thomson Reuters'e göre bu, yaygın bir varsayıma meydan okuyor: yetenekli bir genel amaçlı modelin uzman düzeyinde performans göstermesi için yalnızca doğru içeriğe erişmesi yeterli. Erken sonuçları, güçlü bir temelin üzerine eklenen tescilli eğitim ve insan uzmanlığının, tek başına içerik erişiminin sağlayamayacağı kazanımlar ürettiğini gösteriyor.
CTO Joel Hron bültenede şunları söyledi: "Yıllardır yapay zeka endüstrisi ölçeği cevap olarak gördü: daha büyük modeller, daha fazla işlem gücü, daha fazla para" diyerek Thomson'un başka bir yol gösterdiğini ve "profesyonel yapay zekanın ekonomisini değiştirdiğini" savundu.
İlk kullanım alanı ve açık ağırlıklar
Thomson'un ilk görevi, büyük hacimli yapılandırılmış belgeleri incelemeye yarayan bir özellik olan CoCounsel Legal'deki Tabular Analysis içinde ve yaklaşan sürümde hukuk bürolarına ve kurumsal hukuk departmanlarına ulaşacak. CoCounsel Legal tasarımı gereği birden fazla model çalıştırmaya devam edecek: Thomson'un avantajının en net olduğu yerlerde Thomson kullanılacak, diğer alanlarda önde gelen diğer modeller tercih edilecek. Thomson Reuters ayrıca Thomson modellerini hukuk ve vergi portföyünün tamamına yaymayı ve ardından ek bağımsız (sovereign) kullanım seçenekleri sunmayı planlıyor.
Thomson'un küçük bir açık ağırlıklı sürümü akademik ve ticari olmayan kullanım için Hugging Face'te mevcut ve şirket, hukuk ve yapay zeka akademisyenlerine modeli değerlendirmeleri için doğrudan erişim vermeye başladı. Temel alınan foundation modeli bir teknik rapor ele alıyor.
Erken değerlendiriciler ne dedi
Bültenede iki akademisyene yer veriliyor. Washington University School of Law'dan Jonathan H. Choi, Thomson'u zorlu kurumsal vergi sorularında ChatGPT ve Claude ile karşılaştırdı ve üçünün de doğru yanıtlar verdiği halde genel olarak Thomson'un yanıtlarını tercih ettiğini, özellikle yanıtların doğrulanmasını kolaylaştıran antinlere (treatise) verdiği bağlantıları öne çıkardı. Conflict Analytics Lab (Queen's University) ve Cornell Legal AI Lab direktörü Samuel Dahan ise değerlendirmesinde Thomson'un atıf kalitesinin, Kanada'ya özgü bir ayar olmadan Kanada iş hukuku sorularında dahi önde gelen frontier modellerle genel olarak rekabetçi olduğunu söyledi.
Satış noktası olarak veri egemenliği
Thomson Reuters modeli ayrıca yapay zeka egemenliği etrafında pazarlıyor: bir modelin nasıl eğitildiği, hangi davranış ve önyargıları barındırdığı, nerede çalıştığı ve müşteri bilgilerinin nasıl korunduğu. Şirket, müşteri verilerinin açık rıza olmadan modeli eğitmek için kullanılmadığını söylüyor ve sonucu, özen ve hesap verebilirlik yükümlülükleri taşıyan profesyonellere yönelik bir "Fiduciary-Grade" (Vekâlet Düzeyi) standardını karşılayan bir yapı olarak sunuyor.
Neden önemli
Dünyanın en büyük profesyonel içerik sahiplerinden biri, bir modele sahip olmanın kiralamaktan daha iyi olduğuna karar verdi. İddialar dış inceleme altında doğrulanırsa Thomson, veri avantajı tezinin önemli bir sınavı haline geliyor: güçlü bir açık kaynak temel, derin bir tescilli derlem ve şirket içi alan uzmanlarının, en çok önemli olduğu yerlerde genel frontier modellerle rekabet edebilecek bir uzman modeli kabaca 40 milyon dolara üretebileceği tezi — bu da yüksek değerli derlemlere oturan yayıncıların frontier erişimi için laboratuvarlara süresiz ödeme yapmak zorunda kalmayabileceğini gösteriyor.
Kullanım deseni de aynı derecede anlamlı. Thomson Reuters üçüncü taraf modelleri söküp atmıyor; kendi modelini öne geçtiği yerlere yerleştiriyor. Bu pragmatik şablonu — dar kapsamda inşa et, dikey alanın sahibi ol, geri kalan her şey için frontier modelleri kullan — diğer içerik ağırlıklı şirketlerin de yakından incelemesi muhtemel.
- #ai
- #large-language-models
- #legal-tech
- #enterprise-ai
- #open-weights
İlgili yazılar
- Eski LinkedIn SRE'si, yapay zekâ ile olay yönetiminin mühendislerin sistem bilgisünü aşındırdığı konusunda uyarıyor
- SWE-Bench ProMax: en iyi model büyük çok dilli refactoring görevlerinin yalnızca yüzde 41,2'sini çözebiliyor
- Robotik veri girişimi XDOF, stealth'ten çıkışından üç ay sonra 1,2 milyar dolarlık Series B için görüşüyor