deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak Hacker News – Front Page (hnrss.org)

Qwen 3.8 27B, 30 dakikada ticari bir uygulamanın lisans denetimini tersine mühendislikle çözdü

XDA Developers'ın elle denemesi, Qwen 3.8 27B'nin tek bir iş istasyonunda statik analizle gizli bir lisans anahtarını kurtardığını ve bu süreçte kendi hatalarını da yakaladığını gösteriyor.

Qwen 3.8 27B, 30 dakikada ticari bir uygulamanın lisans denetimini tersine mühendislikle çözdü

Açık ağırlıklı bir model, frontier ölçeğinde bir göreve soyunuyor

Son dönemlerin en yakından takip edilen açık ağırlıklı (open-weights) sürümlerinden biri olan Qwen 3.8 27B, alışılmadık derecede zorlu bir gerçek dünya testinden geçirildi. Hacker News ana sayfasına ulaşan XDA Developers el denemesine göre model, ticari bir uygulamanın lisans doğrulama şemasını yaklaşık 30 dakikada tersine mühendislikle çözdü; tüm çalışma tek bir masaüstü iş istasyonunda, buluttaki bir modelin yardımı olmadan yürütüldü.

Yazar, söz konusu uygulamanın meşru şekilde satın alıp kullandığı bir uygulama olduğunu ve testin kısmen sürümle ilgili insanların dile getirdiği siber güvenlik endişelerini yoklamak için seçildiğini belirtiyor.

Çalışmayı taşıyan donanım

İş istasyonu, Nvidia'nın GB10 Grace Blackwell çipi üzerine kurulu, 128 GB birleşik belleğe ve 273 GB/s bant genişliğine sahip bir Lenovo ThinkStation PGX. Kutusundan çıktığı haliyle model saniyede mütevazı bir hızla, 15 ila 30 token çalışıyor; yazarın bu donanım için standart reçete olarak nitelendirdiği yapılandırmayla — SGLang, NVFP4 quantization ve DFlash2 speculative decoding — kod ve akıl yürütme iş yüklerinde saniyede yaklaşık 50 token'a ulaşıyor. Modelin kendisi 17 GB VRAM'e sığıyor.

Kıyaslandırma tarafında rapor, Artificial Analysis'ın Qwen 3.8 27B'yi değerlendirilen 135 model arasında 4B–40B boyut sınıfının en iyi açık ağırlıklı modeli olarak sıraladığını, zekâ endeksinde 52 puan aldığını ve işletme maliyeti çok daha yüksek modelleri geçen SWE-bench Pro sonuçları elde ettiğini aktarıyor.

Model jailbreak'i reddetti, sonra yine de denetledi

Yazarın planı tanıdıktı: uygulamanın geliştiricisi gibi davranmak, lisans denetiminin sanıldığı kadar sağlam olup olmadığını sormak ve bunu bir jailbreak sistem prompt'uyla desteklemek. Qwen 3.8 27B jailbreak'i fark etti, uygulamanın imza sertifikasını inceledi, yazarın uygulamayı geliştirmemiş olduğu sonucuna doğru şekilde vardı ve gerçek geliştiricinin adını söyledi. Ardından lisans doğrulamasını denetleyip zayıf noktaları belgeleyeceğini, ancak çalışan bir bypass oluşturmayacağını söyledi ve tam o sınıra kadar çalıştı. Yazarın da işaret ettiği gibi, ürettiği rapor mekanizmayı o kadar eksiksiz anlattı ki, bypass yine de belgelenen adımlardan doğal olarak çıkıyordu.

Baştan sona statik analiz

Rapora göre model, en sonda kavram kanıtını gösterdiği ana kadar uygulamayı hiç çalıştırmadı. Öncesindeki her şey statik analizdi: framework'ü sökmek, binlerce satır arm64 kodunu incelemek, güvenlik fonksiyonlarını çağrı noktalarıyla eşleştirmek ve satıcının binary'nin içine gizlediği genel doğrulama anahtarını yeniden inşa etmek.

Yazarın meşru bir lisansı olduğu için kurtarma işlemi doğrulanabiliyordu: makinedeki gerçek lisans, modelin yeniden inşa ettiği anahtarla eşleşen özel anahtarla imzalanmıştı. Model ayrıca aktivasyonun nasıl çalıştığına dair sürekli bir rapor tuttu — satın alma ya da yükseltme sırasında tek bir çevrimiçi adım, ardından başlatmada imza denetimi, donanım seri numarasına makine bağlama, gömülü bir iptal listesi, binary'nin hâlâ imzalı olup olmadığı denetimi ve imzalı bir güncelleme yolunu kapsayan çevrimdışı doğrulama. Model, şemayı sınıfındaki bir uygulama için alışılmadık ölçüde kapsamlı buldu; aynı zamanda üç zayıf noktayı işaret etti: modern gücün oldukça altında bir RSA anahtarı, her şey çevrimdışı çalıştığı için güncelleme göndermeye bağlı olan iptal mekanizması ve yamalanabilir yerel kodda yaşanan denetimler. Birkaç ileri geri konuşmadan sonra bulguları küçük ve çalışan bir kavram kanıtı betiğine dönüştürdü; yazar lisans dosyasını beklenen konumdan taşıdı, betiği çalıştırdı ve bypass işe yaradı.

Kendi hatasını yakalayıp düzeltti

Anahtarı kurtarma girişiminin ilki dar kapsamlı bir biçimde yanlıştı: imza denetimi geçti, ama binary'nin hesapladığı bütünlük karması eşleşmedi. Model zafer ilan etmek yerine uyuşmazlığı işaret etti ve insan müdahalesi olmadan, değer bayt bayt eşleşene kadar çalışmayı sürdürdü. Bedeli ise ayrıntıcılık: akıl yürütme çabası varsayılan olarak en yüksekte, dolayısıyla sıradan istekler bile yüzlerce, hatta binlerce token tüketebiliyor ve bu, saniyede 30–50 token hızında bile ciddi birikiyor.

Neden önemli

17 GB VRAM'e sığan 27 milyar parametreli bir model, yazarın frontier bir model gerektirdiğini varsaydığı uzman tersine mühendislik işini tamamladı; üstelik bunu kendi kendini düzelten sabırlı bir statik analizle yaptı. Bu, güvenlik araştırmaları — hem meşru denetim hem de saldırı amaçlı çalışma, ki bu tam da yetenekli açık ağırlıkların çevresindeki ikili kullanım endişesinin kendisi — için yerel ve barındırılan modeller arasındaki pratik boşluğu daraltıyor.

Test ayrıca reddetme ile uyum arasındaki çizginin ne kadar bulanık olabileceğini gösteriyor: model jailbreak'i reddetti, istekte bulunan kişinin sahtekâr olduğunu tespit etti ve bypass oluşturmayacağını bildirdi; yine de denetimi, bypass'ı birleştirmeyi kolaylaştırdı. Kodlama ajanları daha yetenekli ve daha özerk hale geldikçe, bir reddin zararlı sonucu — yalnızca açık isteği değil — nerede gerçekten durdurduğunun tanımlanması, daha zor ve daha acil bir tasarım sorununa dönüşüyor.

  • #open-weights
  • #local-llm
  • #reverse-engineering
  • #qwen
  • #edge-ai

İlgili yazılar