deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak dev.to (home feed)

BrowserSkill, yapay zeka ajanlarınıza zaten oturum açtığınız tarayıcıyı kullanma imkanı veriyor

Tencent'e atfedilen MIT lisanslı bir proje, yerel bir daemon ile bir tarayıcı uzantısını birleştirerek Cursor ve Claude Code gibi ajanların yeni bir headless tarayıcı yerine kimlik doğrulaması yapılmış tarayıcı oturumunuzun içinde çalışmasını sağlıyor.

BrowserSkill, yapay zeka ajanlarınıza zaten oturum açtığınız tarayıcıyı kullanma imkanı veriyor

Tarayıcı otomasyonu nadiren buton tıklama veya form doldurma konusunda başarısız olur — asıl başarısız olduğu nokta giriştir. BrowserSkill'ün hedeflediği sorun tam olarak bu. dev.to'da yayımlanan bir yazıya göre proje MIT lisanslı, Tencent'e atfedilmiş ve yaklaşık 1,8 bin GitHub yıldızına sahip; yapay zeka ajanı için sıfırdan yeni bir tarayıcı başlatmak yerine, ajanın kişinin zaten kullandığı tarayıcının içinde, mevcut oturumları, çerezleri ve zamanla kazanılmış site güveniyle birlikte çalışmasını sağlıyor.

Nasıl çalışıyor

dev.to yazısı iki yerel bileşen tanımlıyor: bsk adında bir CLI ve daemon, ile bir tarayıcı uzantısı. İkisi de kurulu olduğunda Cursor, Claude Code, Codex ve WorkBuddy gibi ajan araçları bsk komutu üzerinden gerçek tarayıcıyı yönetebiliyor. Tarayıcı görevleri ayrı ve görünür bir Agent penceresinde çalışıyor; böylece ajan kişinin kendi sekmelerini bozmuyor ve yaptığı işlemler gizli tutulmak yerine izlenebiliyor.

Yazıda öne çıkan üç davranış var:

  • Oturum durumu yeniden kullanılıyor, dolayısıyla tek kullanımlık test hesaplarına gerek yok.
  • Ajan görünmez bir context yerine kendi görünür penceresini alıyor.
  • Bir görev captcha, giriş istemi veya onay iletişim kutusuyla karşılaştığında ajan duruyor, insanı devreye davet ediyor ve ardından devam ediyor.

Girişin neden zor kısım olduğu

Yazıya göre otomatikleştirilmiş taramanın çöktüğü yer gezinme değil, kimlik doğrulama. Siteler captcha'lara, SMS kodlarına, QR taramalarına, cihaz parmak izine ve insan olmayan trafiği engellemek için tasarlanmış risk motorlarına yaslanıyor. Yazı, her yaygın çözümün bir bedeli olduğunu belirtiyor: özel test hesapları daha sıkı risk kontrollerine takılabilir, kopyalanan çerezler süresi dolunca bozulur ve headless tarayıcılar hızla fark edilen parmak izleri sunar.

BrowserSkill'ün yanıtı sorunu tamamen bertaraf etmek. Aylarca normal tarama geçmişine ve geçerli bir oturuma sahip bir cihaz, yeni oluşturulmuş bir ortamdan çok daha sık başarı sağlıyor; bu yüzden araç böyle güvenilir bir ortamı taklit etmek yerine ona bağlanıyor.

Playwright ve Puppeteer'dan farkı

Playwright ve Puppeteer gibi headless framework'ler yeni tarayıcı örnekleri başlatır: yeni parmak izleri, yeni çerezler, oturum durumu yok. Anti-bot sistemleri açısından bu kombinasyon şüpheli görünür. BrowserSkill ise parmak izleri ve oturumları uzun süredir yerleşik olan mevcut bir örneğe bağlanır. Yazı iki yaklaşımı birbirini tamamlayan olarak sunuyor — herkese açık verileri kazımak için headless tarayıcılar, giriş gerektiren adımlar için BrowserSkill.

Güvenlik ödünleşimleri

Gerçek ve kimlik doğrulaması yapılmış bir oturumu yeniden kullanmak, bir şey ters gittiğinde riskleri büyütür. Tanımlanan tasarım bilinçli olarak temkinli: ajan bir sekmeyi açıkça ödünç almalı, işi bitince geri vermeli ve geri kalan her şeye dokunmamalı; ayrıca hassas adımları insana bırakıyor. Yine de yazı, ajan para, gizlilik veya herkese açık paylaşım içeren hesaplara dokunduğunda yakın gözetim öneriyor ve aracı tamamen otonom değil, gözetimli olarak nitelendiriyor.

Ayrıca tüm bu anlatılanların resmi dokümantasyon veya bağımsız testlerden değil, tek bir dev.to yazısından geldiğini belirtmek gerekir; bu yüzden desteklenen ajan listesi ve yıldız sayısı gibi ayrıntılar depodan doğrulanmalıdır.

Neden önemli

Giriş, yapay zeka ajanları ile web'in gerçekten önemli olan büyük kısmı — e-posta, panolar, bankacılık, dahili araçlar — arasındaki pratik duvardır. BrowserSkill anlatıldığı gibi çalışırsa, ajan güdümlü taramanın ekonomisini değiştirir: tespit karşıtı altyapı inşa etmek yerine ajan, insan kullanıcının zaten kazandığı güvenin sırtına biner. Bu aynı zamanda güvenlik sorusunu da yeniden çerçeveler; çünkü görevleri başarılı kılan güvenilir oturum, hataları da daha sonuç doğurucu hale getirir — görünür pencere ve insan devreye girme tasarımının önemli olmasının nedeni de tam olarak bu. Kimlik doğrulaması gerektiren erişime ihtiyaç duyan ajanlar inşa eden herkes için yakından izlenmeye değer bir desen.

  • #browser-automation
  • #ai-agents
  • #open-source
  • #developer-tools

İlgili yazılar