deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak dev.to (home feed)

BetterWebSearch MCP, anahtarsız web arama ve daha yalın agent bağlamları sunuyor

BetterWebSearch adlı açık kaynak bir Model Context Protocol sunucusu, AI agent'lara varsayılan olarak API anahtarı gerektirmeden web arama ve içerik çıkarma imkânı veriyor; geliştiricisi de token kullanımında ciddi düşüşler bildiriyor.

BetterWebSearch MCP, anahtarsız web arama ve daha yalın agent bağlamları sunuyor

Bir geliştirici, dev.to üzerinde BetterWebSearch MCP'yi yayımladı; bu açık kaynak Model Context Protocol sunucusu, AI agent'lara varsayılan kurulumda API anahtarı gerektirmeden web arama, sayfa çıkarma ve araştırma araçları sunuyor. Sunucu kutudan çıktığı haliyle DuckDuckGo üzerinden arama yapıyor; Brave Search ve Tavily isteğe bağlı sağlayıcılar olarak mevcut ve proje MIT lisansıyla sunuluyor.

Varsayılan olarak anahtarsız, tasarımdan yerel

Sunucu MCP'nin stdio transport'ı üzerinden yerel olarak çalışıyor ve yazıya göre araya hiçbir satıcı barındırmalı proxy, telemetri veya analitik katmanı koymuyor: istekler doğrudan arama sağlayıcısına ve hedef web sitelerine gidiyor. Başlatmak tek bir komut, npx -y better-web-search-mcp, ya da bir client'ın MCP yapılandırmasına kısa bir kayıt gerektiriyor; varsayılan mod için hiçbir environment variable gerekmiyor. Geliştirici, her stdio uyumlu MCP client'ıyla çalıştığını söyleyerek Claude Desktop, Claude Code, Cursor, VS Code Copilot, Windsurf, Cline, Zed ve OpenCode'u örnek gösteriyor.

Sadece gerektiğinde tırmanan çıkarma işlemi

Düz bir HTTP isteği modern sitelerde çoğu zaman neredeyse boş döner, çünkü içerik JavaScript ile render edilir. BetterWebSearch bunu üç aşamalı bir pipeline ile çözüyor: önce hızlı düz bir fetch, ardından sayfa içinde gömülü yapılandırılmış veriler (JSON-LD ve __NEXT_DATA__, __NUXT__ gibi framework hydration yükleri), son olarak da network interception'lı tam bir Playwright tarayıcı oturumu. Yalnızca önceki aşama başarısız olduğunda bir sonrakine geçiliyor; böylece hafif sayfalar hızlı kalırken JavaScript ağırlıklı uygulamalar da render edilebiliyor. Sunucu ayrıca belirli bir domain için hangi stratejinin işe yaradığını kaydediyor, böylece sonraki ziyaretlerde çalışmadığı bilinen aşamalar atlanabiliyor.

Araştırmayı tek bir çağrıda toplayan yapı

Sunulan araçlar arasında deduplication ve reranking ile çok sağlayıcılı arama yapan web_search, tek bir URL'den temiz içerik çıkaran web_extract, tek bir site içinde arama yapan web_find, çeşitlilik filtresiyle güncel haberler getiren web_news ve deep_search adıyla da bilinen web_research var. Bayrak gemisi web_research: bir agent bir aramayı beş ayrı çıkarma çağrısıyla zincirlemek yerine, sunucu arama, çıkarma ve pasaj seçimini kendisi yaparak sıkı bir kaynak gösterilmiş pasaj kümesi döndürüyor. Bu sonuçları şekillendiren iki destekleyici özellik var. Sorgu genişletme, tek bir sorguyu birbirine bağlı birkaç aramaya dönüştürüyor — yazıdaki örnek, Almanya'da sınırsız mobil veriyle ilgili bir soruyu Almanca ve alternatif ifadelere çeviriyor — ve içerik kümeleme, neredeyse aynı makaleleri birleştirerek yeniden yayımlanmış bir ajans haberinin beş bağımsız kaynak gibi gösterilmesini önlüyor.

Geliştiricinin kendi bildirdiği benchmark rakamları

Yazar, 12 canlı web araştırma sorusunda geleneksel bir iş akışını (arama, sonra en iyi beş sayfayı açma) tek bir web_research çağrısıyla karşılaştırdı. Geleneksel yol 137,3 saniyede 820.229 karakter, kabaca tahmini 205.000 token döndürdü; araştırma çağrısı ise 49,6 saniyede 110.973 karakter, yaklaşık 28.000 token döndürdü. Bu, döndürülen metinde yüzde 86,5'lik genel bir azalma; soru başına medyan azalma yüzde 83,8. İkinci bir test, yanıtların sıkıştırmadan çıkıp çıkmadığını kontrol etti: sayılar, HTTP status code'ları, kısaltmaların açılımları ve genel bilgileri kapsayan, bilinen gerçeklik işaretçileri içeren 34 soruda 34 işaretçinin 33'ü korundu; bu da yüzde 97,1'lik bir oran. Benchmark kodu depoda yer alıyor ve npm run bench ile çalıştırılabiliyor. Bu rakamlar bağımsız bir değerlendirmeden değil, aracın kendi yazarından geliyor.

Güvenilmeyen web içeriği için koruma önlemleri

Agent'lar getirilen sayfaları otomatik olarak tükettiği için sunucu, web içeriğini güvenilmeyen girdi olarak ele alıyor. URL'ler SSRF hedeflerine karşı doğrulanıyor — localhost, özel IP aralıkları, link-local ve rezerve adresler reddediliyor — ve redirect'ler her adımda yeniden kontrol ediliyor. Prompt injection tarafında ise web_extract, gömülü talimatlarla agent'ı yönlendirme girişimi gibi görünen metni işaretleyebiliyor ve uyarıyı, orijinal içeriği değiştirmeden sonuca ekliyor.

Neden önemli

API anahtarları ve ücretli arama planları agent geliştirmede sürekli bir sürtünme kaynağı ve anahtarsız DuckDuckGo varsayılanı, çoğu arama MCP sunucusunun dayattığı kurulum adımını ortadan kaldırıyor. Daha büyük katkı belki de bağlam ekonomisinde: eğer beş sayfalık bir arama gerçekten 200.000 token mertebesinde maliyeti varsa, naif retrieval uzun agent otasyonları için uygulanabilir değil ve pasaj seçimini sunucuya taşımak makul bir çözüm — ancak koruma iddialarının dışarıdan doğrulanmayı hak ettiğini de eklemek gerek. Güvenlik yaklaşımı da öne çıkıyor; zira getirilen sayfalara körü körüne güvenen retrieval-augmented agent'lar büyüyen bir saldırı yüzeyi oluşturuyor. Kendi yazarından gelen tek bir veri noktası olarak sonuçlar kuşkuyla karşılanmalı; yine de tasarımdaki seçimler — yalnızca gerektiğinde tırmanan çıkarma, atıf kümeleme, injection işaretleme — agent retrieval iş akışlarındaki gerçek ve tanınmış sorunlara odaklanıyor.

  • #mcp
  • #ai-agents
  • #web-search
  • #open-source
  • #duckduckgo

İlgili yazılar