deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak Cloudflare blog

Cloudflare Basin: serverless Iceberg analitik platformu genel kullanıma açıldı

Cloudflare'ın veri analitiği platformu artık Basin adıyla genel kullanıma sunuldu; SQL tabanlı veri alımını, Apache Iceberg catalog yapısını ve R2 üzerinde serverless sorgulamayı bir araya getiriyor.

Cloudflare Basin: serverless Iceberg analitik platformu genel kullanıma açıldı

Yeni bir adla genel kullanılabilirlik

Cloudflare'ın analitik platformu artık genel olarak kullanılabilir durumda ve yeni bir kimlikle geliyor: Cloudflare Basin. Suit, ilk kez Birthday Week 2025 kapsamında Cloudflare Data Platform adıyla duyurulmuştu; Cloudflare bloguna göre yeniden adlandırmanın amacı, ayrı ürünleri tek bir çatı altında toplamak.

Basin, Apache Iceberg — Cloudflare'ın veri gölleri için standart açık tablo formatı olarak nitelendirdiği teknoloji — ve R2 Object Storage üzerinde kurulmuş, analitik veriler için serverless bir platform. Üç üründen oluşuyor ve her biri beta döneminden kalan adını değiştirdi:

  • Eski adıyla Cloudflare Pipelines olan Basin Pipelines, Workers'tan, HTTP endpoint'lerinden veya Cloudflare Logpush'tan gelen event'leri alıyor, SQL ile dönüştürüyor ve bunları Apache Iceberg tabloları ya da R2'deki dosyalar olarak yazıyor.
  • Eski adıyla R2 Data Catalog olan Basin Catalog, Iceberg metadata'sını yönetiyor ve tabloları hızlı ve maliyet açısından verimli tutmak için otomatik olarak bakımını yapıyor.
  • Eski adıyla R2 SQL olan Basin SQL, Iceberg tablolarını doğrudan Cloudflare üzerinde sorgulamak için serverless, dağıtık bir SQL motoru.

Cloudflare, platformu iki gelişme fark ettikten sonra geliştirmeye başladığını söylüyor: Apache Iceberg'ün pazarı, neredeyse tüm büyük query engine'lerde taşınabilir açık bir tablo formatı etrafında birleştirmesi ve geliştiricilerin analitik verileri R2'ye taşıması — buradaki egress ücretinin olmaması, farklı araçlar, ekipler, bölgeler ve bulut sağlayıcılarından erişimi pratik hale getiriyordu.\n

Beta'dan bu yana ne değişti

Beta süresince kullanıcılar — Cloudflare'ın kendi faturalandırma ve altyapı ekipleri dahil — servisleri gerçek zamanlı e-ticaret optimizasyonu, faturalandırma metriklerinin uzun süreli depolanması ve raporlanması ile altyapı telemetrisi için kullandı; Cloudflare, kullanıcıların on binlerce Pipeline oluşturduğunu bildiriyor. Anomaly'nin kurucu ortağı Dax Raad, şirketin tüm event veri pipeline'ını Basin'e taşıdığını ve AWS S3 ile Athena kurulumunun yerini aldığını söyledi.

GA sürümü, birkaç entegrasyon iyileştirmesinin yanı sıra alım kapasitesini stream başına 3GB/s'ye kadar yükseltiyor. Cloudflare Logpush, logları SQL dönüşümlerinden geçirerek sıkıştırılmış Parquet dosyalarına veya Iceberg tablolarına aktarabiliyor; Worker binding'leri şema farkındalığına sahip ve wrangler types, bir stream'in şemasından TypeScript tipleri üretiyor; böylece eksik alanlar ve tip uyuşmazlıkları dağıtımdan önce ortaya çıkıyor. Eksik alanlar, tip uyuşmazlıkları, parse hataları ve null değerler gibi veri kalitesi hataları dashboard'da ve GraphQL API üzerinden görülebiliyor; Terraform kaynakları ise catalog, stream, sink ve bunları bağlayan SQL'i kapsıyor.

Cloudflare, planlanan eklemeler arasında Basin Catalog'a yazarken özel partitioning ve şema geçişleri (schema migration) olduğunu söylüyor.

Hız, açıklık ve fiyatlandırma

Cloudflare, geçtiğimiz bir yıllık mühendislik çalışmasını hız, açıklık ve maliyet verimliliği etrafında konumlandırıyor. Bir catalog, bir veri alım pipeline'ı ve ilk sorgu birkaç saniyede kurulabiliyor — şirket bu özelliği, prompt'lar ve coding agent'lar etrafında geliştirilen veri uygulamalarının büyümesiyle ilişkilendiriyor; aksi halde bu uygulamalar kaynaklar için bekleyip sürekli sorgulamak zorunda kalırdı. Veri kümeleri büyüdükçe Basin Catalog, I/O'yu azaltmak için metadata ve veri dosyalarını sıkıştırıyor (compaction) ve sorgu planlaması için istatistikler üretiyor; Basin SQL ise bu istatistikleri kullanarak sorguları Workers genelinde dağıtılan daha küçük görevlere bölüyor.

Açıklık konusunda veriler Iceberg'de kaldığı için PyIceberg, DuckDB, Snowflake ve Apache Spark dahil herhangi bir uyumlu motorla okunup yazılabiliyor. Bobsled'ın platform direktörü Julien Grobbelaar, bu taşınabilirliğin sıfır egress ücretiyle birleşmesinin, şirketine veri ürünlerini her büyük veri ve AI platformunun her bölgesinde, çok daha düşük bir maliyetle erişilebilir kıldığını söyledi.

Fiylandırma kullanım tabanlı: müşteriler veri alındığında, işlendiğinde veya sorgulandığında ödeme yapıyor; saatlik ücret veya ayrı altyapı maliyeti yok. Cloudflare bunu, büyük kurumsal kullanım senaryoları için ölçeklenirken çok az maliyetle veya maliyetsiz hobi projeleri için de uygun bir model olarak konumlandırıyor.

Neden önemli

Basin, veri alımı, tablo yönetimi ve sorgulamayı tek bir serverless teklifte birleştirerek, Iceberg tabanlı bir lakehouse çalıştırmak için normalde gerekli altyapı işinin büyük kısmını ortadan kaldırıyor. Iceberg temeli, verilerin Cloudflare'a kilitlenmediği anlamına geliyor — herhangi bir uyumlu motor bunları sorgulayabiliyor ve R2'nin ücretsiz egress'i bu taşınabilirliği kullanmanın maliyetini düşürüyor. Bu özellikler birlikte Cloudflare'ı bulut veri ambarları ve yönetilen lakehouse servisleriyle daha doğrudan bir rekabete sokuyor; ayrıca lansman, AI agent'ları ve diğer veri yoğun uygulamaların önceden provizyonlanmak yerine hemen kurulup sorgulanabilen analitiğe olan talebini artırdığı bir dönemde geliyor.

  • #cloudflare
  • #apache-iceberg
  • #data-analytics
  • #serverless
  • #cloud

İlgili yazılar