» Etiket
big-data
5 yayınGrab, Data Lake'ini Apache Iceberg'e Taşıyarak Ölçeklendirdi
Grab'in Hive Parquet'ten Apache Iceberg'e geçiş süreci, performans kazanımları ve açık kaynak UnifiedSparkCatalog aracı hakkında teknik özet.
Apache Parquet 2026'da: Sessiz format en gürültülü dönemine giriyor
On üç yıllık Apache Parquet, lakehouse ve yapay zeka baskısıyla en yoğun geliştirme dönemine giriyor: variant tipi, coğrafi veri desteği ve footer tartışması.
Apache Iceberg'de Variant Tipi: Shredding ile JSON Analitiği Hızlandırma
Apache Iceberg v3'teki Variant tipi ve shredding tekniği, JSON verilerini hem esnek hem de sorgu performansı yüksek hale getiriyor. İşte perde arkası.
CommitBrief — terminalde yapay zekâ destekli kod incelemesi
Staged değişiklikleri, bir commit aralığını ya da bütün bir GitHub pull request'ini yerelde inceleyen sağlayıcı bağımsız CLI. Sıfır telemetri, sunucu yok. Açık kaynak, GPL-3.0.
commitbrief.comVeri Gölünde Çevrimiçi Nokta Sorguları için İndeksleme
Spotify gibi firmalar, veri göllerinde hızlı nokta sorguları için RAP yöntemini kullanıyor.
Petabayt Ölçeğinde İleri Düzey Bölümlendirme Stratejileri
Petabayt ölçeğindeki veri setleri için etkili bölümlendirme stratejileri hakkında bilgi edinin. Performans ve yönetim için en iyi uygulamalar.