yoklateknik mülakat

Data Engineer Wh Bigquery Storage Partitioning Clustering Mülakat Soruları

75 doğrulanmış Data Engineer Wh Bigquery Storage Partitioning Clustering mülakat sorusu — cevaplarıyla çöz, açıklamalarıyla öğren, gerçek simülasyonda kendini test et.

Gerçek simülasyonu dene →

Örnek sorular

Wh Bigquery Storage Partitioning ClusteringZorluk 1
BigQuery'de bir tabloyu partition'lamak için hangi üç strateji kullanılabilir?
  • aHash key, range key ve composite key
  • bPrimary key, foreign key ve surrogate key
  • cTime-unit, ingestion time, integer range
  • dRow-level, column-level ve block-level
Açıklama:BigQuery üç partitioning stratejisi sunar: bir time-unit column (DATE/TIMESTAMP/DATETIME), ingestion time (yükleme zamanına göre) ve bir INTEGER kolon üzerinde integer range.
Wh Bigquery Storage Partitioning ClusteringZorluk 1
Açık bir partitioning kolonu olmayan, ingestion-time partitioning kullanan bir tabloda BigQuery partition'a referans vermek için hangi pseudocolumn'ları sunar?
  • a_PARTITIONTIME ve _PARTITIONDATE
  • b_INGESTED_AT ve _LOAD_DATE
  • c_ROW_TIMESTAMP ve _PARTITION_KEY
  • d_EVENT_TIME ve _BATCH_ID
Açıklama:Ingestion-time partition'lı tablolar _PARTITIONTIME (TIMESTAMP) ve _PARTITIONDATE (DATE) pseudocolumn'larını sunar; sorgular yükleme-zamanı partition'ına bu kolonlarla filtre uygular.
Wh Bigquery Storage Partitioning ClusteringZorluk 1
Integer-range partition'lı bir tablonun aralıklarını tanımlamak için hangi üç değer belirtilir?
  • aBir minimum değer, bir maksimum değer ve bir partition sayısı
  • bBir start değeri, bir end değeri ve bir interval
  • cBir seed değeri, bir hash bucket sayısı ve bir salt
  • dBir base değeri, bir büyüme oranı ve bir tavan değer
Açıklama:Integer-range partitioning; start (dahil), end (hariç) ve interval ile tanımlanır, örn. RANGE_BUCKET(customer_id, GENERATE_ARRAY(0, 100, 10)).
Wh Bigquery Storage Partitioning ClusteringZorluk 1
Bir BigQuery tablosunu cluster'larken en fazla kaç kolon belirtilebilir?
  • aİki
  • bSekiz
  • cOn altı
  • dDört
Açıklama:BigQuery, CLUSTER BY ile tablo başına en fazla dört clustering kolonuna izin verir.
Wh Bigquery Storage Partitioning ClusteringZorluk 2
Bir BigQuery tablosunda clustering tanımlarken kolon sırası neden önemlidir?
  • aBir filtre yalnızca clustered kolonların baştaki prefix'ini kapsıyorsa yararlıdır
  • bİlk clustered kolon, tablonun hangi bölgede saklanacağını belirler
  • cKolon sırası yalnızca console arayüzündeki görünümü değiştirir, sorgu maliyetini değiştirmez
  • dBigQuery verilen kolonları sırayı yok sayıp alfabetik olarak yeniden sıralar
Açıklama:Clustering faydası prefix tabanlıdır: bir sorgu, ilk N clustered kolonu (tanımlanan sırayla) filtrelerse block pruning'den yararlanır, ama yalnızca sonraki bir kolonu filtrelerse önceki kolonların faydasını kaçırır.
Wh Bigquery Storage Partitioning ClusteringZorluk 2
Bir tabloyu bir veya daha fazla kolona göre cluster'ladığınızda BigQuery aslında ne yapar?
  • aClustered kolonlar üzerinde ikincil bir B-tree index kurar
  • bClustered kolonları ayrı, daha küçük fiziksel bir tabloya taşır
  • cStorage block'larını clustered değerlere göre sıralar, sorgular daha az block tarar
  • dClustered kolonları oturum süresince bellekte önbelleğe alır
Açıklama:Clustering, satırları clustered kolon değerlerine göre fiziksel olarak birlikte konumlandırıp storage block'larda sıralar; böylece o kolonlarda filtre veya aggregation yapan bir sorgu yalnızca ilgili block'ları okumak zorunda kalır.

1950 soruluk Data Engineer bankasında kendini sına.

Mülakata başla