What is partitioning in a big data table?
- A Organising data into directories, usually by date, so queries can skip irrelevant data
- B Splitting the cluster
- C Replicating data across nodes
- D Compressing columns
Answer
Organising data into directories, usually by date, so queries can skip irrelevant data
Over-partitioning creates a small files problem, where metadata overhead outweighs the benefit of pruning.





