Login to manage your account

Please enter a valid email address.
Forgot Password?
Please enter a valid password.
OR

Don't have an account yet? Sign up

What is the most common practical bottleneck when scaling a big data pipeline?

  1. A Network shuffle and data movement between nodes
  2. B CPU clock speed
  3. C Disk capacity
  4. D Number of columns
Answer

Network shuffle and data movement between nodes

Reducing shuffles through broadcast joins, better partitioning and pre-aggregation usually yields far more than adding hardware.

All Big data MCQs

Login to manage your account

Please enter a valid email address.
Forgot Password?
Please enter a valid password.
OR

Don't have an account yet? Sign up as