Fractal Interview Question

Why do we normalize data before performing K-means clustering? Why do we remove outliers before performing K-means clustering? How does it affect number of K-means cluster?