Normalisierung organisiert Daten so, dass jeder Fakt an genau einer Stelle lebt, und beseitigt Redundanz. Denormalisierung dupliziert Daten bewusst, um Lesevorgänge schneller zu machen. Die meisten Schemas beginnen normalisiert und denormalisieren nur dort, wo Messungen es erfordern.
Normalisierung (bis 3NF)
Jede Tabelle beschreibt eine Entität; verwandte Daten werden per Fremdschlüssel referenziert.
-- Normalized: a customer's city is stored once
customers(id, name, city_id)
cities(id, name)
orders(id, customer_id, total)
