Redundancja danych
Słownik kwalifikacji INF.03 - Tworzenie i administrowanie stronami i aplikacjami internetowymi oraz bazami danych
Co to jest redundancja danych?
Redundancja danych to niepotrzebne powielanie tych samych informacji w wielu miejscach bazy danych. Inaczej mówi się o niej jako o nadmiarowości danych.
W pytaniu egzaminacyjnym poprawna odpowiedź to właśnie redundancja, ponieważ chodzi o sytuację, w której te same dane są zapisane wielokrotnie, mimo że wystarczyłoby przechowywać je tylko raz.
Przykład redundancji
Tabela zamowienia:
| id_zamowienia | klient | adres_klienta | produkt |
|---|---|---|---|
| 1 | Jan Kowalski | Kraków, ul. Długa 5 | Monitor |
| 2 | Jan Kowalski | Kraków, ul. Długa 5 | Klawiatura |
| 3 | Jan Kowalski | Kraków, ul. Długa 5 | Mysz |
Dane klienta i jego adres są powtarzane przy każdym zamówieniu. Lepszym rozwiązaniem jest utworzenie osobnej tabeli klienci i odwoływanie się do niej za pomocą klucza obcego.
Dlaczego redundancja jest problemem?
Redundancja może powodować:
- większy rozmiar bazy danych,
- trudniejsze aktualizowanie informacji,
- ryzyko niespójności danych,
- błędy przy usuwaniu lub modyfikowaniu rekordów.
Jak ogranicza się redundancję?
Najczęściej przez normalizację bazy danych, czyli podział danych na logiczne tabele i zastosowanie relacji między nimi.
Do zapamiętania
Jeżeli w pytaniu pojawia się sformułowanie: niepotrzebne powielanie tych samych danych w wielu miejscach bazy, chodzi o redundancję danych.