Аномалии при выполнении операций в базе данных.

Видно, что в табл. 1 данные хранятся с большой избыточностью: повторяются фамилии сотрудников, номера телефонов, названия проектов. Более того, в одном отношении хранятся независимые друг от друга данные (о сотрудниках, об отделах, о проектах, о работах по проектам). До тех пор, пока с отношением не производится никаких операций, это не приносит неудобств. Но при изменении состояния предметной области, что соответственно меняет состояние базы данных, возникает большое количество проблем.

Исторически эти проблемы получили название аномалии обновления. Сегодня не существует строгого определения понятия аномалии в базе данных. Аномалии определяют как противоречие между моделью предметной области и физической моделью данных, поддерживаемой конкретной СУБД. "Аномалии возникают в том случае, когда наши знания о предметной области оказываются, по каким-то причинам, невыразимыми в схеме БД или входящими в противоречие с ней".

Будем придерживаться интуитивного понятия аномалии как неадекватности модели данных предметной области (что говорит на самом деле о том, что логическая модель данных попросту неверна!) или как дополнительные трудности в реализации ограничений предметной области средствами СУБД (дополнительный программный код в виде триггеров или хранимых процедур).

Т.к. аномалии проявляют себя при выполнении операций, изменяющих состояние базы данных, то различают следующие виды аномалий:

- аномалии вставки (INSERT);

- аномалии обновления (UPDATE);

- аномалии удаления (DELETE).

Рассмотрим отношение в табл.1, в нем выделим следующие аномалии.

Аномалии вставки (INSERT).В табл. 1 нельзя вставить данные о сотруднике, который пока не участвует ни в одном проекте. Если, например, во втором отделе появляется новый сотрудник, скажем, Пушнарев, и он пока не участвует ни в одном проекте, то в отношение нужно вставить кортеж (4, Пушнарев, 2, 321, null, null, null). Это сделать невозможно, т.к. атрибут Н_ПРО (номер проекта) входит в состав потенциального ключа, и, следовательно, не может содержать null-значений.

Точно также нельзя вставить данные о проекте, над которым пока не работает ни один сотрудник.

Причина аномалии – хранение в одном отношении разнородной информации (и о сотрудниках, и о проектах, и о работах по проекту).

Вывод – логическая модель данных неадекватна модели предметной области. База данных, основанная на такой модели, будет работать неправильно.

Аномалии обновления (UPDATE).Фамилии сотрудников, названия проектов, номера телефонов повторяются во многих кортежах отношения. Поэтому если сотрудник меняет фамилию, или проект меняет наименование, или меняется номер телефона, то такие изменения необходимо одновременно выполнить во всех местах, где эта фамилия, название или номер телефона встречаются, иначе отношение станет некорректным (например, один и тот же проект в разных кортежах будет называться по-разному). Таким образом, обновление базы данных одним действием реализовать невозможно. Для поддержания отношения в целостном состоянии необходимо написать триггер, который при обновлении одной записи корректно исправлял бы данные и в других местах.

Причина аномалии – избыточность данных, также порожденная тем, что в одном отношении хранится разнородная информация.

Вывод – увеличивается сложность разработки базы данных. База данных, основанная на такой модели, будет работать правильно только при наличии дополнительного программного кода в виде триггеров.

Аномалии удаления (DELETE).При удалении некоторых данных может произойти потеря другой информации. Например, если закрыть проект "Космос" и удалить все строки, в которых он встречается, то будут потеряны все данные о сотруднике Петрове. Если удалить сотрудника Сидорова, то будет потеряна информация о том, что в отделе номер 2 находится телефон 321. Если по проекту временно прекращены работы, то при удалении данных о работах по этому проекту будут удалены и данные о самом проекте (наименование проекта). При этом если был сотрудник, который работал только над этим проектом, то будут потеряны и данные об этом сотруднике.

Причина аномалии – хранение в одном отношении разнородной информации (и о сотрудниках, и о проектах, и о работах по проекту).

Вывод – логическая модель данных неадекватна модели предметной области. База данных, основанная на такой модели, будет работать неправильно.