
- •Введение
- •I. Понятие хранилище данных
- •1.1 Диаграммы потоков данных
- •1.2. Пример хранилища данных
- •II Общие свойства Хранилищ Данных
- •2.1. Общие свойства
- •2.1.1. Ориентированность на предметную область
- •2.1.2. Интегрированность
- •2.1.3. Зависимость от времени
- •2.1.4. Постоянство
- •2.2. Компоненты хранилища
- •III. Задачи, решаемые с помощью хранилищ данных
- •3.1 Преимущества использования финансового Хранилища данных
- •3.2 Недостатки использования финансового Хранилища данных
- •IV. Структура хранилищ данных
- •4.1. Реализация хранилищ данных
- •Централизованное хранилище данных
- •Распределенное хранилище данных
- •Автономные витрины данных
- •Единое интегрированное хранилище и много витрин данных
- •4.2. Структура хранилищ данных
- •V. Вопросы реализации Хранилищ Данных
- •Неоднородность программной среды.
- •Распределенность.
- •Метаданные
- •Роль метаданных в системах Хранилищ Данных
- •Вопросы защиты данных
- •VI. Хранилище данных предприятия
- •Задачи Хранилища данных
- •1. Консолидация данных
- •2. Интеграция данных
- •Консолидация данных
- •Интеграция данных
- •Агрегация данных
- •Расчеты производных показателей
- •Предоставление данных для поддержки принятия решений (dss)
- •VII. Три основных недостатка современных хранилищ данных
- •Заключение
- •Список используемой литературы
Заключение
Три основных проблемы, которым уделяется недостаточное внимание при создании хранилищ данных: качество данных, оптимальный выбор источников данных и производительность и масштабируемость. На рынке имеется несколько средств очистки данных, которые начинают применяться для очистки грязных данных разнообразных типов. Однако эти средства, конечно, не затрагивают все типы грязных данных, и, конечно, лишь немногие предприятия принимают на вооружение такие средства или процессы для предотвращения или обнаружения и очистки грязных данных, а также для отслеживания и проведения количественной оценки качества данных в хранилищах данных. Сегодня в хранилищах данных содержится множество данных, которые никогда не используются приложениями, выполняемыми над этими хранилищами данных, и эти ненужные данные являются одной из причин снижения эффективности выполнения запросов. Нужно обеспечить возможность регистрации полного набора запросов, генерируемых всеми приложениями, и использования таблиц и полей, фигурирующих в запросах, для тонкой настройки содержимого хранилищ данных. В сегодняшних хранилищах данных для хранения данных и управления ими в значительной степени используются системы РБД. Однако возможности сегодняшних систем РБД не достаточны для обработки запросов, ориентированных на сканирование, таких как группировка записей и вычисление агрегатов, и операций перемещения файлов, которые преобладают на этапе преобразования данных хранилищ данных и этапе подготовки данных при добыче данных.
Список используемой литературы
Алексеева Т.В., Америди Ю.В., Лужецкий М.Г., Информационно-аналитические системы // Московская финансово-промышленная академия, М., 2005
http://bourabai.kz/tpoi/warehouse.htm
http://www.citforum.ru/database/articles/20030520/
http://www.usm.md/do/
http://www.bipartner.ru/
http://www.iso.ru/cgi-bin/main/journal.cgi?do_what=details&id=211