Добавил:
Опубликованный материал нарушает ваши авторские права? Сообщите нам.
Вуз: Предмет: Файл:

Введение в анализ данных с интервальной неопределенностью. Учебное пособие

.pdf
Скачиваний:
0
Добавлен:
07.09.2026
Размер:
2 Мб
Скачать
относительной частоты, так как при росте числа наблюдений она для них не устанавливается. Для описания и анализа подобных явлений традиционная теория вероятностей непригодна.
Проблема малых выборок.
ются как тенденции, которыенаиболее заметны в массовых явлениях. Факти- чески при обработке экспериментальных данных почти всегда стоит вопрос о том, достаточен ли объем выборки оличество измерений и т. п.) для то- го, чтобы выводы, получаемые на основе теоретико-вероятностной модели погрешностей, имели приемлемую практическую достоверность.
Существующие промышленные стандарты и методики обработки экспе- риментальных данных (например, [12, 13, 14]) регламентируют способы ра- боты с выборками размера лишь более15. При этом результаты обработки выборок размера от16до50рекомендуется рассматривать как не очень на- дежные и сопровождать оговорками, а обработка выборок размером не более чем из15измерений стандартами вообще не рассматривается.
Неизвестные вероятностные характеристики распределения.
ли законы теории вероятностей применимы к анализу погрешностей, то ка- ков конкретный вид вероятностных распределений погрешностей? Каковы его числовые характеристики? Это непростые вопросы, на которые не все- гда есть ответ.
Например, считается, что типичным законом вероятностного распре- деления погрешностей является нормальное гауссово распределение. Но насколько оно соответствует действительности? Известно высказывание А. Пуанкаре: «. . .все верят в этот закон . .., потому что экспериментаторы думают, что это математическое утверждение, а математики что это результат экспериментов» [15]. Реальные распределения погрешностей из- мерений в различных ситуациях могут сильно отличаться от нормального гауссового. Для того чтобы выяснить, какое вероятностное распределение имеют анализируемые данные, часто необходима большая дополнительная работа, требующая выборок более 1000 измерений [16].
Конкретный вид функций распределения случайных величин, которые фигурируют в задачах обработки данных, может оказывать существенное влияние на способ их решения. Методология максимума правдоподобия для случая нормально распределенных погрешностей данных указывает на ме- тод наименьших квадратов, метод наименьших модулей для распределения Лапласа или метод чебышевского сглаживания (минимаксное приближение данных) для равномерно распределенных погрешностей.
Независимость данных.
в теории вероятностей понятий личин. Имеют ли данные корреляцию между собой? Или они независимы? Многие классические результаты вероятностной статистики требуют незави- симости рассматриваемых случайных величин, представляющих результаты
Вероятностные закономерности проявля-
Ес-
Ряд вопросов касается часто используемых
независимостиикорреляции
случайных ве-
11
измерений, либо заданного уровня их корреляции. Проверка этих условий на практике почти невозможна.
Наличие погрешностей различных типов.
мо статистических погрешностей, всегда присутствуют и систематические. Последние могут иметь разные источники, их сложно оценить. Часто эта оценка намного сложнее получения собственно результатов. Но даже если эти оценки получены, появляется вопрос: «Каким образом можно получить совокупную ошибку?»
В ходе измерений, поми-
1.2.1. Статистика нечетких данных
При нечетком описании результатов измерений и наблюдений мы пола- гаем, что вместо их точных значений нам известны так называемые
ции принадлежности
ний [39]. Возникновение нечетких чисел в природных явлениях на примере спектров возбуждения и эмиссии [17] представлено на рис. 1.1.
нечетких чисел, получающихся в результате измере-
функ-
Рис. 1.1.
Нечетким множеством
тами произвольной природы, которое дополнено так называемой
принадлежностиµ: 𝑋 [0, 1]
показывает степень принадлежности𝑥множеству𝑋(рис. 1.1). У стандарт- ной функции принадлежности множества (называемой также
функцией
допущение для функцииµнепрерывного ряда значений из интервала позволяет характеризовать ситуации, когда нет уверенности в принадлеж- ности элемента множеству, невозможно оперировать количественной мерой уверенности и строить на этой основе выводы и заключения.
Для построения содержательной теории нечеткого вывода и нечетких неопределенностей обычно ограничивают общность функции принадлежно- стиµ, требуя, чтобы она была
Спектры возбуждения-эмиссии как нечеткие числа [17]
называется множество𝑋, образованное элемен-
функцией
, значение которойµ(𝑥)
множества) значения могут быть равны только 0 или 1, поэтому
квазивогнутой
. В одномерном случае они
на элементе
индикаторной
𝑥 𝑋
[0, 1]
12
являются интервалами. Нечеткие множества с квазивогнутыми функциями принадлежности называются лентным образом заданы как семейства вложенных друг в друга интервалов, которые соответствуют различным уровням принадлежности.
Для обработки данных, имеющих нечеткую неопределенность, предложе- ны разные подходы (см., например, [39]), в частности, широкое применение получили методы восстановления зависимостей по нечетким данным [41].
нечеткими числами
, и они могут быть эквива-
1.3. Место и особенности интервального подхода
1.3.1. Почему интервалы?
Устройство природы.
тервалов для описания данных состоит в том, что некоторые физические (химические, биологические и т.п.) величины принципиально не могут быть выражены точечными значениями, а лишь интервалами. Поэтому интервалы представляют собой новый удобный тип данных, которым уместно дополнить элементарные типы данных, использующиеся в метрологии. В работе [3] при- ведено большое количество примеров из разных областей науки и техники.
Пример 1.3.1. Интервальные веса химических элементов.
2009 г. атомные веса некоторых элементов в Периодической системе эле- ментов Д.И.Менделеева, поддерживаемой Международным союзом теоре- тической и прикладной химии (ИЮПАК, IUPAC), стали выражаться ин- тервалами [42]. Почти каждый химический элемент представлен в природе смесью своих изотопов, т. е. разновидностями атомов, сходных по своим хи- мическим свойствам (структуре электронных оболочек), но отличающихся массой ядер. Относительная доля различных изотопов существенно меняет- ся в зависимости от места и характера взятия пробы. Например, в тканях живых организмов преобладают более легкие изотопы химических элемен- тов, чем в неживой природе. Отличаются друг от друга относительные доли изотопов элементов на суше, в море и т.п.
Известны изотопы ртути с массовыми числами от 170 до 216 оличе- ство протонов 80, нейтронов от 90 до 136). Природная ртуть состоит из смеси семи стабильных изотопов, гистограмма частот изотопов показана на рис. 1.2.
Математические причины.
валов в сравнении с другими способами описания неопределенности? Есть ряд причин, по которым интервалы нужны и важны при обработке данных.
Интервалы являются средством описания и представления типа неопре- деленностей, часто встречающихся в жизни, ограниченных по величине неопределенностей. Интервалы проще, чем вероятностные распределения
Фундаментальная причина использования ин-
В чем преимущества и недостатки интер-
С
13
30 %
20 %
10 %
Распространенность
196 198 200 202 204
Рис. 1.2.
или нечеткие множества. Интервал это «бесструктурный объект», кото- рый более сжато описывает неопределенность. Следствием этой простоты является лучшая развитость теории интервального анализа и интервальных вычислительных методов.
Интервалы и интервальные арифметики во многом уникальны, в частно- сти по своим алгебраическим свойствам, простоте и богатству определения отношений между объектами и результатами операций.
Наконец, интервалы являются предельным случаем сумм независимых ограниченных величин. В большинстве практических ситуаций погрешность измерения возникает в результате накопления и наложения большого коли- чества независимых факторов. Если некоторая величина есть сумма большо- го количества малых независимых слагаемых, то множество всевозможных значений этой величины близко к интервалу. Этот результат составляет со- держание «предельной теоремы Крейновича» и ее обобщений [4].
Кроме того, на основе интервалов можно строить составные матема- тические объекты, описывающие аспекты данных и вычислений, которые недоступны в рамках вещественной арифметики, твины и мультиинтервалы. Кратко рассмотрим их в п. 2.5.3.
Распространенность изотопов ртути на Земле
Масса
изотопа
1.3.2. Статистика интервальных данных
Интервальной неопределенностью
ния о величине, которая не известна точно, но известны нижняя и верхняя границы ее возможных значений, или, иными словами, известен интервал возможных значений этой величины.
В одномерном случае интервалы являются практически наиболее важ- ными ограниченными множествами, поэтому другие способы для описания неопределенности используются нечасто. Но в многомерном случае множе-
называется состояние частичного зна-
14
ствами возможных значений величины, имеющей ограниченную неопреде- ленность, могут быть брусы, многогранники, параллелотопы (зонотопы), эл- липсоиды и прочие объекты. Мы их относим к объектам интервальной ста- тистики и интервального анализа данных.
Отличительной чертой представляемого подхода является его примени- мость к выборкам любого объема, начиная с нескольких измерений пре- дельном случае одного). Как следствие, проблемы «малых выборок», ха- рактерной для вероятностной статистики, в интервальном подходе не суще- ствует. Это свойство особенно ценно, когда технические или экономические причины не позволяют проводить много экспериментов. В частности, тако- ва ситуация с алгоритмами обработки результатов разрушающих измерений или измерений быстропротекающих процессов в реальном масштабе времени. Интервальные методы имеют ляют приближение (аппроксимацию) данных в нужном смысле. Следова- тельно, для их применения массовость не требуется.
Развиваемые идеи впервые были оформлены в пионерской работе на дан- ную тему Л. В.Канторовича [18] во второй половине прошлого века. В то время для обозначения аналогичных подходов в литературе по математике использовались разные термины, напрмер, «минимаксный подход».
Интервальный подход позволяет построить простую и элегантную ме- тодику определения выбросов в данных. При анализе постоянных величин имеется ряд обобщений традиционных методов, дающих более обширную ин- формацию о выборке.
В задаче восстановления зависимостей неопределенности входных и вы- ходных переменных учитываются естественным образом. Оценка погрешно- сти результатов получается автоматически в процессе вычислений, не требу- ет дополнительного анализа и напрямую зависит от неопределенности дан- ных задачи.
Принцип соответствия.
ствия
включать старую теорию и ее результаты как частный предельный случай. Далее будем использовать принцип соответствия как инструмент проверки адекватности используемых конструкций, понятий и методов обработки дан- ных с интервальными неопределенностями, который позволяет исключать ненужные приемы.
называют утверждение, что любая новая научная теория должна
аппроксимационный
В методологии науки
характер, т. е. осуществ-
принципом соответ-
15
Г л а в а 2
БАЗОВЫЕ ПОНЯТИЯ
2.1. Интервалы
Вещественные интервалы.
за
интервал
нас величины, с помощью которого можно рассматривать неопределенности и неоднозначности.
Интервалы могут определяться на вещественной оси, на комплексной плоскости, а также в многомерных пространствах [4]. Далее будут рассмат- рены вещественные интервалы, интервальные векторы и матрицы, так как именно они играют главную роль в измерениях и их обработке.
Определение.
ство всех чисел, расположенных между заданными числами𝑎и𝑏, включая их самих, т.е.
При этом𝑎и𝑏называются и
правым
Аналогичные термины, которые часто используются в математических текстах, это ственной оси. Графическое изображение интервало дано на рис. 2.1.
Множество всех интервалов изRобозначается символомIR. В проти- воположность интервалам и интервальным величинам будем называть
чечными
щественной оси или пространства более высокой размерности. Множество вещественных чиселRможно рассматривать как подмножество множества интервалов, т. е. как интервалы с совпадающими концами:
. Это множество, задающее диапазон значений интересующей
Интервалом
[𝑎, 𝑏] := {𝑥 𝑖𝑛R | 𝑎 𝑥 𝑏}.
(или верхним) соответственно.
числовой промежуток
Рис. 2.1.
те величины, значениями которых являются отдельные точки ве-
Интервал на вещественной оси
Первичное понятие интервального анали-
[𝑎, 𝑏]
вещественной осиRназывается множе-
концами
𝑎 𝑏
интервала
(замкнутый),
𝑥
[𝑎, 𝑏],левым
отрезок,сегмент
R
-
(или нижним)
веще-
то-
R IR.
Используемая система обозначений следует неформальному междуна- родному стандарту обозначений в интервальном анализе [43]. В частности,
16
интервалы и другие интервальные величины (векторы, матрицы и др.) в тек- сте обозначаются полужирным шрифтом, например,𝐴,𝐵, . .. ,𝑦,𝑧, тогда как неинтервальные (точечные) величины никак специально не выделяют- ся. Для интервала𝑎посредством𝑎или тогда как𝑎или
В целом
sup 𝑎
𝑎 = [𝑎, 𝑎]
это его правый конец.
, поэтому
inf 𝑎
обозначается его левый конец,
𝑎 = { 𝑥 R | 𝑎 𝑥 𝑎 }.
Характеристики интервала.
Любой интервал полностью задается
(2.1)
двумя числами своими концами, но на практике широко используются также другие характеристики интервалов и представления интервалов на их основе.
Важнейшими характеристиками интервала являются его (центр)
и его
mid 𝑎 =
радиус
rad 𝑎 =
1
(𝑎 + 𝑎)
2
1
(𝑎 𝑎).
2
середина
(2.2)
(2.3)
В ряде случаев (например, п. 3.3) вместо радиуса рассматривается эквива- лентное понятие
В целом
𝑎 = mid 𝑎 + [1,1] · rad 𝑎
ширины
интервала
wid 𝑎 = 𝑎 𝑎.
, что равносильно представлению
𝑎 = {𝑥 R | |𝑥 mid 𝑎| ≤ rad 𝑎}.
(2.4)
(2.5)
Таким образом, задание середины и радиуса интервала также однозначно определяет его.
Середина интервала это точка, которая представляет его наилучшим образом, так как она наименее удалена от остальных точек этого интервала.
Радиус и ширина характеризуют разброс (рассеяние) точек интервала, т. е. абсолютную меру неопределенности или неоднозначности, выражаемой этим интервалом. Интервалы нулевой ширины (нулевого радиуса) обычно называют поэтому, к примеру,
дуль(магнитуда,абсолютное значение
вырожденными
. Они отождествляются с вещественными числами,
[1, 1]
это то же самое, что и1.
С одной стороны, важной характеристикой интервала является его
), определяемый как максимум мо-
мо-
дулей точек из интервала
|𝑎| = max {|𝑎| | 𝑎 ∈ 𝑎} = max {|𝑎|, |𝑎|}.
Модуль интервала это наибольшее отклонение его точек от нуля.
17
С другой стороны, величина, показывающая, насколько далеко отделен от нуля тот или иной интервал вне зависимости от его знака, называется
мигнитудой
, которая определяется как
𝑎= min {|𝑎| | 𝑎 𝑎} =
min {|𝑎|, |𝑎|},
0,
если если
0 ∈ 𝑎,
0 𝑎.
Среди интервалов особую роль играют интервалы вида своей серединой нуль. Их называют валов с данным абсолютным значением (модулем) именно уравновешенные интервалы имеют наибольшую ширину. И наоборот, среди интервалов фик- сированной ширины уравновешенные интервалы имеют наименьшее абсо- лютное значение.
Интервал полностью определяется двумя своими концами и представля- ет собой объект, который не несет никакой дополнительной структуры. Все точки интервала равноценны (равнозначны, равновозможны), и для каждой из них интервал дает двустороннее приближение.
В частности, интервал𝑎нельзя отождествлять с равномерным вероят- ностным распределением на
𝑎
может быть определено любое другое вероятностное распределение или да-
же какое-то распределение, меняющееся во времени, случайный процесс.
Отношения между интервалами.
ми, составленными из вещественных чисел. Большую роль для них играют теоретико-множественные отношения и операции (объединение, пересечение и др.). Особенно важно
𝑎 𝑏
Отношение включения является ство интервалов в частично упорядоченное множество.
Помимо порядка по включению на множестве интервалов большую роль играют также другие отношения, которые обобщают линейный порядок «» на вещественной осиR. Порядок «» между вещественными числами мо- жет быть обобщен на интервалы многими способами. Важную роль играет следующее упорядочение.
Определение.
восходит𝑏, и писать «
Интервал называется ны оба его конца. Интервал называется неположительны оба его конца.
Теоретико-множественные операции между интервалами.
интервалы𝑎и𝑏имеют непустое пересечение, т. е.
Для интервалов𝑎,
[𝑎, 𝑎]
отношение включения
равносильно тому, что
𝑎 𝑏
» тогда и только тогда, когда
неотрицательным
уравновешенными
с плотностью
частичным порядком
𝑏 IR
1/(wid 𝑎)
Интервалы являются множества-
одного интервала в другой:
𝑎 𝑏и𝑎 𝑏.
будем считать, что𝑎не пре-
, т.е. «
неположительным
0
𝑎 𝑏 =
[𝑎, 𝑎]
, имеющие
. Среди всех интер-
, так как в пределах
(2.6)
и превращает множе-
𝑎 𝑏и𝑎 𝑏
», если неотрицатель-
, т. е. «
, то можно на-
0
.
», если
Если
18
писать простые выражения для результатов теоретико-множественных опе- раций пересечения и объединения через концы этих интервалов
𝑎 𝑏 =max{𝑎, 𝑏}, min{𝑎,𝑏}; 𝑎 𝑏 =min{𝑎, 𝑏}, max{𝑎,𝑏}.
Если
𝑎𝑏 =
уже неверны.
Обобщением операций пересечения и объединения являются операции взятия
, т.е. интервалы𝑎и𝑏не имеют общих точек, то эти равенства
минимумаимаксимума
относительно включения «»:
𝑎 𝑏 =max{𝑎, 𝑏}, min{𝑎,𝑏};
𝑎 𝑏 =min{𝑎, 𝑏}, max{𝑎,𝑏}.
Первая из этих операций, «», не всегда выполнима во множестве обыч- ных интервалов, но это затруднение преодолевается посредством расширения множества интервалов специальными элементами неправильными интер- валами (см. п. 2.4).
(2.7)
(2.8)
2.2. Классическая
интервальная арифметика
Значения физических иных) величин входят в математические выра- жения для физических законов, в различные формулы, в которых использу- ются арифметические операции. После определения интервалов приходим к необходимости введения операций и отношений между ними.
Наиболее естественным является определение результата интервальной операции «по представителям» как множества всевозможных результатов этой же операции между числами из интервалов. Например, для двухмест- ной операции «» можно считать, что
𝑎 𝑏 =𝑎 ⋆ 𝑏 | 𝑎 ∈ 𝑏, 𝑏 ∈ 𝑏.
Аналогичным образом определяются интервальные аналоги для одномест- ных операций.
Если рассматриваются арифметические операции, т.е. можно показать, что задаваемые правилом (2.9) множества являются интер- валами, исключая случай деления на интервал𝑏, который содержит нуль [4].
Конструктивные формулы, расшифровывающие этот общий принцип для отдельных арифметических операций, выглядят следующим образом:
∈ {+, , ·, /}
(2.9)
, то
𝑎 + 𝑏 =𝑎 + 𝑏, 𝑎 + 𝑏;
𝑎 𝑏 =𝑎 𝑏, 𝑎 𝑏;
(2.10)
(2.11)
19
𝑎 · 𝑏 =min{𝑎 𝑏, 𝑎 𝑏, 𝑎 𝑏, 𝑎 𝑏}, max{𝑎 𝑏, 𝑎 𝑏, 𝑎 𝑏, 𝑎 𝑏};
𝑎/𝑏 = 𝑎 ·1/𝑏, 1/𝑏,
для
𝑏 ∋ 0.
(2.12)
(2.13)
Множество всех интервалов вещественной оси с операциями сложения, вычитания, умножения и деления, которые определены посредством (2.10)– (2.13), называется
классической интервальной арифметикой
, и часто его
обозначаютIR.
Пример 2.2.2. Расчет силы тока.
в сети переменного тока находится в пределах интервала противление нагревателя меняется в пределах
Пусть максимальное напряжение
[20, 25]
[220, 230]
Ом. Каким будет ток
В, а со-
в этом участке цепи?
Для расчета используем закон Ома, который дает выражение для тока в виде
𝑈
𝐼 =
,
𝑅
где𝑈 напряжение на участке цепи;𝑅 ее сопротивление. Подставляя вме- сто этих переменных интервалы их изменения и заменяя операцию деления на интервальное деление (2.13), получим интервал значений максимального тока через нагреватель
Ом
В
220
=
[220,240]
𝐼
=
max
[20,25]
240
,
А
25
20
[8, 8, 12, 0]А.
Это точный интервал значений тока, так как математическое выражение для него является простым и позволяет точно оценивать свою область значе- ний с помощью классической интервальной арифметики. Для более сложных выражений оценка, полученная приведенным простым способом, может не быть равной области значений, но лишь содержит ее или, другими словами, является ее
внешней оценкой
.
Отметим важный частный случай интервального умножения произве- дение числа на интервал:
𝑎 · 𝑏 =
𝑎𝑏, 𝑎𝑏,
𝑎𝑏, 𝑎𝑏,
если
если
𝑎 0,
𝑎 0.
Алгебраические свойства интервальной арифметики являются необыч- ными. Операции сложения и умножения не связаны друг с другом привыч- ным соотношением дистрибутивности. Вместо него имеет место более слабая
субдистрибутивность
:
𝑎 (𝑏 + 𝑐) 𝑎𝑏 + 𝑎𝑐.
Например,
[0, 1] · (1 1) = 0 [1, 1] = [0, 1] · 1 + [0,1] · (1)
.
20