Среднее значение случайной величины по её распределению.
- значение, которое может принять величина
- вес этого значения — его вероятность. Ожидание = взвешенное среднее
Ключевые тезисы
- Линейно: E[aX + bY] = aE[X] + bE[Y].
- Функция потерь — это ожидание ошибки по распределению данных.
- Оценивается средним по выборке.
Подробный разбор
2 подтем — раскройте любую, чтобы увидеть объяснение, формулы, примеры и интерактивные графики.
1Линейность и её следствия
Самое полезное свойство во всей теории вероятностей.
Отсюда следует, что ожидаемое предсказание ансамбля равно среднему ожидаемых предсказаний его моделей — а вот дисперсия так себя не ведёт, и именно поэтому усреднение помогает.
2Оценка методом Монте-Карло
Когда интеграл не берётся аналитически.
- математическое ожидание — среднее по распределению
- вектор или точка пространства признаков
- размерность пространства или число объектов
- вероятность (или показатель нормы)
- функция, о которой идёт речь
- суммирование по всем перечисленным элементам
Точность растёт как и, что важно, не зависит от размерности — поэтому Монте-Карло применяют там, где численное интегрирование по сетке невозможно. Именно так оцениваются ELBO в VAE и градиенты политики в RL.
Связанные темы
Вероятность и информация
Probability70%
Теория вероятностей · ОсновыЯзык неопределённости: распределения, условные вероятности и теорема Байеса описывают, как данные порождаются и как обновлять убеждения.
Statistics70%
Статистика · ОсновыКак от выборки перейти к выводам о генеральной совокупности: оценки, доверительные интервалы и проверка гипотез.
Information Theory70%
Теория информации · ОсновыИзмеряет количество информации и различие между распределениями. Отсюда родом энтропия, кросс-энтропия и KL-дивергенция.
Probability Distribution70%
Распределение вероятностей · Математический справочникЗакон, задающий вероятности значений случайной величины.
Variance70%
Дисперсия · Математический справочникМера разброса значений вокруг среднего.
Covariance70%
Ковариация · Математический справочникМера совместной изменчивости двух величин; корреляция — её нормированная версия.
Entropy70%
Энтропия · Математический справочникМера неопределённости распределения: максимальна при равномерном, нулевая при детерминированном.
KL Divergence70%
KL-дивергенция · Математический справочникНасколько распределение q плохо описывает распределение p; несимметрична и не является метрикой.
Cross-Entropy70%
Кросс-энтропия · Математический справочникОжидаемая длина кода при использовании q для данных из p: энтропия p плюс KL(p‖q).
Bayes Theorem70%
Теорема Байеса · Математический справочникПравило пересчёта вероятности гипотезы после получения новых данных.
Naive Bayes70%
Наивный байесовский классификатор · Классическое машинное обучениеПрименяет теорему Байеса при «наивном» предположении о независимости признаков — и работает лучше, чем должно.
Log Loss70%
Логарифмические потери · МетрикиОценивает качество самих вероятностей, а не только меток: уверенная ошибка штрафуется очень сильно.