Как правильно вычислить среднее значение

Как найти среднее арифметическое

Например, перед вами ряд чисел «1, 2, 3, 4, 5, 6». Как следует из определения, чтобы узнать среднее арифметическое, нужно сложить все данные вам числа, а потом разделить получившийся результат на количество этих чисел. В приведённом примере — на шесть. Вот как это выражается формулой:

Допустим, вам нужно определить среднее арифметическое для чисел 4, 5 и 6. Складываем 4 + 5 + 6 = 15. Теперь делим 15 на 3 и получаем 5. Это и будет среднее арифметическое.

Таким же образом оно подсчитывается для десятичных и обыкновенных дробей.

Может понадобиться ✏️

Пример расчёта среднего арифметического для обыкновенных дробей будет выглядеть так:

А это пример, как найти среднее арифметическое для десятичных дробей:

Видео

Подсчет среднего арифметического

Формула для вычислений предельно проста:

P = (a1 + a2 + … an) / n,

где an – значение величины, n – общее количество значений.

Для чего может использоваться данный показатель? Первое и очевидное его применение — это статистика. Практически в каждом статистическом исследовании используется показатель среднего арифметического. Это может быть средний возраст вступления в брак в России, средняя оценка по предмету у школьника или средние траты на продукты в день. Как уже говорилось выше, без учета весов подсчет средних значений может давать странные или абсурдные значения.

К примеру, президент Российской Федерации сделал заявление, что по статистике, средняя зарплата россиянина составляет 27 000 рублей. Для большинства жителей России такой уровень зарплаты показался абсурдным. Не мудрено, если при расчете учитывать размер доходов олигархов, руководителей промышленных предприятий, крупных банкиров с одной стороны и зарплаты учителей, уборщиков и продавцов с другой. Даже средние зарплаты по одной специальности, например, бухгалтера, будут иметь серьезные отличия в Москве, Костроме и Екатеринбурге.

Рассмотрим пару примеров

Расчет средней оценки

Многие учителя используют метод среднего арифметического для определения годовой оценки по предмету. Давайте представим, что ребенок получил следующие четвертные отметки по математике: 3, 3, 5, 4. Какую годовую оценку ему поставит учитель? Воспользуемся калькулятором и посчитаем среднее арифметическое. Для начала выберете соответствующее количество полей и введите значения оценок в появившиеся ячейки:

(3 + 3 + 5 + 4) / 4 = 3,75

Учитель округлит значение в пользу ученика, и школьник получит за год твердую четверку.

Расчет съеденных конфет

Давайте проиллюстрируем некоторую абсурдность среднего арифметического. Представим, что у Маши и Вовы было 10 конфет. Маша съела 8 конфет, а Вова — всего 2. Сколько конфет в среднем съел каждый ребенок? При помощи калькулятора легко вычислить, что в среднем дети съели по 5 конфет, что совершенно не соответствует действительности и здравому смыслу. Этот пример показывает, что показатель среднего арифметического важно считать для осмысленных наборов данных.

Какие способы вычисления среднего бывают?

Первым способом является вычисление уже упомянутого среднего арифметического, являющегося суммой всех значений, деленной на их количество.

Формула:

 x – среднее арифметическое;   xn  – конкретное зн

  • x – среднее арифметическое;
  • x– конкретное значение;
  • n – количество значений.

Плюсы:

  • Хорошо работает при нормальном распределении значений в выборке;
  • Легко вычислить;
  • Интуитивно понятно.

Минусы:

  • Не дает реального представления о распределении значений;
  • Неустойчивая величина легко поддающаяся выбросам (как в случае с генеральным директором).

Вторым способом является вычисление моды, то есть наиболее часто встречающегося значения.

Формула:

 M0 – мода;   x0  – нижняя граница интервала, кото

  • M– мода;
  • x– нижняя граница интервала, который содержит моду;
  • n – величина интервала;
  • fm– частота (сколько раз в ряду встречается то или иное значение);
  • fm-1 – частота интервала предшествующего модальному;
  • fm+1 – частота интервала следующего за модальным.

Плюсы:

  • Прекрасно подходит для получения представления об общественном мнении;
  • Хорошо подходит для нечисловых данных (цвета сезона, хиты продаж, рейтинги);
  • Проста для понимания.

Минусы:

  • Моды может просто не быть (нет повторов);
  • Мод может быть несколько (многомодальное распределение).

Третий способ — это вычисление медианы, то есть значения, которое делит упорядоченную выборку на две половины и находится между ними. А если такого значения нет, то за медиану принимается среднее арифметическое между границами половин выборки.

Формула:

 Me – медиана;   x0  – нижняя граница интервала, к

  • Me – медиана;
  • x– нижняя граница интервала, который содержит медиану;
  • h – величина интервала;
  • f – частота (сколько раз в ряду встречается то или иное значение);
  • Sm-1 – сумма частот интервалов предшествующих медианному;
  • fm – число значений в медианном интервале (его частота).

Плюсы:

  • Дает самую реалистичную и репрезентативную оценку;
  • Устойчива к выбросам.

Минусы:

  • Сложнее вычислить, так как перед вычислением выборку нужно упорядочить.

Мы рассмотрели основные методы нахождения среднего значения, называющиеся мерами центральной тенденции (на самом деле их больше, но это наиболее популярные).

А теперь давайте вернемся к нашему примеру и посчитаем все три варианта среднего при помощи специальных функций Excel:

  • СРЗНАЧ(число1;[число2];…) — функция для определения среднего арифметического;
  • МОДА.ОДН(число1;[число2];...) — функция моды (в более старых версиях Excel использовалась МОДА(число1;[число2];...));
  • МЕДИАНА(число1;[число2];...) — функция для поиска медианы.

И вот какие значения у нас получились:

В данном случае мода и медиана гораздо лучше харак

В данном случае мода и медиана гораздо лучше характеризуют среднюю зарплату в компании.

Но что делать, когда в выборке не 10 значений, как в примере, а миллионы? В Excel это не посчитать, а вот в базе данных где хранятся ваши данные, без проблем.

Вычисляем среднее арифметическое на SQL

Тут все достаточно просто, так как в SQL предусмотрена специальная агрегатная функция AVG.

И чтобы ее использовать достаточно написать вот такой запрос:

Вычисляем моду на SQL

В SQL нет отдельной функции для нахождения моды, но ее легко и быстро можно написать самостоятельно. Для этого нам необходимо узнать, какая из зарплат чаще всего повторяется и выбрать наиболее популярную.

Напишем запрос:

Вычисляем медиану на SQL

Как и в случае с модой, в SQL нет встроенной функции для вычисления медианы, зато есть универсальная функция для вычисления процентилей PERCENTILE_CONT.

Выглядит все это так:

Подробнее о работе функции PERCENTILE_CONT лучше почитать в справке Microsoft и Google BigQuery.

Теги

Популярные:

Последние: