Ваши данные
Вставьте таблицу прямо из Excel или Google Таблиц либо перетащите CSV-файл. Никуда ничего не загружается — весь расчёт идёт внутри этой вкладки браузера.
CSV, TSV или обычный текст. Файлы в windows-1251 распознаются и перечитываются автоматически, поэтому кириллица в заголовках не превращается в кракозябры.
Настройки разбора
Столбцы
Результат
Сохранить и поделиться
Библиотека отрисовки скачивается только при нажатии кнопки и только на этой странице.
Все вычисления выполняются локально в браузере: разбор, график, экспорт. Если отключите сеть, страница продолжит работать.
Факты и границы применимости
| Выборочная формула | Делитель n−1. Это СТАНДОТКЛОН.В (STDEV.S) в Excel и вариант по умолчанию почти в любом курсе статистики. |
|---|---|
| Генеральная формула | Делитель n. Применяйте, только если ваши строки — вся совокупность, а не выборка из неё. |
| Показываются обе | Всегда и рядом — расхождение между ними самая частая причина несовпадающих результатов. |
| Что ещё выдаётся | Дисперсия для обоих делителей, среднее, количество и стандартная ошибка среднего. |
| Минимум строк | 2 для выборочной формулы, 1 для генеральной. |
| Единицы измерения | Те же, что у данных, — в отличие от дисперсии, которая в квадратах единиц. |
Когда этот метод вводит в заблуждение
- Стандартное отклонение предполагает, что разброс примерно симметричен вокруг среднего. На перекошенных данных оно описывает форму, которой нет, и честной заменой становится межквартильный размах из утилиты квартилей.
- Одно экстремальное значение раздувает его драматически, потому что отклонения возводятся в квадрат до усреднения. Одна ошибочная строка способна удвоить стандартное отклонение, не тронув медиану.
- Знакомое «68% укладывается в одно стандартное отклонение» верно только для нормального распределения. Проверьте утилитой нормальности прежде, чем это цитировать: на перекошенных и тяжелохвостых данных реальный процент может быть далёк от 68.
- Его нельзя сравнивать между разными единицами и сильно разными масштабами. Для этого нужен коэффициент вариации, который делит его на среднее и избавляется от единиц.
Как это считается
Каждое значение сравнивается со средним, разность возводится в квадрат, квадраты усредняются. Возведение в квадрат нужно, чтобы отклонения в обе стороны считались разбросом, а не гасили друг друга, и оно же объясняет, почему одно большое отклонение доминирует: на вчетверо большем расстоянии оно даёт в шестнадцать раз больший вес.
Выборочная формула делит на n−1, а не на n. Причина в том, что среднее само оценено по этим же данным, поэтому отклонения в среднем чуть занижены; деление на меньшее число исправляет смещение. Именно это возвращает Excel STDEV.S и именно это означает «стандартное отклонение» в курсе статистики, если рядом не стоит слово «генеральное».
Генеральная формула делит на n. Применяйте её, только когда ваши строки действительно всё: каждый сотрудник компании, каждый станок в цехе, — а не выборка из большей группы. На практике это встречается реже, чем принято думать.
Стандартная ошибка среднего — это стандартное отклонение, делённое на корень из количества. Она отвечает на другой вопрос: не насколько разбросаны значения, а насколько точно зафиксировано само среднее. Она уменьшается по мере накопления данных, а стандартное отклонение — нет.
Вопросы и ответы
Какое число брать, n−1 или n?
Берите n−1, если только ваши строки не вся совокупность. Выборочные данные — месяц заказов, опрос, партия измерений — всегда n−1. Показаны оба, чтобы никогда не гадать, какое из них использовал инструмент.
Почему результат отличается от другого калькулятора?
Почти всегда из-за делителя. Многие школьные калькуляторы по умолчанию берут n. Сверьтесь с обоими числами на этой странице — расхождение разрешится сразу.
Стандартное отклонение 5 — это много?
Только по отношению к среднему. Пять минут на двадцатиминутной доставке — много; пять минут на двадцатичасовой перевозке — ничто. Коэффициент вариации делает это сравнение напрямую.
Что такое стандартная ошибка и почему она настолько меньше?
Она измеряет точность среднего, а не разброс значений, и падает как корень из количества. На 25 строках она в пять раз меньше стандартного отклонения.
Данные покидают браузер?
Нет. Сервера нет; расчёт выполняется на вашем устройстве.