Ваши данные
Вставьте таблицу прямо из Excel или Google Таблиц либо перетащите CSV-файл. Никуда ничего не загружается — весь расчёт идёт внутри этой вкладки браузера.
CSV, TSV или обычный текст. Файлы в windows-1251 распознаются и перечитываются автоматически, поэтому кириллица в заголовках не превращается в кракозябры.
Настройки разбора
Столбцы
Результат
Сохранить и поделиться
Библиотека отрисовки скачивается только при нажатии кнопки и только на этой странице.
У этой страницы вообще нет серверной части. Вставленная таблица разбирается кодом JavaScript внутри вашего же браузера, график рисуется на элементе canvas на вашей машине, файл экспорта собирается локально. Ничего не загружается, не хранится и не пишется ни в какие логи. После загрузки страницы можно отключить сеть — всё продолжит работать, и это самый простой способ проверить обещание самостоятельно.
Факты и границы применимости
| Выборочная формула | Делитель n−1. Это СТАНДОТКЛОН.В (STDEV.S) в Excel и вариант по умолчанию почти в любом курсе статистики. |
|---|---|
| Генеральная формула | Делитель n. Применяйте, только если ваши строки — вся совокупность, а не выборка из неё. |
| Показываются обе | Всегда и рядом — расхождение между ними самая частая причина несовпадающих результатов. |
| Что ещё выдаётся | Дисперсия для обоих делителей, среднее, количество и стандартная ошибка среднего. |
| Минимум строк | 2 для выборочной формулы, 1 для генеральной. |
| Единицы измерения | Те же, что у данных, — в отличие от дисперсии, которая в квадратах единиц. |
Когда этот метод вводит в заблуждение
- Стандартное отклонение предполагает, что разброс примерно симметричен вокруг среднего. На перекошенных данных оно описывает форму, которой нет, и честной заменой становится межквартильный размах из утилиты квартилей.
- Одно экстремальное значение раздувает его драматически, потому что отклонения возводятся в квадрат до усреднения. Одна ошибочная строка способна удвоить стандартное отклонение, не тронув медиану.
- Знакомое «68% укладывается в одно стандартное отклонение» верно только для нормального распределения. Проверьте утилитой нормальности прежде, чем это цитировать: на перекошенных и тяжелохвостых данных реальный процент может быть далёк от 68.
- Его нельзя сравнивать между разными единицами и сильно разными масштабами. Для этого нужен коэффициент вариации, который делит его на среднее и избавляется от единиц.
Как это считается
Каждое значение сравнивается со средним, разность возводится в квадрат, квадраты усредняются. Возведение в квадрат нужно, чтобы отклонения в обе стороны считались разбросом, а не гасили друг друга, и оно же объясняет, почему одно большое отклонение доминирует: на вчетверо большем расстоянии оно даёт в шестнадцать раз больший вес.
Выборочная формула делит на n−1, а не на n. Причина в том, что среднее само оценено по этим же данным, поэтому отклонения в среднем чуть занижены; деление на меньшее число исправляет смещение. Именно это возвращает Excel STDEV.S и именно это означает «стандартное отклонение» в курсе статистики, если рядом не стоит слово «генеральное».
Генеральная формула делит на n. Применяйте её, только когда ваши строки действительно всё: каждый сотрудник компании, каждый станок в цехе, — а не выборка из большей группы. На практике это встречается реже, чем принято думать.
Стандартная ошибка среднего — это стандартное отклонение, делённое на корень из количества. Она отвечает на другой вопрос: не насколько разбросаны значения, а насколько точно зафиксировано само среднее. Она уменьшается по мере накопления данных, а стандартное отклонение — нет.
Вопросы и ответы
Какое число брать, n−1 или n?
Берите n−1, если только ваши строки не вся совокупность. Выборочные данные — месяц заказов, опрос, партия измерений — всегда n−1. Показаны оба, чтобы никогда не гадать, какое из них использовал инструмент.
Почему результат отличается от другого калькулятора?
Почти всегда из-за делителя. Многие школьные калькуляторы по умолчанию берут n. Сверьтесь с обоими числами на этой странице — расхождение разрешится сразу.
Стандартное отклонение 5 — это много?
Только по отношению к среднему. Пять минут на двадцатиминутной доставке — много; пять минут на двадцатичасовой перевозке — ничто. Коэффициент вариации делает это сравнение напрямую.
Что такое стандартная ошибка и почему она настолько меньше?
Она измеряет точность среднего, а не разброс значений, и падает как корень из количества. На 25 строках она в пять раз меньше стандартного отклонения.
Данные покидают браузер?
Нет. Сервера нет; расчёт выполняется на вашем устройстве.