Кейсы
Профессия и обучение

SD и SEM в статье о тренировках: чем они отличаются

SD, standard deviation, обычно означает стандартное отклонение наблюдений. SEM, standard error of the mean, - стандартную ошибку среднего. Первое помогает описать, насколько различаются значения в выборке; второе характеризует точность оценки среднего. Поэтому одинаково нарисованные вертикальные линии на двух графиках могут сообщать разную информацию.

Подпись важнее длины линии

Прежде чем сравнивать полосы погрешности, прочитайте легенду: это SD, SEM, доверительный интервал или другая величина? Уточните, к чему она относится - конечному результату, приросту или разнице групп. Запись «50 ± 2» без этих пояснений неполна.
В простой ситуации независимых одинаково распределённых наблюдений оценка SEM равна SD / √n. Связь этого выражения с доверительным интервалом среднего показана в статистическом руководстве NIST. Для зависимых измерений и более сложных моделей нельзя автоматически подставлять в формулу общее количество строк таблицы.

Короткие полосы приняли за одинаковую реакцию участников

В вымышленном примере тренер видит средний результат силового теста 50 кг и подпись SEM = 2 кг при n = 25. Он хочет объяснить клиенту: «Почти все получили около 50, различия небольшие». Клиент опасается оказаться хуже остальных, если не попадёт в узкий диапазон.
При указанной простой модели SD = SEM × √n = 2 × 5 = 10 кг. Значит, линия SEM длиной 2 кг не изображает разброс индивидуальных результатов. Она не даёт оснований обещать, что все уложатся в 48–52 кг. Для доли людей в конкретном диапазоне нужны сами данные или дополнительные обоснованные предположения о распределении.
Тренер убирает сравнение клиента с нарисованной полосой. В заметке о статье сохраняет обе характеристики: среднее 50 кг, SD 10 кг, SEM 2 кг, 25 наблюдений. Все эти числа придуманы только для расчёта; это не норматив силы и не результат реального тренировочного исследования.

Больше участников - меньше SEM, но не обязательно меньше разброс

Продолжим учебную арифметику. Если при n = 100 стандартное отклонение тоже равно 10 кг, SEM будет 10 / √100 = 1 кг. По сравнению с предыдущим примером SEM уменьшилась вдвое, хотя SD осталось прежним.
Это объясняет, почему большой набор данных может дать точную оценку среднего при заметной неоднородности отдельных результатов. Увеличение выборки не делает людей одинаковыми. Оно также не исправляет автоматически неточный прибор, неудобный протокол или подбор участников, не соответствующий вопросу тренера.

Десять попыток одного человека превратили в десять участников

Другой учебный эпизод: студент записал по десять попыток теста у десяти человек и получил сто строк. Он хочет делить SD на √100, чтобы показать «очень точный средний результат». Его беспокоит, что расчёт по десяти людям даст менее впечатляющую цифру.
Но попытки одного человека связаны между собой. Сто строк не означают сто независимых участников. В зависимости от задачи анализ может использовать индивидуальные средние или модель, учитывающую повторные измерения. Нельзя выбирать знаменатель только ради уменьшения SEM.
Студент возвращается к вопросу: описывает он средний результат людей, стабильность повторных попыток или изменение между условиями? Затем выбирает анализ с преподавателем статистики. До этого в отчёте остаётся прозрачное описание: десять человек, по десять попыток у каждого, без заявления о ста независимых наблюдениях.

Что не следует заключать из SD и SEM

SEM - это ошибка тренера или прибора? Нет. Слово «ошибка» здесь относится к статистической оценке среднего. Техническая погрешность измерения и ошибки записи требуют отдельного разбора.
Меньшая SD доказывает лучшую программу? Нет. Она описывает разброс выбранного показателя. Нужны также величина результата, исходный состав группы и вопрос сравнения.
Среднее ± SEM - это 95% доверительный интервал? Не автоматически. Для интервала используют соответствующий множитель и предположения анализа; одной SEM в обе стороны недостаточно для такого названия.
Если вы пока не разобрались, что именно измеряла работа, начните с чтения научной статьи. А в собственном дневнике тренировок сохраняйте исходные наблюдения: одно итоговое число не заменяет записи условий и попыток.