После разбора вы сможете
Не повторить шаги, а объяснить логику
- отличать наблюдение, переменную и значение
- не путать числовой код с количественной переменной
- находить ошибки, из-за которых анализ даёт странный результат
- подготовить CSV к импорту в SPSS или JASP
Три слова, на которых держится таблица
Представьте таблицу как аккуратный шкаф: строка — один участник, столбец — один признак, ячейка — одно значение этого признака у этого участника.
Это правило работает, пока единица наблюдения — человек. В других исследованиях строкой может быть семья, организация, интервью или отдельный замер. Сначала закончите фразу: «Одна строка в моём файле — это…». Если ответ расплывчатый, анализ начинать рано.
| student_id | group | stress_before | stress_after |
|---|---|---|---|
| G001 | control | 27 | 26 |
| G011 | training | 30 | 22 |
| G012 | training | 26 | 19 |
Здесь показан широкий формат: два замера лежат в двух столбцах. Для смешанных моделей и некоторых повторных измерений нужен длинный формат — отдельная строка на каждый замер и столбец времени. Это не ошибка, а другая заранее выбранная структура.
Тип переменной определяет смысл, а не вид ячейки
SPSS и JASP используют тип переменной, чтобы показывать допустимые графики и методы. Проверьте смысл каждого столбца до анализа.
| Переменная | Смысл | Уровень измерения | Частая ошибка |
|---|---|---|---|
student_id | Уникальная метка участника | Идентификатор / номинальная | Считать среднее по номерам |
group | Контрольная или тренинговая группа | Номинальная | Считать 1 и 2 количественной шкалой |
age_years | Возраст в полных годах | Количественная | Смешать годы и месяцы без единицы |
stress_before | Суммарный балл шкалы до тренинга | Обычно анализируется как количественная* | Не проверить диапазон и правила методики |
* Допустимый способ анализа суммарного балла зависит от конструкции шкалы, её психометрических свойств и требований конкретной методики. Отдельный пункт Лайкерта не стоит автоматически считать непрерывной величиной.
Записывайте данные скучно и одинаково
В самой таблице
- одна строка заголовков, без объединённых ячеек;
- одно написание категории: не смешивать «ж», «Ж» и «жен»;
- числа без слов «баллов», «лет» и «часов» в ячейке;
- никаких итогов, средних и цветных подзаголовков между строк;
- пропуск — пустая ячейка или единый заранее описанный код.
В паспорте данных
- полное название и смысл каждой переменной;
- единица измерения и допустимый диапазон;
- расшифровка категорий и числовых кодов;
- правило пропусков и причины исключений;
- как посчитаны суммарные показатели и обратные пункты.
Почему нельзя бездумно ставить 0 или 999 вместо пропуска?
Если программе не объяснить специальный код, он станет обычным числом. Возраст 999 лет растянет график и изменит среднее; нулевой балл может выглядеть реальным результатом. После импорта всегда посмотрите минимум, максимум и число пропусков.
Что проверить в SPSS и JASP после импорта
Data View + Variable View
- Откройте CSV и подтвердите, что первая строка — заголовки.
- В Variable View проверьте Type, Label, Values, Missing и Measure.
- Добавьте понятные метки категорий, если используете числовые коды.
- Запустите частоты для категорий и описательные статистики для чисел.
Значок типа в заголовке
- Откройте CSV и посмотрите тип у каждого столбца.
- Исправьте nominal, ordinal или scale, если программа угадала неверно.
- Откройте Descriptives и добавьте таблицу частот, диапазон и графики.
- Сверьте число строк, пропусков и невозможных значений с паспортом.
Интерфейс зависит от версии и языка программы. Цель проверки стабильна: увидеть уровень измерения, коды категорий, пропуски, диапазон и распределение каждого столбца.
Чек-лист перед первым тестом
- 01
Я могу одним предложением назвать единицу наблюдения и объяснить, почему каждая строка ей соответствует.
- 02
У каждого столбца один смысл, один формат и один допустимый диапазон.
- 03
Категории и пропуски закодированы единообразно и расшифрованы отдельно.
- 04
После импорта совпали число строк, частоты категорий, минимумы, максимумы и пропуски.
- 05
В рабочем файле нет ФИО, телефонов, адресов и других прямых идентификаторов, если они не нужны и не защищены.
Границы этого гайда
Чистая таблица ещё не делает анализ верным
Она не исправляет смещённую выборку, ненадёжную методику, нарушение процедуры сбора или неверную исследовательскую гипотезу. Не загружайте реальные чувствительные данные в облачные сервисы без законного основания, информирования участников и утверждённого способа хранения.
На что опирается разбор
- Wickham H. Tidy Data. Journal of Statistical Software. 2014;59(10):1–23.
- Field A. Discovering Statistics Using IBM SPSS Statistics. 5th ed. Sage; 2018.
- Документация к установленной версии IBM SPSS Statistics и JASP: сверяйте названия меню и правила импорта со своей версией.
Редакционная карточка
Материал будет пересмотрен
- Версия
- 1.0
- Последняя проверка
- Следующий пересмотр
Если интерфейс вашей версии SPSS или JASP отличается, ищите действие по смыслу, а не по положению кнопки. Сообщить о неточности можно через контакты внизу сайта.