Экспорт для статистического анализа
Пять вариантов скачивания: табличный файл, SPSS, Stata, кодовая книга и рассчитанные показатели.
Ответы становятся полезными, когда они выгружены из платформы в инструмент, в котором проводится анализ. Модуль «Формы» предлагает пять вариантов скачивания, все — со страницы ответов. Для каждого требуется разрешение на просмотр форм, и каждое скачивание записывается в журнал действий рабочего пространства.
Табличный файл
Первый вариант экспорта — простой: таблица, в которой каждому ответу соответствует строка. Ее столбцы: Response ID, Form Version, Individual ID, Full Name, Gender, Source, Submitted At и Linked, затем по одному столбцу на каждый вопрос формы, а затем столбцы повторяющихся групп, если они есть в форме.
Одна и та же таблица предлагается в двух видах: в формате CSV или в виде книги Excel, строка заголовков которой оформлена и закреплена, чтобы оставаться на виду при прокрутке. Файл CSV содержит метку порядка байтов, благодаря чему ответы на арабском языке корректно открываются в Excel, а не отображаются вопросительными знаками.
SPSS, Stata и файл показателей
Два варианта скачивания предназначены для статистических пакетов; в каждом из них одна строка соответствует одному завершенному ответу.
Первый предназначен для SPSS и имеет расширение .sav
В нем ответ с выбором варианта хранится как число с прикрепленными подписями значений, поэтому пакет показывает текст варианта, а не стоящий за ним код. «Да» и «Нет» становятся 1 и 0 с подписями. Пропущенный ответ записывается как системное пропущенное значение, а не как пустое значение или ноль, поэтому он не влияет на средние величины. Подпись каждого столбца содержит полный текст вопроса, усеченный до 255 символов — максимальной длины, допускаемой SPSS.
Второй предназначен для Stata и имеет расширение .dta
В нем те же столбцы, а подписи усекаются до 80 символов — максимальной длины, допускаемой Stata. Есть одно существенное различие: файл Stata не содержит подписей значений. Они есть только в файле SPSS, поэтому при работе со Stata вам понадобится кодовая книга, чтобы понять, что означает, например, значение 3 в столбце.
Файл показателей, также в формате CSV, содержит не исходные ответы, а рассчитанные величины: баллы и показатели прироста, вычисленные платформой для каждого ответа.
Как называются столбцы
Прежде чем открывать любой из них, учтите одно обстоятельство. В файле SPSS, файле Stata и кодовой книге столбцы называются не по имени переменной, выбранному вами в конструкторе, а по собственному номеру вопроса в форме, поэтому их названия идут так: q001, q002 и далее, в порядке следования вопросов.
В кодовой книге используются те же названия, и именно это делает ее полезной: если читать ее параллельно с данными, значение каждого столбца становится понятным. Ваше собственное имя переменной тоже не теряется — кодовая книга указывает его для каждого столбца.
Кодовая книга
Кодовая книга — это файл CSV, в котором каждому вопросу соответствует одна строка; именно этот документ вы передаете исследователю вместе с данными. В каждой строке указаны имя переменной, порядковый номер вопроса в форме, текст вопроса, текст вопроса на арабском языке, тип вопроса, признак обязательности, раздел, допустимые значения, подписи значений на английском языке, подписи значений на арабском языке и примечания.
Она соответствует правилам подписей, которых ожидает пакет R haven, поэтому кодовую книгу и файл данных можно вместе загрузить в R, не переписывая вручную ни то ни другое.
Открытие файлов
Файлы SPSS и Stata открываются непосредственно в этих пакетах, без этапа импорта и без преобразования. Откройте кодовую книгу рядом с данными — и исследователь, никогда не видевший вашей формы, сможет понять, что содержит каждый столбец.
Если библиотеки, которые платформа использует для записи этих двух форматов, недоступны, при скачивании появится сообщение об отсутствии зависимости, а не файл, который лишь выглядит правильным.