सांख्यिकीय निर्यात
पाँच डाउनलोड: स्प्रेडशीट तालिका, SPSS, Stata, कोडबुक और परिकलित मेट्रिक्स।
उत्तर तब उपयोगी बनते हैं जब वे प्लेटफ़ॉर्म से निकलकर उस टूल में पहुँचते हैं जिसमें विश्लेषण होता है। फ़ॉर्म पाँच डाउनलोड प्रदान करता है, सभी उत्तर पृष्ठ से। प्रत्येक के लिए फ़ॉर्म देखने की अनुमति आवश्यक है, और प्रत्येक आपके वर्कस्पेस के गतिविधि लॉग में दर्ज होता है।
स्प्रेडशीट तालिका
पहला निर्यात सामान्य है: एक तालिका जिसमें प्रत्येक उत्तर के लिए एक पंक्ति होती है। इसके कॉलम हैं: उत्तर ID, फ़ॉर्म संस्करण, व्यक्ति ID, पूरा नाम, जेंडर, स्रोत, प्रस्तुत करने का समय और लिंक किया गया, फिर फ़ॉर्म के प्रत्येक प्रश्न के लिए एक कॉलम, फिर फ़ॉर्म द्वारा बनाए गए कोई भी दोहराव समूह कॉलम।
यही तालिका दो रूपों में उपलब्ध है: CSV के रूप में, या Excel वर्कबुक के रूप में जिसकी शीर्षक पंक्ति स्टाइल की गई और स्थिर (फ़्रीज़) होती है, ताकि स्क्रॉल करते समय वह दिखाई देती रहे। CSV में बाइट ऑर्डर मार्क होता है, जिसके कारण अरबी उत्तर Excel में प्रश्नचिह्नों की पंक्तियों के बजाय सही ढंग से खुलते हैं।
SPSS, Stata और मेट्रिक्स फ़ाइल
दो डाउनलोड सांख्यिकीय पैकेजों के लिए लिखे जाते हैं, और प्रत्येक में हर पूर्ण उत्तर के लिए एक पंक्ति होती है।
पहला SPSS के लिए लिखा जाता है और इसका एक्सटेंशन है .sav
इसमें विकल्प वाला उत्तर मान लेबल सहित एक संख्या के रूप में संग्रहीत होता है, ताकि पैकेज आपको उसके पीछे का कोड नहीं, बल्कि विकल्प का पाठ दिखाए। हाँ और नहीं लेबल सहित 1 और 0 बन जाते हैं। छोड़ा गया उत्तर रिक्त या शून्य के बजाय सिस्टम मिसिंग के रूप में लिखा जाता है, जिससे वह आपके औसत से बाहर रहता है। प्रत्येक कॉलम लेबल में प्रश्न का पूरा पाठ होता है, जिसे 255 वर्णों पर काटा जाता है, जो SPSS द्वारा अनुमत लंबाई है।
दूसरा Stata के लिए लिखा जाता है और इसका एक्सटेंशन है .dta
इसमें वही कॉलम होते हैं, और इसके लेबल 80 वर्णों पर काटे जाते हैं, जो Stata द्वारा अनुमत लंबाई है। एक अंतर महत्वपूर्ण है: Stata फ़ाइल में मान लेबल नहीं होते। ये केवल SPSS फ़ाइल में होते हैं, इसलिए Stata के साथ यह जानने के लिए कि किसी कॉलम में 3 का क्या अर्थ है, आपको कोडबुक साथ रखनी होगी।
मेट्रिक्स फ़ाइल, जो CSV भी है, कच्चे उत्तरों के बजाय परिकलित आँकड़े रखती है: वे स्कोर और वृद्धि के आँकड़े जो प्लेटफ़ॉर्म ने प्रत्येक उत्तर के लिए निकाले।
कॉलमों का नामकरण कैसे होता है
इनमें से किसी को भी खोलने से पहले एक बात जान लें। SPSS फ़ाइल, Stata फ़ाइल और कोडबुक में कॉलमों के नाम बिल्डर में आपके द्वारा चुने गए वेरिएबल नाम पर नहीं रखे जाते। उनके नाम फ़ॉर्म में प्रश्न की अपनी संख्या से रखे जाते हैं, इसलिए वे इस प्रकार चलते हैं q001, q002 और आगे, उसी क्रम में जिसमें प्रश्न दिखाई देते हैं।
कोडबुक भी यही नामकरण उपयोग करती है, और इसी कारण वह उपयोगी है: दोनों को साथ-साथ पढ़ें और हर कॉलम का अर्थ स्पष्ट हो जाता है। आपका अपना वेरिएबल नाम भी खोता नहीं है, क्योंकि कोडबुक उसे प्रत्येक कॉलम के सामने सूचीबद्ध करती है।
कोडबुक
कोडबुक एक CSV है जिसमें प्रत्येक प्रश्न के लिए एक पंक्ति होती है, और यही वह दस्तावेज़ है जिसे आप डेटा के साथ किसी शोधकर्ता को देते हैं। प्रत्येक पंक्ति में वेरिएबल नाम, फ़ॉर्म में प्रश्न का क्रम, प्रश्न का पाठ, अरबी प्रश्न पाठ, प्रश्न का प्रकार, प्रश्न अनिवार्य था या नहीं, उसका खंड, मान्य मान, अंग्रेज़ी मान लेबल, अरबी मान लेबल और कोई भी टिप्पणी होती है।
यह उन लेबलिंग परिपाटियों का पालन करती है जिनकी R का haven पैकेज अपेक्षा करता है, इसलिए कोडबुक और डेटा फ़ाइल को एक साथ R में पढ़ा जा सकता है, बिना किसी को इनमें से किसी को हाथ से दोबारा लिखे।
फ़ाइलें खोलना
SPSS और Stata फ़ाइलें सीधे उन पैकेजों में खुलती हैं, बिना किसी आयात चरण या रूपांतरण के। डेटा के साथ कोडबुक खोलें, और जिस शोधकर्ता ने आपका फ़ॉर्म कभी नहीं देखा वह भी बता सकता है कि हर कॉलम में क्या है।
यदि प्लेटफ़ॉर्म इन दोनों प्रारूपों को लिखने के लिए जिन लाइब्रेरी का उपयोग करता है वे उपलब्ध नहीं हैं, तो डाउनलोड आपको ऐसी फ़ाइल देने के बजाय जो केवल सही दिखती हो, यह बताता है कि एक निर्भरता अनुपलब्ध है।