1995 के मुक़ाबले आज छह गुना साहित्य खोजना पड़ता है। जिस तरीक़े से आपके गाइड ने खोजा था, उससे अब काम नहीं चलेगा
🌐 Read this article in English
संक्षेप में: पीएचडी के लिए शोध-पत्र कैसे ढूँढ़ें — वेबसाइटों की सूची के रूप में नहीं, विधि के रूप में। इसमें है: प्रकाशन की मात्रा ने बेतरतीब खोज को असुरक्षित क्यों बना दिया, दोहराई जा सकने वाली सर्च स्ट्रिंग कैसे बनाएँ और दर्ज करें, एक डेटाबेस कभी पूरी खोज क्यों नहीं, पीछे और आगे दोनों दिशाओं में उद्धरण-शृंखला, वे भारतीय स्रोत जिन्हें अंतरराष्ट्रीय सूचकांक कम अनुक्रमित करते हैं, परीक्षक जिस ग्रे लिटरेचर के बारे में पूछते हैं, तीसरे साल नहीं पहले साल अलर्ट लगाना, और पहले पेपर से रेफ़रेंस मैनेजर।
1995 में दुनिया ने क़रीब 25.6 लाख शोध-कृतियाँ छापीं। 2025 में 1.467 करोड़ — ये आँकड़े हमने कल OpenAlex से लिए थे। जिस साहित्य पर डॉक्टरेट छात्र से पकड़ की उम्मीद की जाती है, वह तीस साल में लगभग छह गुना हो गया है, जबकि उसे खोजने का जो तरीक़ा ज़्यादातर छात्र इस्तेमाल करते हैं वह बिल्कुल नहीं बदला: किसी एक खोज-बॉक्स में कुछ शब्द डालिए, जो आए उसे पढ़िए, और जब "काफ़ी लगे" तब रुक जाइए।
जब साहित्य आज के पाँचवें हिस्से जितना था, तब यह तरीक़ा चल सकता था। आज वाइवा बिगड़ने की सबसे आम वजह यही है — इसलिए नहीं कि छात्र ने कम पढ़ा, बल्कि इसलिए कि वह बता नहीं पाता कि उसने क्या खोजा, कहाँ खोजा, और क्या छूट सकता है।
आगे समस्या का खोज वाला आधा हिस्सा है। पहुँच वाला आधा — मिल जाने के बाद पेपर क़ानूनी ढंग से कैसे खोलें — हमने अलग से घर से जर्नल पढ़ने वाले लेख में लिखा है, और वह ज़्यादातर छात्रों की सोच से छोटी समस्या है।
सर्च स्ट्रिंग लिखिए, फिर उसे दर्ज कीजिए
खोज एक विधि है, और विधि दोहराई जा सकने वाली होनी चाहिए। कुछ भी चलाने से पहले स्ट्रिंग का मसौदा बनाइए।
अपने सवाल को दो-तीन मूल अवधारणाओं में तोड़िए। हर अवधारणा के लिए वे सारे शब्द लिखिए जो कोई लेखक इस्तेमाल कर सकता था — पर्यायवाची, ब्रिटिश और अमेरिकी वर्तनी, पुरानी शब्दावली, संक्षेप और उसका पूरा रूप। विकल्पों को OR से जोड़िए, अवधारणाओं को AND से, कई शब्दों वाले पद उद्धरण-चिह्नों में रखिए, और जहाँ डेटाबेस इजाज़त दे वहाँ ट्रंकेशन लगाइए (catalys* से catalysis, catalyst, catalytic — तीनों)।
जहाँ नियंत्रित शब्दावली मौजूद हो, उसे इस्तेमाल कीजिए। जीव-चिकित्सा में इसका मतलब है PubMed के MeSH शब्द, जो उन पेपरों को भी पकड़ लेते हैं जिनके लेखकों ने आपसे अलग शब्द चुने थे। ज़्यादातर सूचकांक फ़ील्ड-टैग भी देते हैं — पूरे पाठ के बजाय सिर्फ़ शीर्षक और सार तक सीमित करना — जिससे बहुत-सा शोर कट जाता है।
फिर इसे दर्ज कीजिए: पूरी स्ट्रिंग, डेटाबेस, तारीख़ या भाषा की कोई सीमा, और चलाने की तारीख़। यही रिकॉर्ड आपके विधि-अध्याय का एक अनुच्छेद है, और यही वह चीज़ है जिससे अठारह महीने बाद वही खोज दोबारा चलाकर आप सिर्फ़ नया हिस्सा देख पाते हैं।
एक डेटाबेस पूरी खोज नहीं है
भारतीय साहित्य-समीक्षाओं की सबसे आम कमज़ोरी यह है कि पूरी समीक्षा गूगल स्कॉलर पर टिकी होती है। स्कॉलर अच्छा औज़ार है — चौड़ी पहुँच के साथ, पर बिना गुणवत्ता-छलनी, बिना नियंत्रित शब्दावली, और यह दर्ज करने के किसी तरीक़े के बिना कि उसने किया क्या।
कम-से-कम तीन अलग क़िस्म के स्रोत इस्तेमाल कीजिए:
उद्धरण-सूचकांक — स्कोपस या वेब ऑफ़ साइंस, अगर आपका संस्थान सदस्यता लेता है। आगे की दिशा में उद्धरण-खोज ठीक से यहीं होती है। विषय-सूचकांक — जीव-चिकित्सा के लिए PubMed, और आपके विषय का उसके जैसा; नियंत्रित शब्दावली इन्हीं में होती है। खुला सूचकांक — सिमैंटिक स्कॉलर, OpenAlex या CORE, जो मुफ़्त हैं और बहुत कुछ ढकते हैं जो सदस्यता वाले सूचकांकों में नहीं है।
और भारतीय सवाल पर काम करने वाले हर व्यक्ति के लिए, भारतीय स्रोत अलग से। हमने कल यही नापा था: 2025 के भारतीय संबद्धता वाले काम का 46 प्रतिशत बंद है, जबकि दुनिया में 32 प्रतिशत — और भारतीय पत्रिकाओं को अंतरराष्ट्रीय डेटाबेस कम अनुक्रमित करते हैं या बिल्कुल नहीं। डॉक्टरेट थीसिस के लिए शोधगंगा, कृषि विज्ञानों के लिए कृषिकोश, भारतीय विज्ञान अकादमी के जर्नल, IndianJournals.com, और आपके विषय की भारतीय सोसाइटी पत्रिकाएँ। भारतीय समस्या पर सिर्फ़ स्कोपस से बनी समीक्षा में ठीक वहीं छेद होता है जहाँ सबसे ज़्यादा मायने रखता है।
उद्धरण-शृंखला वह ढूँढ़ती है जो कीवर्ड नहीं ढूँढ़ पाते
कीवर्ड खोज तब हारती है जब क्षेत्र ऐसी शब्दावली इस्तेमाल करता हो जो आपके ध्यान में आई ही नहीं। उद्धरण-शृंखला को शब्दावली से कोई मतलब नहीं।
पीछे की ओर: तीन-चार ऐसे पेपर लीजिए जिन्हें आप केंद्रीय मानते हैं, और उनकी संदर्भ-सूचियाँ पढ़िए। जिसे ये तीनों उद्धृत करते हों वह बुनियादी है — और उनमें से कई आपको खोज से नहीं मिलते।
आगे की ओर: देखिए कि उन पेपरों को उसके बाद किस-किसने उद्धृत किया। 2011 के किसी मील-पत्थर से क्षेत्र की आज की हालत तक एक ही क़दम में पहुँचने का यही रास्ता है, और उद्धरण-सूचकांक इसी काम के लिए हैं। गूगल स्कॉलर का "Cited by" यह मुफ़्त करता है; स्कोपस और वेब ऑफ़ साइंस बेहतर करते हैं।
पड़ोस का नक़्शा खींचने वाले औज़ार — Connected Papers, Research Rabbit, सिमैंटिक स्कॉलर — यहाँ सचमुच काम के हैं, क्योंकि उनके नीचे का डेटा गढ़ा हुआ पाठ नहीं, उद्धरण-संबंध है। इनसे साहित्य की शक्ल देखिए, सारांश मत बनवाइए।
वह ग्रे लिटरेचर, जिसके बारे में परीक्षक पूछते हैं
जर्नल लेख दिखने वाला हिस्सा हैं। समिति बाक़ी के बारे में पूछेगी।
थीसिस — भारतीय डॉक्टरेट काम के लिए शोधगंगा। अपना एक शब्द लिखने से पहले अपने ही क्षेत्र की तीन थीसिस पढ़िए; दायरा और ढाँचा किसी गाइड से जल्दी समझ आता है। सम्मेलन की कार्यवाहियाँ, जो कंप्यूटर विज्ञान और कई अभियांत्रिकी क्षेत्रों में पूरक नहीं, प्राथमिक साहित्य होती हैं। मानक और तकनीकी रिपोर्ट, जो अक्सर वही विनिर्देश होते हैं जिन पर आपका काम खरा उतरना है। पेटेंट, जहाँ बहुत-सा व्यावहारिक काम खुलता है और कभी पेपर के रूप में नहीं छपता। सरकारी रिपोर्ट और डेटा — data.gov.in, मंत्रालयों के प्रकाशन, सांख्यिकी विज्ञप्तियाँ — जो नीति, कृषि और जनस्वास्थ्य के काम में प्राथमिक स्रोत हैं।
अलर्ट पहले साल लगाइए, तीसरे साल नहीं
यही वह क़दम है जो लगातार अपडेट रहने वाली समीक्षा को उस समीक्षा से अलग करता है जिसे जमा करने से पहले दोबारा करना पड़ता है।
हर डेटाबेस में अपनी खोज सहेजिए और नए नतीजों के लिए ईमेल अलर्ट चालू कीजिए। अपने क्षेत्र की पाँच-छह अहम पत्रिकाओं के लिए विषय-सूची (TOC) अलर्ट लगाइए। जिन तीन-चार पेपरों पर आपका काम खड़ा है उन पर उद्धरण अलर्ट लगाइए, ताकि कोई उन्हें आगे बढ़ाए या काटे तो आपको पता चले। एक ORCID बनाइए और उसे अपडेट रखिए — दस मिनट लगते हैं और आपका अपना काम ढूँढ़ा जा सकने लायक़ हो जाता है।
पूरी व्यवस्था पहले सत्र की एक दोपहर माँगती है और फिर बाक़ी डिग्री भर बिना मेहनत चलती रहती है।
रेफ़रेंस मैनेजर, पहले पेपर से
पहले दिन से इस्तेमाल कीजिए। ज़ोटेरो (Zotero) मुफ़्त और ओपन-सोर्स है; वह पीडीएफ़, मेटाडेटा और आपके अपने नोट एक साथ रखता है, माँगी गई शैली में ग्रंथ-सूची बना देता है, और शैली बदलने पर दोबारा ढाल देता है।
दो आदतें इसे लागत से कहीं ज़्यादा क़ीमती बना देती हैं। हर प्रविष्टि के साथ डीओआई पकड़िए, क्योंकि बाक़ी सब कुछ उसी पहचान से खुलता है। और नोट पढ़ते समय लिखिए — एक ईमानदार अनुच्छेद, कि पेपर ने क्या पाया और आपके तर्क के लिए वह क्यों मायने रखता है। ऐसा न करने की क़ीमत यह है कि तीसरा साल उन्हीं चीज़ों को दोबारा पढ़ने में जाता है जो आप पढ़ चुके हैं, क्योंकि याद नहीं आता कि वह आँकड़ा किसमें था।
परीक्षक का सवाल लगभग कभी यह नहीं होता कि "आपने पर्याप्त पढ़ा है?" सवाल होता है — "आपको कैसे पता कि कुछ छूटा नहीं?" दर्ज की गई सर्च स्ट्रिंग, कई डेटाबेस, दोनों दिशाओं की उद्धरण-शृंखला, और यह नोट कि आपने क्या छोड़ा और क्यों — पूरा जवाब यही है, और यह काम के साथ-साथ ही बनता है, बाद में नहीं।
और उसके बाद ही, पहुँच का सवाल
पेपर मिल जाने के बाद उन्हें खोलना छोटी समस्या है: आपके संस्थान की प्रॉक्सी या लॉगिन, वह मुफ़्त क़ानूनी प्रति जो अक्सर पहले से मौजूद है, किसी भंडार की प्रति, अंतर-पुस्तकालय अनुरोध, या लेखक को ईमेल। यह सब घर से पढ़ने वाली हमारी गाइड में है, और इन्हीं रास्तों से ज़्यादातर शोध-छात्र अपनी ज़रूरत का बड़ा हिस्सा पा लेते हैं।
दोनों समस्याओं को अलग रखना ज़रूरी है। छात्र अक्सर अपनी साहित्य-समीक्षा को उसी तक सीमित कर लेते हैं जो वे खोल सकते हैं — यानी खोज का फ़ैसला लाइसेंस के इत्तेफ़ाक़ से हो जाता है। पहले ढूँढ़िए, फिर तय कीजिए कि ज़रूरी क्या है, फिर सोचिए कि उसे पढ़ेंगे कैसे।
छात्रों और शोधकर्ताओं के लिए इसका मतलब
डॉक्टरेट छात्र के लिए क्रम ही पूरा संदेश है: स्ट्रिंग लिखिए, दर्ज कीजिए, कई जगह खोजिए — भारतीय स्रोतों समेत, दोनों दिशाओं में उद्धरण-शृंखला चलाइए, अलर्ट लगाइए, और सब कुछ नोट के साथ रेफ़रेंस मैनेजर में रखिए। इसमें कुछ भी कठिन नहीं है। पर यही सब आख़िरी साल में पीछे लौटकर करना कहीं ज़्यादा कठिन है।
गाइड के लिए यह एक घंटे की पढ़ाई है जो छात्र का एक सत्र बचाती है। ज़्यादातर शोधार्थियों को खोजना कभी सिखाया ही नहीं जाता — मान लिया जाता है कि यह अपने आप आता है — और यह कमी दो साल बाद ऐसी संदर्भ-सूची के रूप में दिखती है जो ठीक उन्हीं जगहों पर पतली होती है जहाँ परीक्षक कुरेदता है।
संस्थान के लिए सबसे ज़्यादा फ़ायदे वाला प्रशिक्षण यही है: डॉक्टरेट कार्यक्रम के पहले महीने में लाइब्रेरी की ओर से एक खोज-कार्यशाला, और वही कार्यशाला छह महीने बाद दोबारा — जब लोगों के पास लाने के लिए असली सवाल हो।
अक्सर पूछे जाने वाले सवाल
भारत में पीएचडी के लिए शोध-पत्र कैसे ढूँढ़ें?
बूलियन सर्च स्ट्रिंग बनाइए और दर्ज कीजिए, उसे कम-से-कम तीन तरह के स्रोतों में चलाइए — उद्धरण-सूचकांक, विषय-सूचकांक और खुला सूचकांक — भारतीय विषय के लिए भारतीय स्रोत अलग से जोड़िए, फिर अहम पेपरों से आगे और पीछे दोनों दिशाओं में उद्धरण-शृंखला चलाइए।
शोध-पत्र क़ानूनी रूप से डाउनलोड करने की सबसे अच्छी जगहें कौन-सी हैं?
ढूँढ़ने के लिए: सिमैंटिक स्कॉलर, OpenAlex, CORE, PubMed, और आपके संस्थान के सदस्यता वाले सूचकांक। खोलने के लिए: लाइब्रेरी की प्रॉक्सी या संस्थागत लॉगिन, Unpaywall से सामने आई भंडार-प्रति, कॉलेज सदस्य हो तो N-LIST, और डेलनेट के ज़रिए अंतर-पुस्तकालय अनुरोध।
ई-जर्नल से साहित्य-समीक्षा कैसे करें?
इसे पढ़ने की सूची नहीं, दर्ज की गई विधि मानिए: अवधारणाएँ और पर्यायवाची तय कीजिए, कई डेटाबेस में खोजिए, हर स्ट्रिंग और तारीख़ लिखिए, दोहराव हटाइए, हर चरण की गिनती रखिए, और यह भी दर्ज कीजिए कि क्या छोड़ा और क्यों।
विश्वविद्यालय की सदस्यता के बिना जर्नल कैसे पढ़ें?
पहले मुफ़्त क़ानूनी प्रति देखिए, NDLI तथा खुले भारतीय भंडार इस्तेमाल कीजिए, जिस लाइब्रेरी के पास अंतर-पुस्तकालय इंतज़ाम हो उससे अनुरोध कराइए, और संपर्क-लेखकों को लिखिए, जो आम तौर पर अपनी स्वीकृत पांडुलिपि साझा कर सकते हैं।
क्या पीएचडी की साहित्य-समीक्षा के लिए गूगल स्कॉलर काफ़ी है?
नहीं। वह काम का साथी है — ख़ासकर उसका "Cited by" — पर उसमें नियंत्रित शब्दावली नहीं, गुणवत्ता-छलनी नहीं, और दोहराई जा सकने वाली खोज का रिकॉर्ड नहीं। अकेले उसी पर टिकना डॉक्टरेट समीक्षाओं की सबसे आम कमज़ोरी है।
पीएचडी के पहले महीने में क्या करना चाहिए?
रेफ़रेंस मैनेजर की लाइब्रेरी बनाइए, ORCID बनाइए, अपने मुख्य डेटाबेस में सहेजी गई खोजों के अलर्ट लगाइए, और अपनी अहम पत्रिकाओं के विषय-सूची अलर्ट चालू कीजिए। फिर अपने क्षेत्र की तीन शोधगंगा थीसिस पढ़िए, ताकि दिख जाए कि आपके विषय में पूरी हुई थीसिस असल में कैसी होती है।