डिजिटल पुस्तकालय II: राष्ट्रीय और अंतर्राष्ट्रीय डिजिटल पुस्तकालय पहलें; संस्थागत भंडार, ROAR, OpenDOAR और शेरपा रोमियो; सामग्री प्रबंधन प्रणालियाँ; AI, विशेषज्ञ प्रणालियाँ, रोबोटिक्स, SMAC और क्लाउड कंप्यूटिंग; और ऑन्टोलॉजी, सिमेंटिक वेब, लिंक्ड डेटा, बिग डेटा, डेटा माइनिंग और डेटा हार्वेस्टिंग

इकाई VIII का दूसरा अध्याय मद 6 से 10 आच्छादित करता है: भारत और विदेश में डिजिटल पुस्तकालय पहलें; संस्थागत भंडार, उनकी आवश्यकता, उद्देश्य, प्रकार और उपकरण, भारत में भंडार, और पाठ्यक्रम में नामित पंजिकाएँ तथा नीति सेवाएँ (यह "ROAR, DOAR, SHARPA-ROMIO" छापता है, जिसका अर्थ ROAR, OpenDOAR और शेरपा रोमियो है); सामग्री प्रबंधन प्रणालियाँ; पुस्तकालयों में कृत्रिम बुद्धि, विशेषज्ञ प्रणालियाँ और रोबोटिक्स, SMAC और क्लाउड कंप्यूटिंग; और ऑन्टोलॉजी तथा उसके उपकरण (RDF, RDFS और प्रोटेजे, पाठ्यक्रम में "Potege" मुद्रित), सिमेंटिक वेब, लिंक्ड डेटा, बिग डेटा, डेटा माइनिंग और डेटा हार्वेस्टिंग।

1. डिजिटल पुस्तकालय पहलें: राष्ट्रीय और अंतर्राष्ट्रीय

भारतीय पहलएजेंसीसामग्री
भारत का राष्ट्रीय डिजिटल पुस्तकालय (NDLI)IIT खड़गपुर, शिक्षा मंत्रालय के ICT के माध्यम से शिक्षा पर राष्ट्रीय मिशन के अंतर्गतअनेक भारतीय और अंतर्राष्ट्रीय स्रोतों से संग्रहित मेटाडेटा पर एकल-खिड़की खोज, हर स्तर के शिक्षार्थियों हेतु
भारत का राष्ट्रीय आभासी पुस्तकालय (NVLI)संस्कृति मंत्रालय, राष्ट्रीय पुस्तकालय मिशनपुस्तकालयों, अभिलेखागारों और संग्रहालयों से सांस्कृतिक विरासत; इंडियन कल्चर पोर्टल से जुड़ा
शोधगंगा और शोधगंगोत्रीINFLIBNET, MPhil और PhD उपाधियों पर UGC के विनियमों के अंतर्गतपूर्ण-पाठ भारतीय डॉक्टरेट शोध-प्रबंध; प्रगतिरत शोध के सारांश
ई-पीजी पाठशाला और स्वयंUGC और शिक्षा मंत्रालयस्नातकोत्तर ई-सामग्री मॉड्यूल; ऑनलाइन पाठ्यक्रम
राष्ट्रीय पांडुलिपि मिशनसंस्कृति मंत्रालय, 2003 से, इंदिरा गांधी राष्ट्रीय कला केंद्र के साथपांडुलिपियों का सर्वेक्षण, प्रलेखन, संरक्षण और अंकीकरण (कृति संपदा डेटाबेस); केंद्रीय बजट 2025-26 ने पांडुलिपि सर्वेक्षण, प्रलेखन और संरक्षण को आगे बढ़ाने हेतु ज्ञान भारतम मिशन की घोषणा की
डिजिटल लाइब्रेरी ऑफ़ इंडियाभारतीय विज्ञान संस्थान और साझेदार, कार्नेगी मेलन की मिलियन बुक प्रोजेक्ट के साथ, 2000 के दशक मेंपुस्तकों का बड़े पैमाने पर स्कैनिंग, अनेक भारतीय भाषाओं में; एक आरंभिक पड़ाव, अब बंद
अंतर्राष्ट्रीय पहलआरंभ और स्वरूप
प्रोजेक्ट गुटेनबर्ग1971, माइकल हार्ट; लोक-अधिकार कृतियों की निःशुल्क ई-पुस्तकें, सबसे पुराना डिजिटल पुस्तकालय
अमेरिकन मेमोरीलाइब्रेरी ऑफ़ कांग्रेस, 1990 से पायलट; अंकीकृत अमेरिकी इतिहास संग्रह
इंटरनेट आर्काइव1996; वेब संग्रह (वेबैक मशीन), पुस्तकें, ऑडियो और वीडियो
गालिकाबिब्लियोथेक नैशनल द फ़्रांस, 1997
गूगल बुक्स2004; साझेदार पुस्तकालयों के साथ बड़े पैमाने पर अंकीकरण
यूरोपियाना और हाथीट्रस्टदोनों 2008; यूरोपीय सांस्कृतिक विरासत समूहक; अंकीकृत खंड साझा करने वाली शोध पुस्तकालयों की साझेदारी
वर्ल्ड डिजिटल लाइब्रेरीयूनेस्को और लाइब्रेरी ऑफ़ कांग्रेस, 2009; इसकी सामग्री अब लाइब्रेरी ऑफ़ कांग्रेस के संग्रहों का भाग है
डिजिटल पब्लिक लाइब्रेरी ऑफ़ अमेरिका2013; अमेरिकी पुस्तकालयों, अभिलेखागारों और संग्रहालयों का समूहक

2. संस्थागत भंडार: आवश्यकता, उद्देश्य, प्रकार और उपकरण; भारत; ROAR, OpenDOAR और शेरपा रोमियो

क्लिफ़र्ड लिंच (2003) ने विश्वविद्यालय-आधारित संस्थागत भंडार को सेवाओं का वह समुच्चय बताया जो विश्वविद्यालय अपने समुदाय के सदस्यों को संस्था और उसके सदस्यों द्वारा बनाई डिजिटल सामग्री के प्रबंधन और प्रसार हेतु देता है। भंडार शोध-प्रबंध, लेख (प्रीप्रिंट या स्वीकृत पांडुलिपि के रूप में, मुक्त पहुँच का "ग्रीन" मार्ग), रिपोर्ट, आँकड़े, अधिगम सामग्री और अभिलेख एकत्र, परिरक्षित करते और उन तक मुक्त पहुँच देते हैं। इनकी आवश्यकता शोध की दृश्यता और प्रभाव बढ़ाने, संस्था के बौद्धिक उत्पादन को सुरक्षित रखने, वित्तदाता और संस्थागत मुक्त पहुँच आदेशों के अनुपालन, और शोध मूल्यांकन के समर्थन हेतु है। प्रकार हैं संस्थागत भंडार; विषय या अनुशासनात्मक भंडार, जैसे arXiv (1991), पबमेड सेंट्रल (2000), RePEc और पुस्तकालय एवं सूचना विज्ञान हेतु E-LIS; ज़ेनोडो (CERN) और ड्रायड जैसे आँकड़ा भंडार; और शोधगंगा जैसे राष्ट्रीय भंडार। उपकरणों में DSpace (MIT और ह्यूलेट-पैकार्ड, 2002), EPrints (साउथैम्पटन विश्वविद्यालय, 2000), फ़ेडोरा, ग्रीनस्टोन और इनवेनियो आते हैं। भारत में ePrints@IISc पहले संस्थागत भंडारों में था, और अनेक IIT, IISER, विश्वविद्यालय और CSIR प्रयोगशालाएँ अब भंडार चलाती हैं, अधिकांश DSpace या EPrints पर।

सेवायह क्या है
ROAR (मुक्त पहुँच भंडारों की पंजिका)साउथैम्पटन विश्वविद्यालय द्वारा होस्ट भंडारों की पंजिका, 2003 से, भंडार वृद्धि अभिलिखित करती है
OpenDOAR (मुक्त पहुँच भंडारों की निर्देशिका)भंडारों की गुणवत्ता-जाँची निर्देशिका, 2005 में नॉटिंघम विश्वविद्यालय में आरंभ और अब Jisc द्वारा संचालित; पाठ्यक्रम का "DOAR"
शेरपा रोमियोप्रकाशकों और पत्रिकाओं की प्रतिलिप्यधिकार और मुक्त पहुँच स्व-संग्रह नीतियों का सारांश देने वाली Jisc सेवा: कौन-सा संस्करण (प्रस्तुत, स्वीकृत या प्रकाशित) कहाँ और किस प्रतिबंध-अवधि के बाद जमा किया जा सकता है; पहले यह प्रकाशकों को रंग से समूहित करती थी और अब अनुमत संस्करण और शर्तें सूचीबद्ध करती है; पाठ्यक्रम का "SHARPA-ROMIO"
ℹ️ पाठ्यक्रम की वर्तनियाँ
पाठ्यक्रम "ROAR, DOAR, SHARPA-ROMIO" छापता है। सेवाएँ ROAR, OpenDOAR (मुक्त पहुँच भंडारों की निर्देशिका) और शेरपा रोमियो हैं, वह नाम जो Jisc सेवा उपयोग करती है; "SHARPA-ROMIO" मुद्रण-दोष है।

3. सामग्री प्रबंधन प्रणालियाँ

सामग्री प्रबंधन प्रणाली (CMS) लोगों को कूट लिखे बिना डिजिटल सामग्री, सामान्यतः वेबसाइट, बनाने, संपादित करने, संगठित करने और प्रकाशित करने देती है। इसकी वास्तुकला सामग्री भंडार (सामग्री इकाइयों और मेटाडेटा का डेटाबेस), सामग्री प्रबंधन अनुप्रयोग (लेखन, संपादन, कार्यप्रवाह और अनुमोदन, संस्करण नियंत्रण, उपयोगकर्ता भूमिकाएँ और अनुमतियाँ) और सामग्री वितरण अनुप्रयोग (सामग्री प्रस्तुत करने वाले टेम्पलेट और थीम) को अलग करती है; "हेडलेस" CMS API द्वारा किसी भी अग्र-भाग तक सामग्री पहुँचाता है। आँकड़ा एकीकरण CMS को अन्य प्रणालियों से जोड़ता है: ILS से सूची खोज बॉक्स और नई सामग्री फ़ीड, API या OAI-PMH द्वारा भंडार सामग्री, खोज-सेवा विजेट, RSS और सोशल मीडिया, और एकल साइन-ऑन। व्यापक रूप से प्रयुक्त मुक्त स्रोत CMS सॉफ़्टवेयर में वर्डप्रेस (2003), ड्रुपल (2001) और जूमला (2005) आते हैं; पुस्तकालय विषय मार्गदर्शिकाओं हेतु होस्टेड मंच भी उपयोग करते हैं। चयन कार्यक्षमता, गैर-तकनीकी कर्मचारियों हेतु उपयोग की सुगमता, सुलभता, सुरक्षा और अद्यतन अभिलेख, मॉड्यूलों और प्लगइनों द्वारा विस्तार-क्षमता, समुदाय और विक्रेता सहायता, होस्टिंग और लागत तौलता है। क्रियान्वयन में सामग्री लेखा-परीक्षा और स्थानांतरण, अभिकल्प, प्रशिक्षण और आरंभ आते हैं; मूल्यांकन वेब विश्लेषण, उपयोगिता परीक्षण और उपयोगकर्ता प्रतिपुष्टि का उपयोग करता है।

4. कृत्रिम बुद्धि, विशेषज्ञ प्रणालियाँ और रोबोटिक्स; SMAC; क्लाउड कंप्यूटिंग

कृत्रिम बुद्धि (AI) मशीनों की वह क्षमता है जिससे वे बुद्धि चाहने वाले कार्य करें, जैसे भाषा समझना, प्रतिरूप पहचानना, सीखना और तर्क करना। विशेषज्ञ प्रणाली किसी संकीर्ण क्षेत्र में मानव विशेषज्ञों का ज्ञान ग्रहण करती है: इसमें तथ्यों और नियमों का ज्ञान आधार, उनसे तर्क करने वाला अनुमान इंजन, उपयोगकर्ता अंतरफलक और व्याख्या सुविधा होती है; आरंभिक उदाहरण DENDRAL और MYCIN थे, और पुस्तकालय अनुप्रयोगों में सूचीकरण और संदर्भ सलाहकार रहे हैं। पुस्तकालयों में वर्तमान AI में नियमित प्रश्नों हेतु चैटबॉट, अनुशंसा प्रणालियाँ, स्वचालित विषय अनुक्रमणीकरण और मेटाडेटा सृजन, OCR और हस्तलेख अभिज्ञान, सुलभता हेतु वाक्-से-पाठ, और बड़े भाषा मॉडलों पर बनी जनरेटिव AI आती है, जिसे परखना पुस्तकालयाध्यक्षों को उपयोगकर्ताओं को सिखाना भी होता है, क्योंकि ऐसे उपकरण संदर्भ गढ़ सकते हैं, पूर्वाग्रह दोहरा सकते हैं और प्रतिलिप्यधिकार तथा सत्यनिष्ठा के प्रश्न उठाते हैं। पुस्तकालयों में रोबोटिक्स उच्च-घनत्व भंडारों से सामग्री लाने वाली स्वचालित भंडारण और पुनर्प्राप्ति प्रणालियाँ, लौटाई पुस्तकें छाँटने वाला स्वचालित सामग्री प्रबंधन, अलमारी-स्कैनिंग मालसूची रोबोट, और टेलीप्रेज़ेंस या मार्गदर्शक रोबोट आच्छादित करती है। SMAC सोशल मीडिया, मोबाइल प्रौद्योगिकी, विश्लेषण और क्लाउड कंप्यूटिंग का अभिसरण है, प्रत्येक दूसरों को सशक्त करते हुए: सेवाएँ फ़ोनों और सामाजिक मंचों पर उपयोगकर्ताओं तक पहुँचती हैं, आँकड़े उत्पन्न करती हैं जिन्हें विश्लेषण अंतर्दृष्टि में बदलता है, और क्लाउड अवसंरचना पर चलती हैं।

क्लाउड कंप्यूटिंग (NIST परिभाषा, 2011)सामग्री
पाँच अनिवार्य विशेषताएँमाँग पर स्व-सेवा, व्यापक नेटवर्क पहुँच, संसाधन संयोजन, तीव्र लोच और मापित सेवा
तीन सेवा मॉडलसॉफ़्टवेयर एक सेवा के रूप में (SaaS: होस्टेड पुस्तकालय प्रणाली या ई-मेल), मंच एक सेवा के रूप में (PaaS: विकास मंच) और अवसंरचना एक सेवा के रूप में (IaaS: किराए के सर्वर और भंडारण)
चार परिनियोजन मॉडलसार्वजनिक, निजी, सामुदायिक और संकर क्लाउड
पुस्तकालयों मेंक्लाउड-होस्टेड पुस्तकालय सेवा मंच और होस्टेड कोहा, भंडार और बैकअप भंडारण, साझा कार्यालय सूट; लागत और विस्तार-क्षमता के लाभों को आँकड़ों के स्थान, निजता, विक्रेता पर निर्भरता और संपर्क पर निर्भरता से तौला जाता है

5. ऑन्टोलॉजी और उसके उपकरण; सिमेंटिक वेब, लिंक्ड डेटा, बिग डेटा, डेटा माइनिंग और डेटा हार्वेस्टिंग

कंप्यूटिंग में ऑन्टोलॉजी, टॉम ग्रूबर के शब्दों में (1993), "किसी संकल्पनाकरण का सुस्पष्ट विनिर्देश" है: किसी क्षेत्र के वर्गों, उनके गुणों और संबंधों, उनसे संबंधित व्यष्टियों, और तर्क संभव बनाने वाले नियमों (स्वयंसिद्धों) का औपचारिक मॉडल। RDF (रिसोर्स डिस्क्रिप्शन फ़्रेमवर्क, 1999 से W3C अनुशंसा, 2014 में RDF 1.1 के रूप में संशोधित) आँकड़ों को कर्ता, विधेय और कर्म के त्रिकों के रूप में व्यक्त करता है, प्रत्येक एक URI से नामित, जो मिलकर एक ग्राफ़ बनाते हैं। RDFS (RDF स्कीमा) वर्गों और गुणों के वर्णन हेतु मूल शब्दावली जोड़ता है, जैसे rdfs:Class, rdfs:subClassOf, rdfs:domain और rdfs:range; OWL (वेब ऑन्टोलॉजी लैंग्वेज, 2004; OWL 2, 2009) समृद्ध तर्क जोड़ता है; SPARQL (2008) RDF पर प्रश्न करता है। प्रोटेजे, स्टैनफ़र्ड विश्वविद्यालय के जैव-चिकित्सा सूचना-विज्ञान शोध केंद्र का निःशुल्क, मुक्त स्रोत ऑन्टोलॉजी संपादक, वह उपकरण है जिसे पाठ्यक्रम "Potege" छापता है। सिमेंटिक वेब, जिसे टिम बर्नर्स-ली, जेम्स हेंडलर और ओरा लसिला ने साइंटिफ़िक अमेरिकन (2001) में प्रस्तुत किया, आँकड़ों का ऐसा वेब है जिसकी मशीनें व्याख्या कर सकें, URI और यूनिकोड से XML, RDF, RDFS और OWL होते हुए तर्क, प्रमाण और विश्वास तक स्तरों में बना।

  • लिंक्ड डेटा: बर्नर्स-ली के चार सिद्धांत (2006) हैं वस्तुओं के नामों के रूप में URI का उपयोग; HTTP URI का उपयोग ताकि लोग उन्हें देख सकें; URI देखे जाने पर मानक प्रारूपों (RDF, SPARQL) में उपयोगी सूचना देना; और अन्य URI के लिंक जोड़ना ताकि और वस्तुएँ खोजी जा सकें। उनकी पाँच-तारा योजना (2010) मुक्त आँकड़ों को एक तारे (मुक्त लाइसेंस के अंतर्गत वेब पर उपलब्ध) से पाँच (अन्य आँकड़ों से जुड़े) तक श्रेणीबद्ध करती है। पुस्तकालय उदाहरण हैं लाइब्रेरी ऑफ़ कांग्रेस का id.loc.gov (लिंक्ड डेटा के रूप में LCSH और अन्य शब्दावलियाँ), VIAF (वर्चुअल इंटरनेशनल अथॉरिटी फ़ाइल, OCLC द्वारा होस्ट), विकिडेटा और BIBFRAME।
  • बिग डेटा: सामान्य उपकरणों हेतु बहुत बड़े या तीव्र आँकड़ा-समुच्चय, डग लैनी के तीन V (2001), मात्रा, वेग और विविधता, द्वारा वर्णित, प्रायः सत्यता और मूल्य से विस्तृत; पुस्तकालय इसे उपयोग लॉग, शोध आँकड़ों और अंकीकृत पाठ संग्रहों में पाते हैं।
  • डेटा माइनिंग: डेटाबेसों में ज्ञान खोज (चयन, पूर्व-प्रसंस्करण, रूपांतरण, खनन, व्याख्या) के भाग के रूप में बड़े आँकड़ा-समुच्चयों में प्रतिरूप खोजना, वर्गीकरण, गुच्छन, साहचर्य नियमों ("जिन्होंने यह उधार लिया उन्होंने वह भी लिया") और पाठ खनन का उपयोग कर।
  • डेटा हार्वेस्टिंग: अनेक स्रोतों से आँकड़ों या मेटाडेटा का स्वचालित संग्रह, जैसे समूहकों (CORE, BASE, NDLI) द्वारा OAI-PMH संग्रहण, वेब संग्रहों हेतु वेब क्रॉलिंग, और API-आधारित संग्रह; इसे लाइसेंसों, निजता और रोबोट नियमों का सम्मान करना चाहिए।
ℹ️ पाठ्यक्रम का "Potege"
पाठ्यक्रम ऑन्टोलॉजी उपकरणों को "RDF, RDFS, Potege" के रूप में सूचीबद्ध करता है। उपकरण प्रोटेजे (Protégé) है, स्टैनफ़र्ड का ऑन्टोलॉजी संपादक; RDF और RDFS कड़े अर्थ में उपकरण के बजाय W3C मानक हैं, पर ऑन्टोलॉजी संपादक यही उत्पन्न करता है।

मुख्य बिंदु

  • भारतीय पहलें: NDLI (IIT खड़गपुर), NVLI (राष्ट्रीय पुस्तकालय मिशन), शोधगंगा, ई-पीजी पाठशाला और स्वयं, राष्ट्रीय पांडुलिपि मिशन (2003) और ज्ञान भारतम मिशन (बजट 2025-26); अंतर्राष्ट्रीय: प्रोजेक्ट गुटेनबर्ग (1971), अमेरिकन मेमोरी, इंटरनेट आर्काइव (1996), गालिका (1997), गूगल बुक्स (2004), यूरोपियाना और हाथीट्रस्ट (2008), वर्ल्ड डिजिटल लाइब्रेरी (2009), DPLA (2013)।
  • संस्थागत भंडार (लिंच, 2003) ग्रीन मुक्त पहुँच और परिरक्षण देते हैं; प्रकार संस्थागत, विषय (arXiv, पबमेड सेंट्रल, E-LIS), आँकड़ा (ज़ेनोडो) और राष्ट्रीय (शोधगंगा) हैं; उपकरण DSpace (2002), EPrints (2000), फ़ेडोरा; पंजिकाएँ ROAR (2003) और OpenDOAR (2005), और नीति सेवा शेरपा रोमियो (पाठ्यक्रम का "SHARPA-ROMIO")।
  • CMS भंडार, प्रबंधन और वितरण अनुप्रयोगों को अलग करता है; वर्डप्रेस, ड्रुपल और जूमला सामान्य हैं; चयन उपयोगिता, सुरक्षा, विस्तार-क्षमता, सहायता और लागत तौलता है।
  • विशेषज्ञ प्रणालियों में ज्ञान आधार, अनुमान इंजन, अंतरफलक और व्याख्या सुविधा होती है; AI और रोबोटिक्स चैटबॉट, अनुक्रमणीकरण, अनुशंसा, ASRS और छँटाई का समर्थन करते हैं; SMAC सोशल, मोबाइल, विश्लेषण और क्लाउड है; NIST (2011) पाँच विशेषताएँ, तीन सेवा मॉडल (SaaS, PaaS, IaaS) और चार परिनियोजन मॉडल देता है।
  • ऑन्टोलॉजी किसी संकल्पनाकरण का सुस्पष्ट विनिर्देश है (ग्रूबर, 1993); RDF त्रिक, RDFS, OWL और SPARQL, प्रोटेजे (पाठ्यक्रम का "Potege") में संपादित; सिमेंटिक वेब (2001), लिंक्ड डेटा के चार सिद्धांत (2006), बिग डेटा के तीन V, डेटा माइनिंग और OAI-PMH संग्रहण।

अभ्यास प्रश्न (10)

उत्तर खोलने से पहले प्रत्येक प्रश्न हल करें। हर व्याख्या सही विकल्प के साथ लुभावना गलत विकल्प भी बताती है, क्योंकि अंक वहीं जाते हैं।

  1. भंडारों में जमा करने वाले लेखकों हेतु प्रकाशकों की प्रतिलिप्यधिकार और स्व-संग्रह नीतियों का सारांश कौन-सी सेवा देती है?

    1. OpenDOAR
    2. ROAR
    3. यूरोपियाना
    4. शेरपा रोमियो
    उत्तर देखें

    उत्तर: D — शेरपा रोमियो

    Jisc द्वारा संचालित शेरपा रोमियो अभिलिखित करती है कि लेख का कौन-सा संस्करण किन शर्तों पर जमा किया जा सकता है। OpenDOAR और ROAR भंडार सूचीबद्ध करते हैं, और यूरोपियाना यूरोपीय सांस्कृतिक विरासत एकत्र करता है।
  2. RDF में हर कथन किसके त्रिक के रूप में व्यक्त होता है?

    1. कृति, अभिव्यक्ति और प्रकटीकरण
    2. कर्ता, विधेय और कर्म
    3. शीर्षक, सृजक और विषय
    4. लीडर, निर्देशिका और क्षेत्र
    उत्तर देखें

    उत्तर: B — कर्ता, विधेय और कर्म

    RDF संसाधनों का वर्णन कर्ता-विधेय-कर्म त्रिकों से करता है, हर भाग एक URI से नामित, जो एक ग्राफ़ बनाते हैं। अन्य विकल्प FRBR सत्ताएँ, ISO 2709 अभिलेख संरचना और डबलिन कोर तत्व हैं।
  3. NIST परिभाषा क्लाउड कंप्यूटिंग के कितने सेवा मॉडल मानती है? संख्या लिखिए।

    संख्यात्मक उत्तर — मान टाइप करें।

    उत्तर देखें

    उत्तर: 3

    NIST की परिभाषा (2011) तीन सेवा मॉडल, सॉफ़्टवेयर, मंच और अवसंरचना एक सेवा के रूप में, नामित करती है, पाँच अनिवार्य विशेषताओं और चार परिनियोजन मॉडलों के साथ।
  4. निम्न में से कौन-से विशेषज्ञ प्रणाली के घटक हैं? सभी सही चुनिए।

    1. अनुमान इंजन
    2. ज्ञान आधार
    3. लिंक रिज़ॉल्वर
    4. व्याख्या सुविधा
    उत्तर देखें

    उत्तर: A — अनुमान इंजन; B — ज्ञान आधार; D — व्याख्या सुविधा

    विशेषज्ञ प्रणाली तथ्यों और नियमों के ज्ञान आधार, उनसे तर्क करने वाले अनुमान इंजन, उपयोगकर्ता अंतरफलक और यह दिखाने वाली व्याख्या सुविधा को जोड़ती है कि निष्कर्ष कैसे निकला। लिंक रिज़ॉल्वर ई-संसाधनों हेतु OpenURL उपकरण है।
  5. अभिकथन (A): संस्थागत भंडार में स्वीकृत पांडुलिपि जमा करना ग्रीन मुक्त पहुँच का एक रूप है। कारण (R): ग्रीन मुक्त पहुँच का अर्थ है कि पत्रिका स्वयं लेख को अपनी वेबसाइट पर पढ़ने हेतु निःशुल्क प्रकाशित करती है। सही विकल्प चुनिए।

    1. A और R दोनों सत्य हैं, और R, A की सही व्याख्या है
    2. A और R दोनों सत्य हैं, पर R, A की सही व्याख्या नहीं है
    3. A सत्य है, पर R असत्य है
    4. A असत्य है, पर R सत्य है
    उत्तर देखें

    उत्तर: C — A सत्य है, पर R असत्य है

    A सत्य है और R असत्य। ग्रीन मुक्त पहुँच लेखक द्वारा भंडार में स्व-संग्रह है; पत्रिका द्वारा स्वयं पढ़ने हेतु निःशुल्क प्रकाशन गोल्ड मुक्त पहुँच है।
  6. व्यापक रूप से प्रयुक्त भंडार सॉफ़्टवेयर DSpace किसके द्वारा विकसित किया गया?

    1. साउथैम्पटन विश्वविद्यालय
    2. वाइकाटो विश्वविद्यालय
    3. MIT और ह्यूलेट-पैकार्ड
    4. CERN
    उत्तर देखें

    उत्तर: C — MIT और ह्यूलेट-पैकार्ड

    DSpace 2002 में MIT लाइब्रेरीज़ और ह्यूलेट-पैकार्ड द्वारा जारी हुआ। साउथैम्पटन ने EPrints, CERN ने इनवेनियो विकसित किया और ज़ेनोडो चलाता है, और वाइकाटो ने ग्रीनस्टोन विकसित किया।
  7. निम्न में से कौन-से टिम बर्नर्स-ली के लिंक्ड डेटा सिद्धांतों में हैं? सभी सही चुनिए।

    1. वस्तुओं के नामों के रूप में URI का उपयोग कीजिए
    2. अन्य URI के लिंक जोड़िए
    3. सभी अभिलेख MARC 21 में कूटित कीजिए
    4. सारे आँकड़े एक केंद्रीय डेटाबेस में रखिए
    उत्तर देखें

    उत्तर: A — वस्तुओं के नामों के रूप में URI का उपयोग कीजिए; B — अन्य URI के लिंक जोड़िए

    चार सिद्धांत हैं नामों के रूप में URI, HTTP URI का उपयोग, URI देखे जाने पर RDF जैसे मानक प्रारूपों में उपयोगी सूचना देना, और अन्य URI से जोड़ना। लिंक्ड डेटा वितरित है, केंद्रीकृत नहीं, और MARC की अपेक्षा नहीं करता।
  8. डग लैनी के बिग डेटा के मूल वर्णन में कितने V थे? संख्या लिखिए।

    संख्यात्मक उत्तर — मान टाइप करें।

    उत्तर देखें

    उत्तर: 3

    लैनी (2001) ने मात्रा, वेग और विविधता का वर्णन किया। बाद के लेखकों ने सत्यता और मूल्य जोड़े, जिससे चार या पाँच V बने, पर मूल मॉडल में तीन हैं।
  9. एक पुस्तकालय अपने परिसंचरण अभिलेखों का विश्लेषण कर पाता है कि सांख्यिकी पाठ्यपुस्तक उधार लेने वाले विद्यार्थी प्रायः SPSS नियमावली भी उधार लेते हैं। यह किस डेटा माइनिंग तकनीक को दर्शाता है?

    1. साहचर्य नियम खनन
    2. डेटा हार्वेस्टिंग
    3. एन्क्रिप्शन
    4. अनुकरण
    उत्तर देखें

    उत्तर: A — साहचर्य नियम खनन

    साथ-साथ आने वाली सामग्रियाँ खोजना साहचर्य नियम खनन है, "इसे उधार लेने वाले पाठकों ने यह भी लिया" अनुशंसाओं का आधार। हार्वेस्टिंग आँकड़े एकत्र करती है, अनुकरण परिरक्षण विधि है, और एन्क्रिप्शन आँकड़ों की रक्षा करता है।
  10. पाठ्यक्रम ऑन्टोलॉजी उपकरणों में "Potege" सूचीबद्ध करता है। अभिप्रेत उपकरण है:

    1. PREMIS, परिरक्षण मेटाडेटा शब्दकोश
    2. प्रोटेजे, स्टैनफ़र्ड विश्वविद्यालय का ऑन्टोलॉजी संपादक
    3. पोर्टिको, ई-पत्रिका संग्रह
    4. PRECIS, अनुक्रमणीकरण प्रणाली
    उत्तर देखें

    उत्तर: B — प्रोटेजे, स्टैनफ़र्ड विश्वविद्यालय का ऑन्टोलॉजी संपादक

    "Potege" प्रोटेजे का मुद्रण-दोष है, स्टैनफ़र्ड के जैव-चिकित्सा सूचना-विज्ञान शोध केंद्र का निःशुल्क, मुक्त स्रोत ऑन्टोलॉजी संपादक। PREMIS परिरक्षण मेटाडेटा, पोर्टिको अंधकार संग्रह, और PRECIS ऑस्टिन की अनुक्रमणीकरण प्रणाली है।