ज्ञान संगठन III: अनुक्रमणीकरण प्रणालियाँ और तकनीकें, नियत और व्युत्पन्न, पूर्व-समन्वित और पश्च-समन्वित; शब्दावली नियंत्रण; सारकरण, उसके प्रकार और दिशानिर्देश; और सूचना पुनर्प्राप्ति प्रणालियाँ, उनकी विशेषताएँ, घटक, मॉडल और मूल्यांकन

इकाई V का तीसरा अध्याय मद 8 से 10 आच्छादित करता है, ज्ञान संगठन का वह भाग जो अलमारी में रखने के बजाय खोज की सेवा करता है। यह अनुक्रमणीकरण प्रणालियों को पाठ्यक्रम के वर्गीकरण के अनुसार प्रस्तुत करता है, पूर्व-समन्वित और पश्च-समन्वित रूपों में नियत अनुक्रमणीकरण और व्युत्पन्न, शीर्षक-आधारित अनुक्रमणीकरण, हल किए गए शृंखला अनुक्रमणीकरण सहित; विषय शीर्षक सूचियों और थिसॉरस द्वारा शब्दावली नियंत्रण; सारकरण, उसके प्रकार और उसका मार्गदर्शन करने वाले मानक; और सूचना पुनर्प्राप्ति प्रणालियाँ, उनकी विशेषताएँ, घटक और मॉडल, अंत में संख्याओं से हल किए गए पुनःस्मरण और परिशुद्धता द्वारा मूल्यांकन के साथ।

1. अनुक्रमणीकरण प्रणालियाँ: नियत, पूर्व-समन्वित और पश्च-समन्वित

अनुक्रमणीकरण प्रलेखों की विषय-सामग्री को अनुक्रमणी पदों द्वारा प्रस्तुत करता है ताकि उन्हें पुनः प्राप्त किया जा सके। नियत अनुक्रमणीकरण में प्रशिक्षित अनुक्रमणिकार पद चुनता है, सामान्यतः नियंत्रित शब्दावली से, जिनका प्रलेख में होना आवश्यक नहीं। व्युत्पन्न अनुक्रमणीकरण में पद प्रलेख से ही, उसके शीर्षक, सार या पाठ से, लिए जाते हैं। नियत अनुक्रमणीकरण को आगे इससे बाँटा जाता है कि संकल्पनाएँ कब जोड़ी जाती हैं। पूर्व-समन्वित अनुक्रमणीकरण में अनुक्रमणिकार अनुक्रमणीकरण के समय संकल्पनाओं को एक निश्चित उद्धरण क्रम में शृंखला में जोड़ता है, अतः अनुक्रमणी मिश्रित विषयों को तैयार शीर्षकों के रूप में दिखाती है (शास्त्रीय मुद्रित अनुक्रमणी)। पश्च-समन्वित अनुक्रमणीकरण में हर संकल्पना अलग अनुक्रमित होती है और खोजकर्ता उन्हें खोज के समय जोड़ता है, और हर कंप्यूटर डेटाबेस बूलियन संचालकों के साथ ऐसे ही कार्य करता है।

प्रणालीप्रवर्तक और तिथिमुख्य विशेषताएँ
कैसर का व्यवस्थित अनुक्रमणीकरणजे. कैसर, 1911पूर्व-समन्वित; पद मूर्त, प्रक्रियाएँ और देश हैं, उसी क्रम में उद्धृत
शृंखला अनुक्रमणीकरणएस. आर. रंगनाथन, 1938पूर्व-समन्वित; वर्ग संख्या की शृंखला से विषय अनुक्रमणी प्रविष्टियाँ व्युत्पन्न करता है, हर कड़ी एक प्रविष्टि, अंतिम कड़ी पहले
संबंधात्मक अनुक्रमणीकरणजे. ई. एल. फ़ैराडेन, 1950 का दशकपूर्व-समन्वित; संकल्पनाओं के बीच संबंध व्यक्त करने वाले संचालकों से जुड़े पद
PRECIS (संरक्षित संदर्भ अनुक्रमणी प्रणाली)डेरेक ऑस्टिन, ब्रिटिश राष्ट्रीय ग्रंथसूची, 1974पूर्व-समन्वित; भूमिका संचालक शृंखला का क्रम देते हैं; "शंटिंग" पदों को घुमाती है ताकि हर प्रविष्टि अपना संदर्भ बनाए रखे; BNB में 1991 में COMPASS द्वारा प्रतिस्थापित
POPSI (अभिधारणा-आधारित क्रमपरिवर्तित विषय अनुक्रमणीकरण)जी. भट्टाचार्य, DRTC, 1970 का दशकपूर्व-समन्वित; रंगनाथन की अभिधारणाओं पर आधारित, प्रारंभिक श्रेणियाँ विषयानुशासन, सत्ता, क्रिया और गुण, और प्रविष्टियों हेतु पदों का क्रमपरिवर्तन
यूनिटर्ममॉर्टिमर टॉब, 1953पश्च-समन्वित; एकल-शब्द पद, हर एक प्रलेख संख्याओं वाले कार्ड पर; खोजकर्ता साझा संख्याओं हेतु कार्डों की तुलना करता है
प्रकाशीय संयोग (पीक-अ-बू) कार्डडब्ल्यू. ई. बैटन, 1940 का दशकपश्च-समन्वित; प्रति पद एक कार्ड जिसमें प्रलेख-संख्या स्थानों पर छेद; कार्डों को एक पर एक रखकर प्रकाश में देखने पर सभी पदों वाले प्रलेख दिखते हैं

DDC से हल किया शृंखला अनुक्रमणीकरण: संख्या 330.954 की शृंखला है 300 सामाजिक विज्ञान, 330 अर्थशास्त्र, 330.9 आर्थिक दशाएँ, 330.954 भारत। शृंखला प्रक्रिया हर उस कड़ी हेतु एक प्रविष्टि लिखती है जिसे उपयोगकर्ता खोज सकते हैं, अंतिम से आरंभ कर ऊँची कड़ियों को विशेषक के रूप में जोड़ते हुए: "India, Economic conditions, Economics 330.954"; "Economic conditions, Economics 330.9"; "Economics 330"; "Social sciences 300"। भारत, आर्थिक दशाएँ या अर्थशास्त्र खोजने वाला उपयोगकर्ता सही वर्ग संख्या तक पहुँचता है। विधि किफ़ायती है, पर हर प्रविष्टि की केवल अंतिम कड़ी पूर्णतः विशिष्ट होती है, और यह पूरी तरह वर्गीकरण पद्धति की शृंखला पर निर्भर करती है।

2. व्युत्पन्न, शीर्षक-आधारित अनुक्रमणीकरण

व्युत्पन्न अनुक्रमणीकरण प्रलेख से, मूलतः शीर्षकों से, महत्वपूर्ण शब्द लेता है, जो इतना सस्ता है कि कंप्यूटर कर सके। IBM के एच. पी. लुन ने लगभग 1958-60 में संदर्भ-में-कीवर्ड (KWIC) अनुक्रमणी प्रस्तुत की: "a", "of" और "the" जैसे निरर्थक शब्द हटाने के बाद हर महत्वपूर्ण शीर्षक शब्द एक प्रवेश-बिंदु बनता है, जो केंद्रीय स्तंभ में संरेखित छपता है और शेष शीर्षक उसके चारों ओर लिपटा रहता है, ताकि संदर्भ दिखे। संदर्भ-से-बाहर-कीवर्ड (KWOC) कीवर्ड को हाशिये में शीर्षक के रूप में और पूरा शीर्षक उसके नीचे छापता है; कीवर्ड-और-संदर्भ (KWAC) शीर्षक को अक्षुण्ण रखता है और विस्थापित शब्दों को जोड़ देता है। शीर्षक-आधारित अनुक्रमणियाँ तीव्र और सामयिक होती हैं (केमिकल टाइटल्स, 1960, आरंभिक KWIC अनुक्रमणी थी) पर शीर्षकों की सूचनात्मकता पर निर्भर होती हैं, पर्यायों को एक साथ नहीं ला सकतीं और संबंधित संकल्पनाओं को बिखेर देती हैं; जोड़े गए कीवर्डों से संवर्धन इसका आंशिक उपचार करता है। उद्धरण अनुक्रमणीकरण, यूजीन गारफ़ील्ड द्वारा 1955 में प्रस्तावित, एक और व्युत्पन्न विधि है: इसमें "पद" वे संदर्भ हैं जिन्हें प्रलेख उद्धृत करता है।

⚠️ KWIC व्युत्पन्न है, नियत नहीं
KWIC, KWOC और KWAC शीर्षकों में वास्तव में आने वाले शब्दों का उपयोग करते हैं, बिना नियंत्रित शब्दावली के, अतः वे व्युत्पन्न अनुक्रमणीकरण हैं। शृंखला अनुक्रमणीकरण, PRECIS और POPSI नियमों और किसी वर्गीकरण या शब्दावली के अनुसार पद नियत करते हैं, अतः वे नियत और पूर्व-समन्वित हैं।

3. शब्दावली नियंत्रण

प्राकृतिक भाषा में पर्याय (एक संकल्पना हेतु अनेक शब्द: कारें, मोटरगाड़ियाँ), समनाम (अनेक संकल्पनाओं हेतु एक शब्द: पारा धातु, बुध ग्रह और देवता हेतु mercury) और वर्तनी रूपांतर होते हैं, और यह पदानुक्रम नहीं दिखाती। शब्दावली नियंत्रण हर संकल्पना हेतु एक वरीय पद तय करता है, अवरीय पदों से उपयोगकर्ताओं को संदर्भित करता है, समनामों को विशेषकों से अलग करता है, और व्यापक, संकीर्ण तथा संबंधित संकल्पनाएँ अभिलिखित करता है, ताकि अनुक्रमणिकार और खोजकर्ता एक ही पद का उपयोग करें। उपकरण हैं विषय शीर्षक सूचियाँ, जैसे लाइब्रेरी ऑफ़ कांग्रेस सब्जेक्ट हेडिंग्स (पहली बार 1909-14 में प्रकाशित) और छोटे पुस्तकालयों हेतु सीयर्स लिस्ट ऑफ़ सब्जेक्ट हेडिंग्स (1923), और थिसॉरस, जो किसी विशेष क्षेत्र हेतु पद और उनके संबंध सूचीबद्ध करते हैं: MeSH (मेडिकल सब्जेक्ट हेडिंग्स, नेशनल लाइब्रेरी ऑफ़ मेडिसिन, 1960), ERIC थिसॉरस, यूनेस्को थिसॉरस, AGROVOC (FAO) और INSPEC थिसॉरस। थिसॉरस निर्माण ISO 25964 (2011-13) में मानकीकृत है, जिसने ISO 2788 और ISO 5964 का स्थान लिया।

संबंधसंक्षेपाक्षरउदाहरण
समतुल्यताUSE / UF (के लिए प्रयुक्त)मोटरगाड़ी USE कार; कार UF मोटरगाड़ी
पदानुक्रमितBT (व्यापक पद) / NT (संकीर्ण पद)पुस्तकालय NT शैक्षणिक पुस्तकालय; शैक्षणिक पुस्तकालय BT पुस्तकालय
साहचर्यRT (संबंधित पद)पुस्तकालय RT पुस्तकालयाध्यक्ष
दायराSN (दायरा टिप्पणी)परिभाषित करती है कि शब्दावली में पद कैसे प्रयुक्त होता है

4. सारकरण: प्रकार और दिशानिर्देश

ANSI/NISO परिभाषा के अनुसार सार किसी प्रलेख की सामग्री का संक्षिप्त, सटीक निरूपण है, बिना जोड़ी गई व्याख्या या आलोचना के। यह पाठकों को यह तय करने में सहायता करता है कि पूरा प्रलेख पढ़ें या नहीं, समय बचाता है, किसी अन्य भाषा में लिखे जाने पर भाषा बाधाएँ पार करता है, और सारों के अनुक्रमित होने पर पुनर्प्राप्ति का समर्थन करता है। सार लेखक द्वारा (लेखक सार), सार सेवाओं हेतु विषय विशेषज्ञों या व्यावसायिक सारकारों द्वारा लिखे जा सकते हैं, या बढ़ते रूप में स्वचालित रूप से बनाए जाते हैं।

प्रकारयह क्या करता है
सूचक (वर्णनात्मक)बताता है कि प्रलेख किस बारे में है और क्या आच्छादित करता है, परिणाम दिए बिना; समीक्षाओं, लंबी रिपोर्टों और विवेचनात्मक कृतियों के अनुकूल
सूचनात्मकउद्देश्य, विधियाँ, परिणाम और निष्कर्ष प्रमुख आँकड़ों सहित देता है, ताकि वह आंशिक रूप से प्रलेख का स्थान ले सके; प्रायोगिक और शोध पत्रों के अनुकूल
सूचक-सूचनात्मकमुख्य बिंदुओं पर सूचनात्मक और शेष पर सूचक
आलोचनात्मककृति की गुणवत्ता पर सारकार का मूल्यांकन जोड़ता है; संक्षिप्त समीक्षा के निकट
संरचितपृष्ठभूमि, उद्देश्य, विधियाँ, परिणाम और निष्कर्ष जैसे निश्चित शीर्षकों का उपयोग करता है; चिकित्सा पत्रिकाओं में मानक
अभिनत (मिशन-उन्मुख)किसी विशेष समूह हेतु लिखा, उनके लिए महत्वपूर्ण बातों पर बल देते हुए
सांख्यिकीय या सारणीबद्ध, और तार-शैलीसारणियों में प्रस्तुत आँकड़े; या संक्षिप्त, तार-शैली में टिप्पणियाँ
  • मानक: ISO 214 (प्रलेखन, प्रकाशनों और प्रलेखन हेतु सार; पहली बार 1976) और ANSI/NISO Z39.14 (सारों हेतु दिशानिर्देश, 1997)।
  • उत्तम प्रथा: उद्देश्य, विधि, परिणाम और निष्कर्ष उसी क्रम में बताइए; संक्षिप्त रहिए, सामान्यतः एक अनुच्छेद; पूर्ण वाक्यों, यथासंभव कर्तृवाच्य और जो किया तथा पाया गया उस हेतु भूतकाल का उपयोग कीजिए; प्रलेख में अनुपस्थित कोई सूचना न जोड़िए; अपरिभाषित संक्षेपाक्षरों और चित्रों के संदर्भों से बचिए।

5. सूचना पुनर्प्राप्ति प्रणालियाँ: विशेषताएँ, घटक, मॉडल और मूल्यांकन

सूचना पुनर्प्राप्ति (IR) प्रणाली प्रलेखों या अभिलेखों के भंडार से वे चुनती है जो उपयोगकर्ता के प्रश्न हेतु प्रासंगिक हों। इसके घटक हैं प्रलेख उपतंत्र (अर्जन, अनुक्रमणीकरण या निरूपण, भंडारण), प्रश्न उपतंत्र (खोज कथन के रूप में व्यक्त उपयोगकर्ता की आवश्यकता), दोनों की तुलना कर परिणामों को क्रमित या चयनित करने वाला मिलान उपतंत्र, और प्रतिपुष्टि सहित अंतरफलक। खोज सुविधाओं में बूलियन संचालक, छंटाई और वाइल्डकार्ड, वाक्यांश और निकटता खोज, क्षेत्र खोज, सीमाएँ, प्रासंगिकता क्रमण और प्रासंगिकता प्रतिपुष्टि आती हैं।

मॉडलप्रलेखों का मिलान कैसे होता है
बूलियनAND (दोनों पद), OR (कोई एक) और NOT (अपवर्जन) सहित सटीक मिलान; प्रलेख प्राप्त होता है या नहीं, बिना क्रमण के
सदिश समष्टिजेरार्ड सॉल्टन (SMART प्रणाली): प्रलेख और प्रश्न भारित पदों (tf-idf) के सदिश हैं; समानता से क्रमित, सामान्यतः सदिशों के बीच कोण की कोज्या
प्रायिकतात्मकस्टीफ़न रॉबर्टसन और कैरेन स्पार्क जोन्स (1976): प्रासंगिकता की अनुमानित प्रायिकता से क्रमित; BM25 इसका सबसे प्रसिद्ध भारण है
अस्पष्ट समुच्चय और विस्तारित बूलियनआंशिक सदस्यता और क्रमिक बूलियन मिलान, क्रमित परिणाम देते हुए
अंतर्निहित अर्थगत अनुक्रमणीकरणपद-प्रलेख आव्यूह को अंतर्निहित संकल्पनाओं तक घटाता है, ताकि प्रलेख सटीक शब्द साझा किए बिना मेल खा सकें

मूल्यांकन सिरिल क्लेवरडन के क्रैनफ़ील्ड प्रयोगों (क्रैनफ़ील्ड I, 1957-62; क्रैनफ़ील्ड II, 1963-66) से आरंभ हुआ, जिन्होंने प्रासंगिकता निर्णयों वाले परीक्षण संग्रह पर अनुक्रमणीकरण भाषाओं की तुलना की और पुनःस्मरण तथा परिशुद्धता को मानक मापों के रूप में स्थापित किया; एफ़. डब्ल्यू. लैंकेस्टर के MEDLARS मूल्यांकन (1968) ने उन्हें प्रचालित प्रणाली पर लागू किया, और NIST द्वारा 1992 से चलाई जा रही टेक्स्ट रिट्रीवल कॉन्फ़्रेंस (TREC) यह परंपरा जारी रखती है। पुनःस्मरण संग्रह के सभी प्रासंगिक प्रलेखों का वह अनुपात है जिसे खोज प्राप्त करती है; परिशुद्धता प्राप्त प्रलेखों का वह अनुपात है जो प्रासंगिक हैं। हल किया उदाहरण: किसी संग्रह में एक प्रश्न हेतु 40 प्रासंगिक प्रलेख हैं; एक खोज 50 प्रलेख प्राप्त करती है, जिनमें 30 प्रासंगिक हैं। परिशुद्धता = 30 / 50 = 60 प्रतिशत। पुनःस्मरण = 30 / 40 = 75 प्रतिशत। F-माप, दोनों का हरात्मक माध्य, 2 × 0.60 × 0.75 / (0.60 + 0.75) = 0.90 / 1.35 = 0.67 है। क्लेवरडन ने देखा कि पुनःस्मरण और परिशुद्धता प्रायः व्युत्क्रम रूप से बदलते हैं: खोज को व्यापक करने से पुनःस्मरण बढ़ता और परिशुद्धता घटती है।

🧠 कौन-सा हर?
परिशुद्धता उससे भाग देती है जो आपने प्राप्त किया; पुनःस्मरण उससे जो विद्यमान है। दोनों में प्राप्त-प्रासंगिक अंश है। पुनःस्मरण को संग्रह के कुल प्रासंगिक प्रलेखों की संख्या चाहिए, इसीलिए परीक्षण संग्रहों के बाहर इसे मापना कठिन है।

मुख्य बिंदु

  • नियत अनुक्रमणीकरण अनुक्रमणिकार द्वारा चुने पदों का उपयोग करता है; व्युत्पन्न अनुक्रमणीकरण प्रलेख से शब्द लेता है; पूर्व-समन्वित प्रणालियाँ अनुक्रमणीकरण के समय पद जोड़ती हैं, पश्च-समन्वित खोज के समय।
  • पूर्व-समन्वित प्रणालियाँ: कैसर (1911), शृंखला अनुक्रमणीकरण (रंगनाथन, 1938), संबंधात्मक अनुक्रमणीकरण (फ़ैराडेन), PRECIS (ऑस्टिन, 1974), POPSI (भट्टाचार्य); पश्च-समन्वित: यूनिटर्म (टॉब, 1953) और पीक-अ-बू कार्ड; शृंखला अनुक्रमणीकरण 330.954 को भारत, आर्थिक दशाओं, अर्थशास्त्र और सामाजिक विज्ञान के अंतर्गत प्रविष्टियों में बदलता है।
  • व्युत्पन्न अनुक्रमणीकरण: KWIC (लुन), KWOC, KWAC और उद्धरण अनुक्रमणीकरण (गारफ़ील्ड, 1955); शब्दावली नियंत्रण ISO 25964 के अंतर्गत USE/UF, BT/NT, RT और SN सहित LCSH, सीयर्स और MeSH (1960) जैसे थिसॉरस का उपयोग करता है।
  • सार सूचक, सूचनात्मक, सूचक-सूचनात्मक, आलोचनात्मक, संरचित या अभिनत होते हैं; ISO 214 और ANSI/NISO Z39.14 दिशानिर्देश देते हैं।
  • IR मॉडल बूलियन, सदिश समष्टि (सॉल्टन), प्रायिकतात्मक (रॉबर्टसन और स्पार्क जोन्स) और अन्य हैं; क्रैनफ़ील्ड (क्लेवरडन) से TREC (1992) तक मूल्यांकन परिशुद्धता (प्राप्त-प्रासंगिक बटा प्राप्त) और पुनःस्मरण (प्राप्त-प्रासंगिक बटा सभी प्रासंगिक) का उपयोग करता है: 40 प्रासंगिक में से 50 प्राप्त में 30 प्रासंगिक होने पर 60 और 75 प्रतिशत।

अभ्यास प्रश्न (10)

उत्तर खोलने से पहले प्रत्येक प्रश्न हल करें। हर व्याख्या सही विकल्प के साथ लुभावना गलत विकल्प भी बताती है, क्योंकि अंक वहीं जाते हैं।

  1. किसी संग्रह में एक प्रश्न हेतु 80 प्रासंगिक प्रलेख हैं। एक खोज 40 प्रलेख प्राप्त करती है, जिनमें 32 प्रासंगिक हैं। पुनःस्मरण प्रतिशत में क्या है? संख्या लिखिए।

    संख्यात्मक उत्तर — मान टाइप करें।

    उत्तर देखें

    उत्तर: 40

    पुनःस्मरण = प्राप्त प्रासंगिक / संग्रह के सभी प्रासंगिक = 32 / 80 = 0.40, अर्थात 40 प्रतिशत। उसी खोज की परिशुद्धता 32 / 40 = 80 प्रतिशत है, जो परिशुद्ध पर कम पुनःस्मरण वाली खोज दिखाती है।
  2. एक खोज 50 प्रलेख प्राप्त करती है, जिनमें 30 प्रासंगिक हैं; संग्रह में 40 प्रासंगिक प्रलेख हैं। परिशुद्धता प्रतिशत में क्या है? संख्या लिखिए।

    संख्यात्मक उत्तर — मान टाइप करें।

    उत्तर देखें

    उत्तर: 60

    परिशुद्धता = प्राप्त प्रासंगिक / कुल प्राप्त = 30 / 50 = 0.60, अर्थात 60 प्रतिशत। 40 प्रासंगिक प्रलेखों का कुल केवल पुनःस्मरण हेतु आवश्यक है, जो यहाँ 30 / 40 = 75 प्रतिशत है।
  3. PRECIS को डेरेक ऑस्टिन ने किसके लिए विकसित किया?

    1. लाइब्रेरी ऑफ़ कांग्रेस
    2. प्रलेखन शोध और प्रशिक्षण केंद्र
    3. अमेरिकी राष्ट्रीय चिकित्सा पुस्तकालय
    4. ब्रिटिश राष्ट्रीय ग्रंथसूची
    उत्तर देखें

    उत्तर: D — ब्रिटिश राष्ट्रीय ग्रंथसूची

    PRECIS ब्रिटिश राष्ट्रीय ग्रंथसूची में विषय अनुक्रमणीकरण हेतु बनाया गया और वहाँ 1970 के दशक के आरंभ से 1991 तक प्रयुक्त हुआ जब COMPASS ने उसका स्थान लिया। POPSI DRTC में विकसित हुआ, और राष्ट्रीय चिकित्सा पुस्तकालय MeSH का उपयोग करता है।
  4. थिसॉरस में "Libraries" और "Academic libraries" के बीच संबंध किससे दिखाया जाता है?

    1. SN
    2. BT और NT
    3. RT
    4. USE और UF
    उत्तर देखें

    उत्तर: B — BT और NT

    Academic libraries, Libraries का संकीर्ण पद है, अतः Libraries NT Academic libraries और Academic libraries BT Libraries। USE और UF समतुल्यता, RT साहचर्य संबंध, और SN दायरा टिप्पणी दिखाते हैं।
  5. निम्न में से कौन-सी पूर्व-समन्वित अनुक्रमणीकरण प्रणालियाँ हैं? सभी सही चुनिए।

    1. यूनिटर्म
    2. प्रकाशीय संयोग कार्ड
    3. शृंखला अनुक्रमणीकरण
    4. POPSI
    उत्तर देखें

    उत्तर: C — शृंखला अनुक्रमणीकरण; D — POPSI

    शृंखला अनुक्रमणीकरण और POPSI अनुक्रमणीकरण के चरण पर पदों को शृंखलाओं में जोड़ते हैं। यूनिटर्म और प्रकाशीय संयोग (पीक-अ-बू) कार्ड हर पद को अलग अनुक्रमित करते हैं और जोड़ना खोजकर्ता पर छोड़ते हैं, अतः वे पश्च-समन्वित हैं।
  6. ऐसा सार जो किसी शोध पत्र के उद्देश्य, विधियाँ, परिणाम और निष्कर्ष प्रमुख आँकड़ों सहित बताए, ताकि वह पत्र पढ़ने का आंशिक विकल्प बन सके, है:

    1. सूचनात्मक
    2. आलोचनात्मक
    3. सूचक
    4. अभिनत
    उत्तर देखें

    उत्तर: A — सूचनात्मक

    सूचनात्मक सार परिणामों सहित सार-तत्व रखता है। सूचक सार केवल बताता है कि प्रलेख क्या आच्छादित करता है, आलोचनात्मक सार मूल्यांकन जोड़ता है, और अभिनत सार किसी विशेष पाठक-वर्ग हेतु लिखा जाता है।
  7. अभिकथन (A): KWIC अनुक्रमणियाँ एक ही संकल्पना हेतु भिन्न शब्दों का उपयोग करने वाले प्रलेखों को एक साथ नहीं ला सकतीं। कारण (R): KWIC व्युत्पन्न अनुक्रमणीकरण है जो शब्दावली नियंत्रण के बिना शीर्षकों के शब्दों का उपयोग करता है। सही विकल्प चुनिए।

    1. A और R दोनों सत्य हैं, और R, A की सही व्याख्या है
    2. A और R दोनों सत्य हैं, पर R, A की सही व्याख्या नहीं है
    3. A सत्य है, पर R असत्य है
    4. A असत्य है, पर R सत्य है
    उत्तर देखें

    उत्तर: A — A और R दोनों सत्य हैं, और R, A की सही व्याख्या है

    दोनों सत्य हैं और R, A की व्याख्या करता है। चूँकि KWIC बिना नियंत्रित शब्दावली के सीधे शीर्षकों से शब्द लेता है, "cars" और "automobiles" वाले शीर्षक अलग स्थानों पर दर्ज होते हैं; केवल शब्दावली नियंत्रण पर्यायों को एक साथ रख सकता है।
  8. कौन-सा सूचना पुनर्प्राप्ति मॉडल प्रलेखों और प्रश्नों को भारित पद सदिशों के रूप में प्रस्तुत करता है और प्रलेखों को उनके बीच कोण की कोज्या से क्रमित करता है?

    1. बूलियन मॉडल
    2. प्रायिकतात्मक मॉडल
    3. शृंखला अनुक्रमणीकरण
    4. सदिश समष्टि मॉडल
    उत्तर देखें

    उत्तर: D — सदिश समष्टि मॉडल

    सॉल्टन का सदिश समष्टि मॉडल, SMART प्रणाली के साथ विकसित, पद सदिशों के बीच समानता मापता है। बूलियन मॉडल सटीक, अक्रमित मिलान देता है, प्रायिकतात्मक मॉडल प्रासंगिकता की अनुमानित प्रायिकता से क्रमित करता है, और शृंखला अनुक्रमणीकरण पूर्व-समन्वित अनुक्रमणीकरण विधि है।
  9. सूचना पुनर्प्राप्ति के मूल्यांकन के बारे में कौन-से कथन सही हैं? सभी सही चुनिए।

    1. TREC 1992 से NIST द्वारा चलाई जा रही है
    2. क्रैनफ़ील्ड प्रयोगों का नेतृत्व सिरिल क्लेवरडन ने किया
    3. पुनःस्मरण और परिशुद्धता प्रायः व्युत्क्रम रूप से बदलते हैं
    4. परिशुद्धता प्राप्त प्रासंगिक प्रलेखों को संग्रह के सभी प्रासंगिक प्रलेखों से भाग देना है
    उत्तर देखें

    उत्तर: A — TREC 1992 से NIST द्वारा चलाई जा रही है; B — क्रैनफ़ील्ड प्रयोगों का नेतृत्व सिरिल क्लेवरडन ने किया; C — पुनःस्मरण और परिशुद्धता प्रायः व्युत्क्रम रूप से बदलते हैं

    क्लेवरडन ने क्रैनफ़ील्ड का नेतृत्व किया, पुनःस्मरण और परिशुद्धता सामान्यतः एक-दूसरे की कीमत पर बदलते हैं, और NIST 1992 से TREC चला रहा है। अंतिम कथन पुनःस्मरण की परिभाषा है, परिशुद्धता की नहीं; परिशुद्धता प्राप्त प्रलेखों की संख्या से भाग देती है।
  10. DDC संख्या 330.954 (300 सामाजिक विज्ञान, 330 अर्थशास्त्र, 330.9 आर्थिक दशाएँ, 330.954 भारत) पर शृंखला अनुक्रमणीकरण से पहली और सबसे विशिष्ट अनुक्रमणी प्रविष्टि कौन-सी है?

    1. आर्थिक दशाएँ, भारत 330.9
    2. भारत, आर्थिक दशाएँ, अर्थशास्त्र 330.954
    3. सामाजिक विज्ञान, अर्थशास्त्र, आर्थिक दशाएँ, भारत 330.954
    4. अर्थशास्त्र 330
    उत्तर देखें

    उत्तर: B — भारत, आर्थिक दशाएँ, अर्थशास्त्र 330.954

    शृंखला प्रक्रिया अंतिम कड़ी, भारत, से आरंभ होती है, ऊँची कड़ियों द्वारा उलटे क्रम में विशेषित, और उसे पूरी वर्ग संख्या 330.954 देती है। ऊँची कड़ियों की प्रविष्टियाँ (Economics 330) बाद में आती हैं; कड़ियों को ऊपर से नीचे उद्धृत करना या भारत को 330.9 से जोड़ना शृंखला प्रक्रिया नहीं है।