खोज, खेल-खेलना व तर्कसंगत अभिकर्ता
ट्यूरिंग परीक्षण व तर्कसंगत अभिकर्ता उपागम
ट्यूरिंग परीक्षण पूछता है कि क्या मानव पूछताछकर्ता, पाठ से अदृश्य मानव व अदृश्य मशीन से वार्तालाप करते हुए, विश्वसनीय रूप से बता सके कि कौन कौन है — इसे पास करना बुद्धिमत्ता की व्यावहारिक कसौटी है (मानव से अविभेद्य रूप से कार्य करना), व इसका ऐतिहासिक महत्व 'क्या मशीनें सोच सकती हैं?' (आंतरिक अनुभव संबंधी प्रश्न, प्रचालनात्मक बनाना कठिन) को 'क्या मशीनें वह कर सकती हैं जो सोचती वस्तु करती है?' (प्रेक्षणीय व्यवहार संबंधी प्रश्न) में पुनर्रचित करने में है। तर्कसंगत अभिकर्ता उपागम, जिसके इर्द-गिर्द आधुनिक AI वस्तुतः स्वयं को संगठित करती है, अभिकर्ता को प्रदर्शन-मापक से परिभाषित करता है जिसे उसे अपने प्रत्यक्षों (जो उसने महसूस किया) व पूर्व ज्ञान को देखते हुए अधिकतम करना है, वह क्रिया चुनते हुए जिससे सर्वश्रेष्ठ प्रदर्शन की प्रत्याशा हो — यह ट्यूरिंग परीक्षण से व्यापकतर, अधिक सामान्य कसौटी है, क्योंकि यह किसी भी अभिकर्ता (थर्मोस्टैट, स्व-चालित कार, शतरंज-प्रोग्राम) पर लागू होती है चाहे मानव-सदृश वार्तालाप उसके कार्य हेतु प्रासंगिक हो या न हो।
अवस्था-समष्टि निरूपण व अनुमानी खोज
| गुण | असूचित (अंधी) | सूचित (अनुमानी) |
|---|---|---|
| किस नोड को विस्तारित करना है यह तय करने हेतु यह क्या प्रयोग करती है | केवल समस्या की संरचना (BFS: उथला पहले; DFS: गहरा पहले; एकसमान-लागत: सस्तम पथ-लागत पहले) | संरचना के अतिरिक्त, लक्ष्य तक शेष लागत का आकलन h(n) |
| मानक कलनविधि | BFS, DFS, एकसमान-लागत खोज | लोभी सर्वोत्तम-प्रथम खोज (केवल h(n) प्रयोग करती); A* (f(n) = g(n) + h(n) प्रयोग करती, अब तक की वास्तविक लागत जमा शेष अनुमानित लागत) |
खेल-खेलना: मिन-मैक्स व अल्फ़ा-बीटा छंटाई
मिन-मैक्स दो-खिलाड़ी, शून्य-योग, पूर्ण-सूचना खेल को एकांतर चालों के वृक्ष के रूप में प्रतिरूपित करता है: MAX खिलाड़ी सर्वाधिक मान वाली संतति की ओर ले जाती चाल चुनता है, MIN खिलाड़ी न्यूनतम मान वाली संतति की ओर ले जाती चाल चुनता है, व मान पत्ती (अंतिम-अवस्था) मूल्यांकनों से ऊपर प्रसारित होते हैं — यह उस विरोधी को सही ढंग से प्रतिरूपित करता है जो सदा MAX के परिणाम को न्यूनतम करने खेलता है, उस कलनविधि के विपरीत जो केवल विरोधी की चालें यादृच्छिक मान लेती। अल्फ़ा-बीटा छंटाई वृक्ष के बड़े भाग को छोड़ते हुए, जो सिद्ध रूप से अंतिम निर्णय को प्रभावित नहीं कर सकते, ठीक वही मिन-मैक्स मान गणित करती है: अल्फ़ा वह सर्वश्रेष्ठ मान है जो MAX वर्तमान पथ के अनुदिश अब तक गारंटी दे सकता है, बीटा वह सर्वश्रेष्ठ मान जो MIN गारंटी दे सकता है — एक बार किसी नोड का मान उससे बुरा पाया जाए जो विरोधी पहले से कहीं और बाध्य कर सकता (बीटा ≤ अल्फ़ा), उस नोड की शेष संतति बिना खोजे छाँट दी जाती है, क्योंकि वे जो भी मूल्यांकित हों, तर्कसंगत विरोधी खेल को उस नोड तक पहुँचने ही नहीं देगा।
एक हल किया अल्फ़ा-बीटा उदाहरण, व जब अकेली खोज पर्याप्त नहीं
- हाथ से अल्फ़ा-बीटा अनुसरण करना: बाएँ से दाएँ संतति प्रक्रमित करें; MAX नोड पर, अब तक मिले सर्वश्रेष्ठ संतति-मान से अल्फ़ा अद्यतित करें; MIN नोड पर, वैसे ही बीटा अद्यतित करें; जिस क्षण MIN नोड का वर्तमान बीटा उसके पूर्वज MAX नोड के अल्फ़ा तक या उससे नीचे गिरे, उस MIN नोड की शेष संतति खोजना रोकें (बीटा-कटऑफ) — व सममित रूप से, MAX नोड का अल्फ़ा उसके पूर्वज MIN नोड के बीटा तक या उससे ऊपर उठना अल्फ़ा-कटऑफ ट्रिगर करता है।
- शतरंज एक वास्तविक खेल है जहाँ अवस्था-समष्टि इतनी विशाल है कि अकेली पूर्ण खोज-यंत्रावली भी पर्याप्त नहीं — गहराई-सीमित खोज हस्त-रचित या अधिगत मूल्यांकन-फलन (खेल के वास्तविक अंत तक संपूर्ण रूप से खोजे बिना अ-अंतिम स्थिति के मूल्य का आकलन) से संयुक्त वही है जो वास्तविक शतरंज इंजन प्रयोग करते हैं, जो ठीक वही व्यावहारिक पुल है जो इस शास्त्रीय खोज-अध्याय व आधुनिक इंजनों द्वारा भी लिए गए तंत्रिका-जाल-आधारित मूल्यांकन उपागमों के बीच है, जो इस इकाई के अपने कृत्रिम-तंत्रिका-जाल अध्याय में ढके हैं।
मुख्य बिंदु
- ट्यूरिंग परीक्षण बुद्धिमत्ता की व्यावहारिक कसौटी है; तर्कसंगत अभिकर्ता फ्रेमिंग (प्रत्यक्षों व ज्ञान को देखते हुए प्रदर्शन-मापक अधिकतम करना) व्यापकतर है व वह है जिसके इर्द-गिर्द आधुनिक AI वस्तुतः संगठित होती है।
- मान्य अनुमानी (कभी अत्यधिक-आकलन न करती) सहित A* इष्टतम हल खोजने की गारंटी देती है।
- मिन-मैक्स खेल-वृक्ष में एकांतर सर्वश्रेष्ठ/निकृष्टतम मान ऊपर प्रसारित करती है; अल्फ़ा-बीटा सिद्ध रूप से-अप्रासंगिक शाखाएँ छाँटती है, तेज़ ठीक वही उत्तर लौटाते हुए।
- अल्फ़ा-बीटा छंटाई चलने का समय बदलती है, अंतिम निर्णय कभी नहीं — अच्छा चाल-क्रमन उसी समय में खोजने-योग्य गहराई को लगभग दोगुना कर देता है।
- शतरंज जैसे वास्तविक खेल गहराई-सीमित खोज को मूल्यांकन-फलन से संयोजित करते हैं, क्योंकि वास्तविक अवस्था-समष्टि संपूर्ण रूप से खोजने हेतु बहुत विशाल है।
अभ्यास प्रश्न (8)
उत्तर खोलने से पहले प्रत्येक प्रश्न हल करें। हर व्याख्या सही विकल्प के साथ लुभावना गलत विकल्प भी बताती है, क्योंकि अंक वहीं जाते हैं।
ट्यूरिंग परीक्षण की तुलना में, तर्कसंगत अभिकर्ता फ्रेमिंग व्यापकतर कसौटी है क्योंकि:
उत्तर देखें
उत्तर: A — यह किसी भी अभिकर्ता पर लागू होती है जो प्रदर्शन-मापक अधिकतम करे, चाहे मानव-सदृश वार्तालाप प्रासंगिक हो या न हो
थर्मोस्टैट या स्व-चालित कार तर्कसंगत अभिकर्ता हो सकते हैं बिना कभी मानव-सदृश वार्तालाप की आवश्यकता के, यही ठीक वह कारण है कि यह कसौटी ट्यूरिंग परीक्षण की वार्तालाप-फ्रेमिंग से कहीं अधिक व्यापक रूप से लागू होती है।'मान्य' अनुमानी h(n) का अर्थ है:
उत्तर देखें
उत्तर: A — यह लक्ष्य तक वास्तविक शेष लागत को कभी अत्यधिक-आकलित नहीं करती
मान्यता (h(n) ≤ वास्तविक शेष लागत, सदा) ठीक वही शर्त है जो A* को इष्टतम गारंटी देने हेतु चाहिए, क्योंकि यह खोज को किसी बुरे पथ के विषय में कभी झूठा आशावादी होने से रोकती है।मिन-मैक्स खोज में, MIN खिलाड़ी वह चाल चुनता है जो इस ओर ले जाती है:
उत्तर देखें
उत्तर: A — न्यूनतम मान वाली संतति
MIN को उस विरोधी के रूप में प्रतिरूपित किया जाता है जो सदा MAX के अंतिम परिणाम को न्यूनतम करने खेलता है, अतः MIN सदा वह चाल चुनता है जो अपनी संतति में न्यूनतम मान की ओर ले जाए।सादे मिन-मैक्स की तुलना में, अल्फ़ा-बीटा छंटाई का सर्वोत्तम वर्णन है:
उत्तर देखें
उत्तर: A — सिद्ध रूप से अप्रासंगिक शाखाएँ छोड़कर, तेज़ी से, ठीक वही चाल लौटाना
वही मूल्यांकन-फलन व गहराई देखते हुए अल्फ़ा-बीटा की छाँटी शाखाएँ अंतिम निर्णय हेतु सिद्ध रूप से अप्रासंगिक हैं, अतः यह सदा ठीक वही लौटाती है जो सादा मिन-मैक्स देता, बस तेज़ी से गणित।वास्तविक शतरंज इंजन खेल के वास्तविक अंत तक पूरा खेल-वृक्ष मुख्यतः इसलिए नहीं खोज सकते:
उत्तर देखें
उत्तर: A — अवस्था-समष्टि संपूर्ण खोज हेतु बहुत विशाल है, अतः इसके बजाय गहराई-सीमित खोज व मूल्यांकन-फलन प्रयोग किया जाता है
शतरंज का शाखन-गुणक व खेल-लंबाई संपूर्ण खोज को गणनात्मक रूप से असंभव बनाते हैं, अतः इंजन केवल परिबद्ध गहराई खोजते हैं व वास्तविक खेल-समापक अवस्था तक खोजने के बजाय मूल्यांकन-फलन से अ-अंतिम स्थितियों का मूल्य आकलित करते हैं।सूचित (अनुमानी) खोज की तुलना में असूचित (अंधी) खोज के विषय में निम्नलिखित में कौन सत्य हैं? (एक से अधिक विकल्प सही हो सकते हैं।)
उत्तर देखें
उत्तर: A — असूचित खोज केवल समस्या की संरचना प्रयोग करती है, शेष लागत के आकलन का नहीं; B — चौड़ाई-प्रथम खोज मानक असूचित खोज कलनविधि है; D — सूचित खोज अगले किस नोड को विस्तारित करना है यह मार्गदर्शित करने हेतु अनुमानी प्रयोग कर सकती है
A* सूचित खोज का मानक उदाहरण है, f(n) = g(n) + h(n) प्रयोग करते हुए; BFS असूचित का मानक उदाहरण है, बिना किसी लागत-आकलन के केवल वृक्ष की उथला-पहले संरचना प्रयोग करते हुए।A* खोज में, फलन f(n) = g(n) + h(n) का नाम बताइए, जहाँ g(n) अब तक की वास्तविक लागत है व h(n) आकलित शेष लागत है।
संख्यात्मक उत्तर — मान टाइप करें।
उत्तर देखें
उत्तर: evaluation function
f(n) A* का मूल्यांकन-फलन है, अब तक की ज्ञात लागत को शेष का आकलन जोड़ते हुए — जब h मान्य हो, यही संयोजन ठीक वही है जो A* को इष्टतम पथ खोजने की गारंटी देता है।A* की तुलना में, लोभी सर्वोत्तम-प्रथम खोज अगले किस नोड को विस्तारित करना है यह तय करती है इससे:
उत्तर देखें
उत्तर: A — केवल अनुमानी आकलन h(n) से, अब तक हुई वास्तविक लागत को नज़रअंदाज़ करते हुए
लोभी सर्वोत्तम-प्रथम खोज उस नोड को विस्तारित करती है जो केवल h(n) से लक्ष्य के निकटतम दिखे, जो उसे कम आकलन पर पर उच्च वास्तविक लागत वाले पथ में भटका सकता है — ठीक वही कमी जिसे ठीक करने हेतु A* का f(n) = g(n) + h(n) अभिकल्पित है।