वर्ष 1996 है। एक खबर तेजी से दुनिया भर में फैलती है, एक हलचल और प्रशंसा जगाती है: पहली बार एक कंप्यूटर शतरंज की बिसात पर एक विश्व चैंपियन के खिलाफ जीतने का प्रबंधन करता है। यह 10 फरवरी, 1996 का दिन था जब आईबीएम द्वारा विशेष रूप से शतरंज के खेल के लिए डिजाइन और निर्मित कंप्यूटर डीप ब्लू ने खिताब के धारक गैरी कास्परोव को हरा दिया। मैन-कैलकुलेटर चैलेंज के उद्घाटन मैच में। यह एक ऐतिहासिक तारीख है, आर्टिफिशियल इंटेलिजेंस एक ऐसे लक्ष्य को प्राप्त करता है जिसे अधिकांश लोग पहुंच से बाहर मानते हैं, पहुंचना असंभव है, मशीनों के लिए वर्जित है। हालांकि पहले गेम में आईबीएम सुपरकंप्यूटर ने कास्पारोव को पछाड़ दिया, लेकिन संघर्ष के अंतिम परिणाम में रूसी चैंपियन की जीत देखी गई। बाद के मैचों में डीप ब्लू शुरुआती सफलता को दोहराने में असमर्थ है और अंत में कास्परोव के लिए तीन जीत और दो ड्रॉ हैं। आदमी ने कार को 4-2 से पीटा।
कई राहत की सांस लेते हैं, मानवता अपनी प्रधानता बरकरार रखती है। मनुष्य की हानि के लिए कंप्यूटरों का आगे बढ़ना शायद अब विज्ञान कथाओं का अनन्य विषय नहीं है, लेकिन कम से कम यह अभी आना बाकी है। और कुछ गलत नहीं! अगले साल दोनों दावेदारों के बीच बदला देखा जाता है और इस बार डीप ब्लू प्रबल होता है। इसलिए मई 1997 में कंप्यूटर ने मनुष्य को हराया: 3,5-2,5। मर्यादा लांघ दी, दीवार चकनाचूर कर दी।
गैरी कास्पारोव ने हाल ही में प्रकाशित 300 पन्नों की एक किताब "डीप थिंकिंग: व्हेयर आर्टिफिशियल इंटेलिजेंस एंड्स एंड ह्यूमन क्रिएटिविटी बिगिन्स" में इस खोई हुई चुनौती को फिर से संगठित किया।
हालांकि, घटना विवाद के बिना नहीं है। सबसे पहले, डीप ब्लू उस कमरे के अंदर स्थित नहीं है जिसमें मैच खेला जाता है, बल्कि कुछ किलोमीटर की दूरी पर स्थित होता है और परिणामस्वरूप, डेटा सीधे कंप्यूटर से नहीं भेजा जाता है। यह तथ्य और अन्य तत्व कास्परोव को यह दावा करने के लिए प्रेरित करते हैं कि मैचों के दौरान डीप ब्लू की मदद की गई थी। एक तत्व जो चुनौती के दौरान कई बार लौटता है और पिछले समझौतों के अनुसार मशीन की गतिविधि से संबंधित प्रिंटआउट प्रदान करने के लिए आईबीएम के कास्परोव के अनुरोध को अस्वीकार करता है, केवल संदेह को पुष्ट करता है और संदेह को बढ़ाता है। हारने वाला अंत में एक रीमैच की मांग करता है, लेकिन आईबीएम एक स्पष्ट इनकार का विरोध करता है, निश्चित रूप से डीप ब्लू को वापस ले लेता है।
20 साल बाद डीप माइंड एल्गोरिथम आता है
2003 के एक वृत्तचित्र, गेम ओवर: कास्परोव एंड द मशीन में, कुछ गवाहों के साथ साक्षात्कार की पेशकश की जाती है, जिन्होंने सुपरकंप्यूटर की जीत पर भारी छाया डाली। इनसे यह पता चलेगा कि, अंततः, डीप ब्लू ने आईबीएम द्वारा शेयर बाजार पर अपने स्टॉक के मूल्य को बढ़ाने के लिए कार्यान्वित एक चाल का प्रतिनिधित्व किया। कास्पारोव पर विजय के एक ही दिन में, आईबीएम के शेयरों में 15% की वृद्धि हुई।
तो मशीन की जीत, विशेष रूप से, शायद शुरू में विश्वास करने की तुलना में कहीं अधिक मानवीय है। या संयोग का परिणाम, जैसा कि नैट सिल्वर का दावा है। अपनी पुस्तक (द सिग्नल एंड नॉइज़। द आर्ट एंड साइंस ऑफ़ फोरकास्टिंग) में उन्होंने डीप ब्लू की सफलता का श्रेय मशीन द्वारा किए गए संयोग के परिणाम, बिल्कुल तर्कहीन चाल को दिया है। एक ऐसा कदम जिसने कास्परोव की मानवता को अपूरणीय रूप से अस्थिर कर दिया होगा, उनके भरोसे और तर्कसंगतता को कम कर दिया।
बीस साल बाद, AlphaGo ने एक और सीमा तोड़ी है। 2016 के पहले महीनों में डीप माइंड एल्गोरिद्म ने इस बार बिना किसी विवाद या तरकीब के पहले यूरोपीय चैंपियन और फिर विश्व GO चैंपियन को हरा दिया। जीत स्पष्ट और स्पष्ट है। और यह कि मशीन वास्तव में मनुष्य को पछाड़ने में सक्षम है, इस तथ्य से प्रदर्शित होता है कि, एक सप्ताह में, 29 दिसंबर 2016 और 4 जनवरी 2017 के बीच, अल्फ़ागो, भेस में, दुनिया के सर्वश्रेष्ठ खिलाड़ियों के खिलाफ लगातार साठ जीत हासिल करने में कामयाब रहा। मांस।
गणना क्षमता: 10170
कुछ समय पहले तक यह माना जाता था कि कुछ विशेष क्षेत्र मनुष्य के अनन्य डोमेन बने रहेंगे या, सबसे खराब स्थिति में, आने वाले लंबे समय तक ऐसा ही रहेगा। इनमें शतरंज और गो दोनों थे। दोनों खेल, हालांकि उनके पास अल्प नियम और स्पष्ट रूप से सरल गतिशीलता है, वास्तव में एक उच्च कठिनाई को छिपाते हैं। एक कठिनाई जो चालों के संयोजनों की संख्या और परिणामस्वरूप संभावित गेम कॉन्फ़िगरेशन द्वारा दी जाती है। इतनी बड़ी संख्या कि किसी को विश्वास हो जाए कि कोई भी कंप्यूटर ऐसी जटिलता में पारंगत नहीं हो सकता था। इसलिए यह आम राय थी कि शतरंज, और इससे भी अधिक गो, मानव बुद्धि और सभी अंतर्ज्ञान से ऊपर रहेगा। इस तरह के अचानक समर्पण की उम्मीद तो और भी कम थी।
लेकिन अगर डीप ब्लू ब्रूट बल के माध्यम से प्रबल होने में कामयाब रहा, तो एक दुर्जेय कंप्यूटिंग शक्ति (प्रति सेकंड 220 मिलियन चालों की गणना करने में सक्षम) के लिए धन्यवाद, AlphaGo के लिए मामला अलग है। शतरंज की तुलना में गो में बहुत अधिक संख्या में संयोजन हैं। प्रत्येक चाल के लिए, औसतन, संभावनाएँ दस गुना अधिक होती हैं। अकेले गणना क्षमता, यद्यपि विशाल, लगभग 10170 विभिन्न स्थितियों पर विचार करने के लिए पर्याप्त नहीं होगी और साथ ही खेल द्वारा उत्पन्न नुकसान के बारे में सही होने के लिए पर्याप्त नहीं होगी।
तो AlphaGo ने विश्व चैंपियन को कैसे हराया? सरल, सीखना।
डीप लर्निंग, मशीन का गुप्त हथियार
जैसा कि डीप माइंड के संस्थापक डेमिस हासाबिस कहते हैं, कंप्यूटर को स्मार्ट बनाने के दो तरीके हैं। पहली विधि किसी समस्या के निर्धारित समाधान की प्रोग्रामिंग करने और मशीन को इसे निष्पादित करने देती है। दूसरा, और यह AlphaGo का मामला है, इसमें शामिल हैं «... कंप्यूटर को खुद से सीखने की क्षमता देना, अनुभव के माध्यम से सीखना। … मैं तुम्हें सिखाऊंगा कि कैसे सीखना है, मैं तुम्हें समाधान नहीं दूंगा».
AlphaGo की सफलता के पीछे के रहस्य को डीप लर्निंग कहा जाता है। "एल्गोरिदम में तीन विशेषताएं हैं, जो सभी न्यूरोबायोलॉजी से ली गई हैं: सुदृढीकरण सीखने, दृढ़ तंत्रिका नेटवर्क और चयनात्मक मेमोरी लूप।"
एक और ख़ासियत जो अल्फागो को डीप ब्लू से अलग करती है, वह इस तथ्य में शामिल है कि डीप माइंड प्राणी को विशेष रूप से और विशेष रूप से गो के लिए नहीं बनाया गया था। अंतर्निहित एल्गोरिथ्म समय के साथ, विभिन्न प्रकार के खेलों को सीखने और अनुकूलित करने में सक्षम साबित हुआ है। इसकी प्रगति और अधिग्रहण वास्तव में सावधानीपूर्वक और सावधानीपूर्वक योजना के कारण नहीं हैं, बल्कि अनुभव का परिणाम हैं। यह क्या जानता है, AlphaGo ने पूर्ण स्वायत्तता में, खेलकर खोजा और आत्मसात किया। "नई पीढ़ी के एल्गोरिदम की पहचान यह है कि, लोगों की तरह, वे अपनी सफलताओं और असफलताओं से सीखते हैं।"
49 अलग-अलग अटारी 2600 खेलों में प्रशिक्षित, डीप माइंड के एल्गोरिदम ने न केवल अन्य प्रतिस्पर्धी एल्गोरिदम, बल्कि इंसानों को भी मात दी है। "... इनमें से 29 खेलों में एल्गोरिद्म ने एक मानव पेशेवर परीक्षक को 75 प्रतिशत या उससे अधिक से पीछे छोड़ दिया, कभी-कभी उन्हें बहुत बड़े अंतर से हरा दिया।"
संज्ञानात्मक कंप्यूटिंग
AlphaGo दर्शाता है कि अब हम आईबीएम डेटा प्रोसेसिंग के तीसरे युग के रूप में वर्णित कर रहे हैं: संज्ञानात्मक कंप्यूटिंग। पहला युग, सारणीबद्ध कंप्यूटिंग का, शुरू से ही 50 के दशक तक, इनपुट और आउटपुट दोनों के लिए पंच कार्ड का उपयोग करते हुए आवश्यक गणितीय संचालन करने में सक्षम कंप्यूटर देखे गए। दूसरा युग, 50 के दशक से लेकर आज तक, प्रोग्रामिंग कंप्यूटिंग का, इलेक्ट्रॉनिक कंप्यूटर का युग है। मशीनें कमांड (यदि/तो) और तार्किक संरचनाओं को संसाधित करने में भी सक्षम हैं, लेकिन उन्हें कुछ नियमों का पालन करके ऐसा करने का निर्देश दिया जाना चाहिए और इसलिए उन्हें प्रोग्राम करने की आवश्यकता है।
संज्ञानात्मक कम्प्यूटिंग, जोनास न्यूके (आईबीएम) बताते हैं, «... "अगर/फिर" तर्क में निहित कठोरता को तोड़ने के लिए पैदा हुआ था ... संज्ञानात्मक कंप्यूटिंग एक संभाव्यता विस्तार है, जिसके परिणाम एक स्पेक्ट्रम के साथ भिन्न होते हैं, कठोर "हां या" होने के बजाय नहीं, सही या गलत”».
आईबीएम द्वारा संज्ञानात्मक कम्प्यूटिंग पर दिया गया जोर, कम से कम भाग में, स्व-रुचि है, यह एक शक्तिशाली मार्केटिंग मशीन के कोगों में से एक है जो कास्परोव पर जीत से संतुष्ट नहीं था। अल्फ़ागो, वास्तव में, एक पूर्ववर्ती है या, यदि आप चाहें, तो डीप ब्लू का उत्तराधिकारी था। एक सुपरकंप्यूटर जिसने अभी तक एक और बाधा को तोड़ दिया है, एक और शिकार रिजर्व के आदमी को लूट लिया है, उसे एक और निश्चितता से वंचित कर दिया है: एक शब्द में, वाटसन।
हम अगली पोस्ट में वाटसन से निपटेंगे
