میں تقسیم ہوگیا

پہلا آن لائن بینر

مشین انسان کو پیچھے چھوڑ دیتی ہے: ڈیپ بلیو سے الفا گو تک الگورتھم کا چیلنج

ڈیپ بلیو اور عالمی چیمپیئن گیری کاسپروف کے درمیان شطرنج کے میچ کے بعد سے، مصنوعی ذہانت بیس سال سے انسان کو چیلنج کرتی رہی ہے لیکن 2016 میں اوور ٹیکنگ حقیقت ہے: ڈیپ مائنڈ الگورتھم نے جی او ورلڈ چیمپئن کو شکست دی اور اس بار بغیر کسی تنازع کے۔

سال 1996 ہے۔ خبروں کا ایک ٹکڑا تیزی سے پوری دنیا میں چلا جاتا ہے، ایک ہلچل اور تعریف پیدا کرتا ہے: پہلی بار ایک کمپیوٹر بساط پر کسی عالمی چیمپئن کے خلاف غالب آنے کا انتظام کرتا ہے۔ یہ 10 فروری 1996 کی بات ہے جب آئی بی ایم کے ذریعے خاص طور پر شطرنج کے کھیل کے لیے ڈیزائن اور بنایا گیا کمپیوٹر ڈیپ بلیو نے ٹائٹل کے حامل گیری کاسپروف کو شکست دی۔ مین کیلکولیٹر چیلنج کے افتتاحی میچ میں۔ یہ ایک تاریخی تاریخ ہے، مصنوعی ذہانت ایک ایسا مقصد حاصل کرتی ہے جسے زیادہ تر لوگوں کی پہنچ سے باہر، پہنچنا ناممکن، مشینوں کے لیے روکا جاتا ہے۔ اگرچہ IBM سپر کمپیوٹر نے پہلی گیم میں کاسپاروف سے بہتر حاصل کیا، لیکن تصادم کے حتمی نتائج میں روسی چیمپئن کی فتح نظر آتی ہے۔ اس کے بعد کے میچوں میں ڈیپ بلیو ابتدائی کامیابی کو دہرانے سے قاصر ہے اور آخر میں کاسپاروف کی تین فتوحات اور دو ڈرا ہیں۔ آدمی نے کار کو 4-2 سے ہرا دیا۔

بہت سے لوگ راحت کی سانس لیتے ہیں، انسانیت اپنی سربلندی کو محفوظ رکھتی ہے۔ کمپیوٹرز کا انسان کو نقصان پہنچانا شاید اب سائنس فکشن کا خصوصی موضوع نہیں رہا، لیکن کم از کم یہ ابھی آنا باقی ہے۔ مزید کچھ غلط نہیں! اگلے سال دو دعویداروں کے درمیان بدلہ دیکھنے کو ملتا ہے اور اس بار ڈیپ بلیو غالب ہے۔ لہذا مئی 1997 میں کمپیوٹر آدمی کو شکست دیتا ہے: 3,5-2,5۔ ایک حد پار ہو گئی، دیوار ٹوٹ گئی۔

گیری کاسپاروف نے حال ہی میں شائع ہونے والی 300 صفحات پر مشتمل کتاب میں اس کھوئے ہوئے چیلنج کو دوبارہ تشکیل دیا جس کا عنوان ہے "گہری سوچ: جہاں مصنوعی ذہانت ختم ہوتی ہے اور انسانی تخلیقی صلاحیتیں شروع ہوتی ہیں"۔

تاہم، واقعہ تنازعہ کے بغیر نہیں ہے. سب سے پہلے، ڈیپ بلیو اس کمرے کے اندر نہیں ہے جس میں میچ کھیلا جاتا ہے، بلکہ چند کلومیٹر کے فاصلے پر ہے اور اس کے نتیجے میں، ڈیٹا کمپیوٹر سے براہ راست نہیں بھیجا جاتا ہے۔ یہ حقیقت اور دیگر عناصر کاسپاروف کو یہ دعوی کرنے کی طرف لے جاتے ہیں کہ میچوں کے دوران ڈیپ بلیو کی مدد کی گئی تھی۔ ایک ایسا عنصر جو چیلنج کے دوران کئی بار واپس آتا ہے اور IBM کا مشین کی سرگرمی سے متعلق پرنٹ آؤٹ فراہم کرنے کی کاسپروف کی درخواست سے انکار، پچھلے معاہدوں کے مطابق، صرف شکوک و شبہات کو تقویت دیتا ہے اور شکوک و شبہات کو ہوا دیتا ہے۔ ہارنے والا آخرکار دوبارہ میچ کے لیے کہتا ہے، لیکن IBM قطعی طور پر ڈیپ بلیو کو واپس لے کر، صریح انکار کی مخالفت کرتا ہے۔

20 سال بعد ڈیپ مائنڈ الگورتھم آتا ہے۔

2003 کی ایک دستاویزی فلم، گیم اوور: کاسپاروو اینڈ دی مشین، میں کچھ گواہوں کے انٹرویوز پیش کیے گئے ہیں جنہوں نے سپر کمپیوٹر کی فتح پر گہرا سایہ ڈالا۔ ان سے یہ نکلے گا کہ بالآخر، ڈیپ بلیو نے IBM کی طرف سے سٹاک مارکیٹ میں اپنے سٹاک کی قدر بڑھانے کے لیے لاگو کی گئی چال کی نمائندگی کی۔ Kasparov پر فتح کے ایک ہی دن میں، IBM کے حصص میں 15% اضافہ ہوا۔

لہذا مشین کی فتح، خاص طور پر، شاید اس سے کہیں زیادہ انسانی ہے جو ابتدائی طور پر یقین کرنے کی وجہ سے تھی۔ یا موقع کا نتیجہ، جیسا کہ نیٹ سلور کا دعویٰ ہے۔ اپنی کتاب (سگنل اور شور، پیشن گوئی کا فن اور سائنس) میں اس نے ڈیپ بلیو کی کامیابی کو بالکل غیر معقول اقدام، موقع کا نتیجہ، مشین کے ذریعے بنایا ہے۔ ایک ایسا اقدام جس نے کاسپاروف کی انسانیت کو ناقابل تلافی طور پر عدم استحکام سے دوچار کیا، اس کے اعتماد اور عقلیت کو مجروح کیا۔

بیس سال بعد، AlphaGo نے ایک اور حد توڑ دی۔ 2016 کے پہلے مہینوں میں دیپ مائنڈ الگورتھم نے اس بار بغیر کسی تنازعہ یا چالوں کے، پہلے یورپی چیمپئن اور پھر ورلڈ GO چیمپئن کو شکست دی۔ فتح واضح اور غیر واضح ہے۔ اور یہ کہ یہ مشین واقعی انسان کو پیچھے چھوڑنے کی صلاحیت رکھتی ہے اس کا ثبوت اس حقیقت سے ہوتا ہے کہ 29 دسمبر 2016 سے 4 جنوری 2017 کے درمیان ایک ہفتے میں AlphaGo نے بھیس بدل کر دنیا کے بہترین کھلاڑیوں کے خلاف لگاتار ساٹھ فتوحات حاصل کیں۔ جسم میں سیارہ.

حساب کی گنجائش: 10170 

کچھ عرصہ پہلے تک یہ خیال کیا جاتا تھا کہ کچھ مخصوص علاقے انسان کا خصوصی ڈومین رہیں گے یا، بدترین صورت حال میں، آنے والے طویل عرصے تک ایسا ہی رہے گا۔ ان میں شطرنج اور گو دونوں شامل تھے۔دونوں گیمز، اگرچہ ان میں معمولی اصول اور بظاہر سادہ حرکیات ہیں، درحقیقت بڑی مشکل کو چھپاتے ہیں۔ ایک مشکل جو چالوں کے امتزاج کی تعداد اور اس کے نتیجے میں ممکنہ گیم کنفیگریشنز کے ذریعہ دی گئی ہے۔ اتنی بڑی تعداد جس سے کسی کو یقین ہو جائے کہ کوئی بھی کمپیوٹر اس طرح کی پیچیدگی پر عبور حاصل نہیں کر سکتا تھا۔ لہذا یہ عام رائے تھی کہ شطرنج، اور اس سے بھی زیادہ گو، انسانی ذہانت اور سب سے بڑھ کر وجدان کا استحقاق رہے گا۔ اس طرح کے اچانک سر تسلیم خم کرنے کی توقع کم تھی۔

لیکن اگر ڈیپ بلیو بروٹ فورس کے ذریعے غالب آنے میں کامیاب ہو گیا، ایک زبردست کمپیوٹنگ پاور (فی سیکنڈ 220 ملین حرکتوں کا حساب لگانے کی صلاحیت) کی بدولت AlphaGo کے لیے معاملہ مختلف ہے۔ گو میں شطرنج کے مقابلے بہت زیادہ تعداد میں امتزاجات ہیں۔ ہر اقدام کے لیے، اوسطاً، امکانات دس گنا زیادہ ہیں۔ اکیلے حساب کی گنجائش، اگرچہ بہت زیادہ ہے، تقریباً 10170 مختلف حالات پر غور کرنے کے لیے کافی نہیں ہوگی اور ساتھ ہی ساتھ کھیل سے پیدا ہونے والے نقصانات کے بارے میں درست ہونا بھی کافی نہیں ہوگا۔

تو AlphaGo عالمی چیمپئن کو شکست دینے میں کیسے کامیاب ہوا؟ سادہ، سیکھنا۔

گہری تعلیم، مشین کا خفیہ ہتھیار

جیسا کہ ڈیپ مائنڈ کے بانی، ڈیمس ہاسابیس کہتے ہیں، کمپیوٹر کو زیادہ اسمارٹ بنانے کے دو طریقے ہیں۔ پہلا طریقہ پروگرامنگ کے لیے ایک مخصوص مسئلے کا حل فراہم کرتا ہے اور مشین کو اس پر عمل کرنے دیتا ہے۔ دوسرا، اور یہ AlphaGo کا معاملہ ہے، "... کمپیوٹر کو خود سے سیکھنے، تجربے کے ذریعے سیکھنے کی صلاحیت فراہم کرتا ہے۔ … میں آپ کو سیکھنے کا طریقہ سکھاؤں گا، میں آپ کو اس کا حل نہیں دوں گا»۔

AlphaGo کی کامیابی کا راز ڈیپ لرننگ کہلاتا ہے۔ "الگورتھم میں تین خصوصیات ہیں، جو سب نیورو بائیولوجی سے لی گئی ہیں: کمک سیکھنے، کنوولوشنل نیورل نیٹ ورکس، اور سلیکٹیو میموری لوپس۔"

ایک اور خاصیت جو AlphaGo کو ڈیپ بلیو سے ممتاز کرتی ہے وہ اس حقیقت پر مشتمل ہے کہ ڈیپ مائنڈ مخلوق کو خاص طور پر اور صرف Go کے لیے نہیں بنایا گیا تھا۔ بنیادی الگورتھم نے ثابت کیا ہے کہ وہ وقت کے ساتھ ساتھ مختلف قسم کے گیمز کو سیکھنے اور ڈھالنے کے قابل ہے۔ اس کی ترقی اور اس کا حصول درحقیقت محتاط اور باریک بینی کی منصوبہ بندی سے نہیں بلکہ تجربے کا نتیجہ ہے۔ یہ کیا جانتا ہے، AlphaGo نے کامل خود مختاری میں، کھیل کے ذریعے دریافت کیا ہے اور اس میں شامل کیا ہے۔ "الگورتھمز کی نئی نسل کی خاصیت یہ ہے کہ، لوگوں کی طرح، وہ اپنی کامیابیوں اور ناکامیوں سے سیکھتے ہیں۔"

تقریباً 49 مختلف اٹاری 2600 گیمز میں تربیت یافتہ، ڈیپ مائنڈ کے الگورتھم نے نہ صرف دوسرے مقابلہ کرنے والے الگورتھم بلکہ انسانوں کو بھی پیچھے چھوڑ دیا ہے۔ "... ان گیمز میں سے 29 میں الگورتھم نے ایک انسانی پروفیشنل ٹیسٹر کو 75 فیصد یا اس سے زیادہ پیچھے چھوڑ دیا، بعض اوقات انہیں بہت بڑے مارجن سے ہرایا۔"

علمی کمپیوٹنگ

AlphaGo یہ ظاہر کرتا ہے کہ ہم اب داخل ہو رہے ہیں جسے IBM ڈیٹا پروسیسنگ کے تیسرے دور کے طور پر بیان کرتا ہے: کوگنیٹو کمپیوٹنگ کا۔ پہلا دور، جو کہ ٹیبلیٹنگ کمپیوٹنگ کا ہے، شروع سے لے کر 50 کی دہائی تک، کمپیوٹرز کو ان پٹ اور آؤٹ پٹ دونوں کے لیے پنچڈ کارڈز کا استعمال کرتے ہوئے، ضروری ریاضیاتی عمل انجام دینے کے قابل دیکھا گیا۔ دوسرا دور، پروگرامنگ کمپیوٹنگ کا، 50 کی دہائی سے آج تک، الیکٹرانک کمپیوٹرز کا دور ہے۔ مشینیں کمانڈز (اگر/تو) اور منطقی ڈھانچے پر کارروائی کرنے کے قابل بھی ہیں، لیکن انہیں کچھ اصولوں پر عمل کرتے ہوئے ایسا کرنے کی ہدایت کی جانی چاہیے اور اس لیے ان کو پروگرام کرنے کی ضرورت ہے۔

کوگنیٹو کمپیوٹنگ، جوناس نیوک (IBM) کی وضاحت کرتا ہے، «... "اگر/تو" منطق میں موجود سختی کو توڑنے کے لیے پیدا ہوا تھا … علمی کمپیوٹنگ ایک امکانی وضاحت ہے، جس کے نتائج سختی سے "ہاں یا" ہونے کے بجائے ایک سپیکٹرم کے ساتھ مختلف ہوتے ہیں۔ نہیں، صحیح یا غلط"۔

IBM کی طرف سے کوگنیٹو کمپیوٹنگ پر جو زور دیا گیا ہے، کم از کم جزوی طور پر، خود دلچسپی ہے، یہ ایک طاقتور مارکیٹنگ مشین کا ایک حصہ ہے جو Kasparov پر فتح سے مطمئن نہیں تھا۔ الفاگو، درحقیقت، ایک پیشرو ہے یا، اگر آپ چاہیں تو، ڈیپ بلیو کا جانشین تھا۔ ایک سپر کمپیوٹر جس نے ایک اور رکاوٹ کو توڑ دیا ہے، اس نے انسان کو شکار کے ایک اور ذخیرے کو لوٹ لیا ہے، اسے مزید یقین سے محروم کر دیا ہے: ایک لفظ میں، واٹسن۔

ہم اگلی پوسٹ میں واٹسن سے نمٹیں گے۔

کمنٹا