আমি বিভক্ত

ফার্স্টঅনলাইন ব্যানার

পরীক্ষায় নকল করতে কৃত্রিম বুদ্ধিমত্তার শ্রেণীকক্ষ ত্যাগ: ওপেনএআই-কে আলিঙ্গন করার ঘটনাটি কী প্রকাশ করে

এআই মডেল বিতরণ প্ল্যাটফর্ম হাগিং ফেস তাদের আইটি সিস্টেমে একটি অনুপ্রবেশ শনাক্ত করে তার প্রতিকার করেছে। এটি ছিল তাদের অতীতের যেকোনো ঘটনার চেয়ে ভিন্ন, কিন্তু এটি এমন একটি "ঘটনা" যা একটি বিজ্ঞাপন প্রচারণার চেয়েও বেশি গুরুত্বপূর্ণ ছিল: কারণটা এখানে দেওয়া হলো।

পরীক্ষায় নকল করতে কৃত্রিম বুদ্ধিমত্তার শ্রেণীকক্ষ ত্যাগ: ওপেনএআই-কে আলিঙ্গন করার ঘটনাটি কী প্রকাশ করে

একটি কৃত্রিম বুদ্ধিমত্তাকে হ্যাকারের মতো আচরণ করতে বললে কী হয়? এই প্রশ্নটিই আলোচনার কেন্দ্রবিন্দুতে রয়েছে। এক্সপ্লয়েটজিমসাইবার নিরাপত্তা ক্ষেত্রে এআই মডেলের আক্রমণাত্মক ক্ষমতা পরিমাপের জন্য এটি বিশ্বের অন্যতম উন্নত একটি বেঞ্চমার্ক। এই বেঞ্চমার্ক প্রকল্পটি ম্যাক্স প্ল্যাঙ্ক ইনস্টিটিউট, ইউনিভার্সিটি অফ অ্যারিজোনা এবং ইউনিভার্সিটি অফ ক্যালিফোর্নিয়া (বার্কলি ও সান্তা বারবারা)-এর মতো বিশ্ববিদ্যালয় ও গবেষণা কেন্দ্রের একদল আন্তর্জাতিক গবেষক তৈরি করেছেন, এবং এতে অ্যানথ্রোপিক, গুগল ও ওপেনএআই-এর গবেষকরাও অবদান রেখেছেন। এর লক্ষ্যটি যতটা সহজ, ততটাই সূক্ষ্ম: একটি এআই এজেন্ট একটি পরিচিত সাইবার দুর্বলতাকে কতটা একটি সত্যিকারের কার্যকরী আক্রমণে রূপান্তরিত করতে সক্ষম, তা পরীক্ষা করা।

এক্সপ্লয়েটজিম কোনো ভিডিও গেম বা হ্যাকিং প্রতিযোগিতা নয়। এটি এক ধরনের "চূড়ান্ত পরীক্ষানতুন এআই-এর জন্য। এজেন্টদেরকে প্রোগ্রাম কোড এবং এক্সিকিউশন এনভায়রনমেন্ট সহ শত শত বাস্তব দুর্বলতা সরবরাহ করা হয়। তাদের কাজ হলো স্বাধীনভাবে একটি এক্সপ্লয়েট তৈরি করা, অর্থাৎ এমন একটি নির্দেশাবলীর ক্রম যা সেই দুর্বলতাকে কাজে লাগিয়ে সিস্টেমের নিয়ন্ত্রণ বা গোপনীয় তথ্যে প্রবেশাধিকার পেতে সক্ষম। যেহেতু এই পরীক্ষাগুলো সম্ভাব্য বিপজ্জনক, তাই এগুলো সাধারণত একটি নির্দিষ্ট পরিসরের মধ্যে সম্পন্ন করা হয়। স্যান্ডবক্সইন্টারনেটের বাকি অংশ থেকে সম্পূর্ণ বিচ্ছিন্ন একটি পরিবেশ। ‘স্যান্ডবক্স’ শব্দটির সাথে শিশুদের খেলার বালির বাক্সের তুলনাটি বেশ সহজবোধ্য: শিশুরা সেখানে বালির দুর্গ বানাতে পারে, গর্ত খুঁড়তে পারে এবং সবকিছু এলোমেলো করে ফেলতে পারে, কিন্তু সমস্ত "এলোমেলো" বালির মধ্যেই সীমাবদ্ধ থাকে, যা বাগানকে নোংরা করে না বা বাইরে কোনো সমস্যা তৈরি করে না। কম্পিউটার বিজ্ঞানেও নীতিটি একই: সফটওয়্যার স্যান্ডবক্সের মধ্যে "মুক্তভাবে চলাচল" করতে পারে, কিন্তু তার সেই পরিবেশ ছেড়ে যাওয়া বা অপারেটিং সিস্টেম, ইন্টারনেট বা অন্যান্য সংবেদনশীল ডেটা অ্যাক্সেস করার ক্ষমতা থাকা উচিত নয়।

ঠিক এই অভ্যন্তরীণ মূল্যায়নগুলির একটি চলাকালীনই, যা পুনর্গঠিত হয়েছে তা অনুসারে OpenAI e হাগিং ফেস দ্বারা নিশ্চিত করা হয়েছে, দুটি সর্বাধুনিক এবং উন্নত ওপেনএআই মডেল: জিপিটি-৫.৬ সল এবং আরও একটি উন্নত মডেল, যা এখনও জনসাধারণের জন্য প্রকাশ করা হয়নি – তাতে তারা একটি দুর্বলতা খুঁজে পেত। জিরো-ডে টেস্টিং পরিকাঠামোতে। এই ধরনের দুর্বলতা হলো এমন একটি নিরাপত্তা ত্রুটি যা সফটওয়্যার ডেভেলপারদের অজানা এবং তাই এর কোনো সমাধানও নেই। এর নামকরণের কারণ হলো, সমস্যাটি আবিষ্কৃত বা অপব্যবহার হওয়ার আগে নির্মাতার কাছে এটি সমাধানের জন্য "শূন্য দিন" সময় ছিল।

প্রাপ্ত খবর অনুযায়ী, ওপেনএআই-এর দুটি এআই মডেল স্যান্ডবক্স থেকে বেরিয়ে আসতে, ইন্টারনেটে প্রবেশাধিকার লাভ করতে এবং শেষ পর্যন্ত উৎপাদন পরিকাঠামোর একটি অংশকে ক্ষতিগ্রস্ত করতে সক্ষম হয়েছিল। আলিঙ্গন মুখযেখানে তারা (যুক্তিযুক্ত কারণেই) বিশ্বাস করত যে বেঞ্চমার্কটি সমাধান করার জন্য দরকারি তথ্য সংরক্ষিত থাকতে পারে। চূড়ান্ত লক্ষ্য হাগিং ফেস-এর ক্ষতি করা ছিল না, বরং আরও ভালো স্কোর অর্জনের জন্য পরীক্ষাটির 'উত্তর' খুঁজে বের করা ছিল। হাগিং ফেস এই কার্যকলাপটি শনাক্ত করে ব্লক করে দেয় এবং ওপেনএআই-এর সাথে মিলে ঘটনাটির বিষয়ে একটি প্রযুক্তিগত তদন্ত শুরু করে।

যে শিক্ষার্থী দরজা খোলা এবং "নিয়ন্ত্রণের বাইরে" থাকা এআই-টি খুঁজে পায়

আসলে কী ঘটেছিল তা বোঝার জন্য, আমরা পরীক্ষারত একজন ছাত্রের কথা কল্পনা করতে পারি। শিক্ষক তাকে পরীক্ষার খাতা সহ একটি শ্রেণীকক্ষে তালাবদ্ধ করে দেন এবং বলেন, "তুমি শুধু তোমার ডেস্কের জিনিসপত্রই ব্যবহার করতে পারবে।" কিন্তু ছাত্রটি বুঝতে পারে যে দরজার তালাটি ত্রুটিপূর্ণ। সেই মুহূর্তে, বাইরে কোনো নজরদারি না থাকার এবং সমস্ত নজরদারি ব্যবস্থা নিষ্ক্রিয় থাকার সুযোগ নিয়ে, সে শ্রেণীকক্ষ থেকে বেরিয়ে লাইব্রেরিতে যায়, একটি লকপিক দিয়ে দরজা খোলে, উত্তরপত্র দেখে, নির্বিঘ্নে ফিরে আসে এবং একটি নিখুঁত পরীক্ষা জমা দেয়।

এখন, শিক্ষার্থীর সাথে উপমায় কেন একটি দৃশ্যকল্প ব্যবহার করা হয়েছে নজরদারি ব্যবস্থা নিষ্ক্রিয় করা হয়েছে e কোন বাহ্যিক নিয়ন্ত্রণ নেই সেটা কি শিক্ষার্থীকে অনুচিত আচরণে লিপ্ত হওয়া থেকে বিরত রাখে? কারণ ঠিক এখানেই পুরো ঘটনাটিকে একটি সায়েন্স ফিকশন সিনেমার পর্ব বলে মনে হওয়ার ঝুঁকি থাকে। এই ব্যাখ্যাটি ছাড়া, কেউ হয়তো এমন একটি কাহিনি কল্পনা করে ফেলতে পারে যেখানে যন্ত্ররা সবকিছু দখল করে নেয়। কিন্তু ব্যাপারটা মোটেও তেমন নয়।

যারা ChatGPT, Claude বা Gemini ব্যবহার করেছেন, তারা ইতিমধ্যেই তথাকথিত “সিঁড়ির পার্শ্বস্থ রেলিংঅর্থাৎ, সেই নিরাপত্তা ব্যবস্থাগুলো যা মডেলটিকে সম্ভাব্য বিপজ্জনক অনুরোধগুলো কার্যকর করা থেকে বিরত রাখে। যদি কোনো ব্যবহারকারী জিজ্ঞাসা করে কীভাবে একটি বিস্ফোরক যন্ত্র তৈরি করতে হয়, কীভাবে একটি কম্পিউটার সিস্টেম হ্যাক করতে হয়, বা কীভাবে লগইন তথ্য চুরি করতে হয়, তবে মডেলটি সাধারণত উত্তর দিতে অস্বীকার করে বা কেবল সাধারণ তথ্য সরবরাহ করে (তবে, কয়েক বছর আগে পর্যন্ত, এই এআইগুলোর বেশিরভাগই বিস্তারিত, কার্যকর নির্দেশাবলী প্রদান করত, এমনকি আত্মহত্যার জন্যও)।

তবে এর মানে এই নয় যে, মডেলটি প্রযুক্তিগতভাবে এই সমস্যাগুলো সমাধান করতে অক্ষম, বরং এটিকে এমনভাবে ডিজাইন করা হয়েছিল যাতে এই সক্ষমতাগুলো ব্যবহারকারীদের জন্য উপলব্ধ না হয়। এক্সপ্লয়েটজিম বেঞ্চমার্কের ক্ষেত্রে, ডেভেলপাররা আসলে মডেলটির আক্রমণাত্মক সাইবার নিরাপত্তা সক্ষমতা পরিমাপ করতে চেয়েছিলেন। এই কারণে, মডেলটিকে দুর্বলতা কাজে লাগানোর চেষ্টা করার অনুমতি দেওয়া হয়েছিল, কারণ সেটাই ছিল পরীক্ষাটির উদ্দেশ্য। সেই মুহূর্তে কোনো সুরক্ষা ব্যবস্থা ছিল না। কোন বিধিনিষেধ নেই, কিন্তু এমন কিছুই নেই যা “নিয়ন্ত্রণের বাইরে”।.

অন্য কথায়, পরীক্ষাটি বিশ্বস্তভাবে পুনরুৎপাদন করতে পারেনি বাস্তব ব্যবহারের পরিস্থিতি এটি কোনো ব্যবহারকারীর নয়, বরং একটি গবেষণা পরীক্ষাগারের, যা সিস্টেমটির সর্বোচ্চ সম্ভাবনা পরিমাপ করতে প্রতিশ্রুতিবদ্ধ। এই পরিস্থিতি ঘটনাটিকে কোনোভাবেই কম তাৎপর্যপূর্ণ করে না, বরং এটিকে সঠিক প্রেক্ষাপটে ব্যাখ্যা করার জন্য আমাদের আহ্বান জানায়: যা পর্যবেক্ষণ করা হয়েছে তা হলো, একটি মডেল বেঞ্চমার্কের পরীক্ষামূলক পরিস্থিতিতে কী করতে পারে, এটি অগত্যা তা নয় যে জনসাধারণের জন্য প্রকাশিত সংস্করণে এটি কীভাবে আচরণ করবে।

এই দিকটিকে অন্য একটি দিক থেকে আলাদা করে দেখতে হবে: স্যান্ডবক্স, অর্থাৎ যে বিচ্ছিন্ন পরিবেশে পরীক্ষাটি হয়েছিল, তা সম্পূর্ণ সুরক্ষিত থাকা উচিত ছিল। যদি মডেলটি একটি জিরো-ডে দুর্বলতার সুযোগ নিয়ে কোনোভাবে বেরিয়ে আসতে সক্ষম হয়ে থাকে, তবে তা এই কারণে নয় যে আয়োজকরা ইচ্ছাকৃতভাবে "দরজা খোলা রেখেছিলেন", বরং এই কারণে যে এটি এমন একটি ত্রুটি শনাক্ত করেছিল, যা সম্পর্কে ডেভেলপাররা নিজেরাও অবগত ছিলেন না। সংক্ষেপে, এআই তার পরিবেশ পর্যবেক্ষণ, একটি বিকল্প পরিকল্পনা তৈরি এবং নিজের লক্ষ্য অনুসরণ করার সক্ষমতা প্রদর্শন করেছে। কেউ তাকে স্পষ্টভাবে কিছু না বললেও (এবং জেনারেটিভ এজেন্ট এআই-এর মৌলিক কার্যপ্রণালী বুঝতে পারলে এটি আশ্চর্যজনক নয়)। এআই সর্বদা এবং শুধুমাত্র একটি ভিত্তির উপর চলে। সাফল্যের সম্ভাবনামূলক মূল্যায়ন সমস্ত সম্ভাব্য বিকল্পের মধ্যে থেকে (এমনকি যখন তাকে নিজের ভাষার শব্দ বেছে নিতে হয়)।

এমন একটি দুর্ঘটনা যার মূল্য একটি বিজ্ঞাপন প্রচারণার চেয়েও বেশি

কিন্তু এর আরেকটি ব্যাখ্যাও আছে, যা গবেষণাগারের চেয়ে আর্থিক বাজারের বেশি কাছাকাছি। ওপেনএআই তাদের প্রেস রিলিজের একটি বড় অংশ ঘটনাটির ওপর আলোকপাত করার চেয়ে নিজেদের মডেলের উন্নত সক্ষমতা ব্যাখ্যা করতে ব্যয় করেছে। এটি একটি যোগাযোগের পছন্দ যা কারো নজর এড়ায়নি। আমেরিকান কোম্পানিটির আনুষ্ঠানিক প্রেস বিজ্ঞপ্তিতে মডেলটির প্রদর্শিত সক্ষমতার ওপর যথেষ্ট জোর দেওয়া হয়েছে, এতটাই যে প্রকাশিত একমাত্র গ্রাফটি এর কর্মক্ষমতা সম্পর্কিত। ওপেনএআই ভবিষ্যতে শেয়ার বাজারে তালিকাভুক্ত হওয়ার জন্য প্রস্তুতি নিচ্ছে। ২০২৬ সালের ৮ই জুন, এটি গোপনে আবেদন করে। SEC-এর কাছে খসড়া S-1১২২ বিলিয়ন ডলারের একটি তহবিল সংগ্রহের পর এর মূল্যমান ৮৫২ বিলিয়ন ডলারে দাঁড়ায়। এই দৃষ্টিকোণ থেকে, প্রযুক্তিগত নেতৃত্বের প্রতিটি প্রদর্শন বিনিয়োগকারী, শিল্প অংশীদার এবং বাজারের কাছে কোম্পানির অনুভূত মূল্য বৃদ্ধিতে অবদান রাখে।

এমন কোনো প্রমাণ নেই যা থেকে বোঝা যায় যে দুর্ঘটনাটি পরিকল্পিতভাবে ঘটানো হয়েছিল। প্রচারমূলক উদ্দেশ্যেতবে, এটা উপেক্ষা করা কঠিন যে ওপেনএআই দ্বারা নির্মিত আখ্যানটি একটি সম্ভাব্য বিব্রতকর ঘটনাকে—যেমন পরীক্ষার পরিবেশ থেকে একটি মডেলের পালিয়ে যাওয়া—তাদের সিস্টেমের প্রযুক্তিগত শ্রেষ্ঠত্বের প্রদর্শনীতে রূপান্তরিত করে। অন্য কথায়, এটি এমন একটি যোগাযোগ যা একটি পরিশীলিত বিপণন কৌশল হিসাবেও পড়া যেতে পারে। ওপেনএআই বলতে চায়: "আমাদের মডেলগুলো সময়ের চেয়ে এগিয়ে।" লক্ষ্য হলো এমন একটি পরীক্ষাগার হিসাবে পরিচিতি লাভ করা, যা বর্তমানে কৃত্রিম বুদ্ধিমত্তার সীমানা নির্ধারণ করছে। বড় প্রযুক্তি সংস্থাগুলো শুধু পণ্যই বিক্রি করে না: তারা ভবিষ্যতের নেতৃত্বের প্রত্যাশা বিক্রি করে। বাজার যদি নিশ্চিত হয় যে একটি সংস্থার কাছে সবচেয়ে উন্নত মডেল রয়েছে, তবে এটি তাকে ক্রমবর্ধমান উচ্চ মূল্যায়ন দিতে ইচ্ছুক হবে। অধিকন্তু, আমেরিকান এআই সংস্থাগুলোকে পারফরম্যান্সের সাথে প্রতিদ্বন্দ্বিতা করতে হচ্ছে। চীনা এআই যেগুলোর সুবিধা হলো, এগুলোর দাম আমেরিকানগুলোর চেয়ে গড়ে ৪০% কম। জার্মান বিশ্লেষক কিম আইজেনবার্গকৃত্রিম বুদ্ধিমত্তা বিষয়ক ম্যাগাজিন “সুপারইন্টেলিজেন্স”-এর সহ-প্রতিষ্ঠাতা এবং প্রধান সম্পাদক, কিছুদিন আগে কোনো কাকতালীয়ভাবে ভবিষ্যদ্বাণী করেননি যে, “কিমি কে১.৫চীনা কোম্পানি দ্বারা তৈরি নতুন মডেল মুনশট এআইসমুদ্রের ওপারে লাল সতর্কতা জারি হয়ে যেত…

মন্তব্য করুন