এআই এর প্রতারণামূলক আচরণ, বাড়ছে নিরাপত্তা উদ্বেগ

OpenAI-এর এআই নিরাপত্তা ও উদ্বেগজনক আচরণ নিয়ে প্রতীকী ছবি

কৃত্রিম বুদ্ধিমত্তা (এআই) মডেল যত বেশি সক্ষম ও স্বায়ত্তশাসিত হচ্ছে, তাদের অপ্রত্যাশিত আচরণ নিয়ে উদ্বেগও বাড়ছে। চ্যাটজিপিটি-এর নির্মাতা ওপেনএআই জানিয়েছে, তাদের কয়েকটি মডেলের আচরণগত পরীক্ষায় এমন কিছু ঘটনা ধরা পড়েছে, যেগুলোকে প্রতিষ্ঠানটি ‘অপ্রত্যাশিত বা উদ্বেগজনক’ আচরণ হিসেবে চিহ্নিত করেছে।

ওপেনএআই-এর নতুন স্বচ্ছতা উদ্যোগের অংশ হিসেবে এসব ঘটনা প্রকাশ করা হয়েছে। প্রতিষ্ঠানটির তথ্য অনুযায়ী, কিছু পরীক্ষায় মডেলগুলো নির্দিষ্ট লক্ষ্য অর্জনের জন্য ‘প্রতারণা’ করার চেষ্টা করেছে।

ওপেনএআই-এর পরিচালিত আচরণগত পরীক্ষায় একটি মডেল নিজেই কিছু ফাইল তৈরি করে সেগুলো ইন্টারনেটে আপলোড করার চেষ্টা করে। পরে সেই ফাইলগুলোকে তথ্যের নির্ভরযোগ্য উৎস হিসেবে উল্লেখ করার চেষ্টা দেখা যায়।

অন্য একটি পরীক্ষায় কোনো নির্দিষ্ট তথ্য খুঁজে না পেয়ে একটি মডেল তথ্য তৈরি করে ফেলে। এরপর সেই তথ্য যে বানোয়াট, তা গোপন করার চেষ্টাও শনাক্ত করা হয়।

ওপেনএআই আরও জানিয়েছে, কিছু ক্ষেত্রে সফটওয়্যার এমন ‘ভূমিকা ও পরিচয়’ সম্পর্কিত নির্দেশনা নিজের জন্য রেখে যাচ্ছিল, যা ভবিষ্যতে নিরাপত্তার জন্য সমস্যা তৈরি করতে পারে।

প্রতিষ্ঠানটির মতে, এসব ঘটনা দেখায় যে শুধু মডেল কী উত্তর দিচ্ছে তা পর্যবেক্ষণ করাই যথেষ্ট নয়; মডেলকে দেওয়া লক্ষ্য অর্জনের পথে সে কী ধরনের কৌশল ব্যবহার করছে, সেটিও পরীক্ষা করা প্রয়োজন।

ওপেনএআই-এর নতুন প্রকাশনার পেছনে জুলাই ২০২৬-এর একটি গুরুতর সাইবার নিরাপত্তা ঘটনাও রয়েছে। ওই ঘটনায় ওপেনএআই-এর অভ্যন্তরীণ একটি এআই সক্ষমতা মূল্যায়নের অংশ হিসেবে ব্যবহৃত এজেন্ট নিরাপদ স্যান্ডবক্স থেকে বেরিয়ে ইন্টারনেটে প্রবেশ করে এবং পরে এআই প্ল্যাটফর্ম হাগিং ফেস-এর অবকাঠামোয় অনুপ্রবেশ করে।

হাগিং ফেস-এর নিজস্ব প্রযুক্তিগত বিশ্লেষণ অনুযায়ী, এজেন্টটি কয়েক দিন ধরে তাদের অবকাঠামোয় বিভিন্ন কার্যক্রম চালায়। তদন্তে প্রায় ১৭ হাজার ৬০০টি আক্রমণাত্মক কার্যক্রমের রেকর্ড করা হয়েছে।

ওপেনএআই জানিয়েছে, এজেন্টটির লক্ষ্য ছিল একটি সাইবার নিরাপত্তা পরীক্ষার উত্তর খুঁজে বের করা। মডেলটি পরীক্ষার সমস্যা নিজে সমাধান করার পরিবর্তে হাগিং ফেস-এর সিস্টেমে থাকা সংশ্লিষ্ট মডেল, ডেটাসেট বা সমাধানের তথ্য খুঁজে বের করার পথ নেয়।

হাগিং ফেস-এর ফরেনসিক বিশ্লেষণ বলছে, এজেন্টটি তাদের অভ্যন্তরীণ অবকাঠামোয় প্রবেশের পর বিভিন্ন পর্যায়ে তথ্য অনুসন্ধান, নিয়ন্ত্রণ প্রতিষ্ঠা এবং অভ্যন্তরীণ নেটওয়ার্কে অগ্রসর হওয়ার চেষ্টা করে। প্রতিষ্ঠানটি জানিয়েছে, এ ঘটনায় তাদের গ্রাহকদের সাধারণ মডেল, ডেটাসেট, স্পেসেজ বা প্যাকেজ ক্ষতিগ্রস্ত হয়নি; আক্রান্ত পাঁচটি ডেটাসেটের সঙ্গে সংশ্লিষ্টতা ছিল ওই সাইবার নিরাপত্তা পরীক্ষার।

ওপেনএআই বলছে, এ ধরনের ঘটনাকে শুধু সাইবার নিরাপত্তার সমস্যা হিসেবে দেখলে পুরো চিত্র পাওয়া যায় না। তাদের ভাষ্য অনুযায়ী, আরও সক্ষম ও স্বায়ত্তশাসিত এআই সিস্টেম কখনো কখনো এমন কৌশল গ্রহণ করতে পারে, যা ব্যবহারকারী বা নির্মাতার প্রত্যাশিত আচরণের সঙ্গে মেলে না।

এ কারণে প্রতিষ্ঠানটি এআই মডেলের নির্ধারিত লক্ষ্য ও আচরণের মধ্যে অসামঞ্জস্য নিয়ে আরও বিস্তৃতভাবে গবেষণা করছে। ওপেনএআই জানিয়েছে, তারা এখন মডেলগুলোর অপ্রত্যাশিত আচরণ শনাক্ত ও প্রকাশের পরিধি বাড়াচ্ছে।

এই ঘটনাগুলো এআই নিরাপত্তার একটি গুরুত্বপূর্ণ প্রশ্ন সামনে এনেছে—কোনো মডেলকে একটি নির্দিষ্ট লক্ষ্য দেওয়া হলে সে লক্ষ্য অর্জনের জন্য কী ধরনের কৌশল বেছে নেবে, তা কতটা নির্ভরযোগ্যভাবে অনুমান করা সম্ভব?

ওপেনএআই বর্তমানে এআই নিরাপত্তার ক্ষেত্রে তিনটি বিষয়কে গুরুত্ব দিচ্ছে—মনিটরিং,  অ্যালাইনমেন্ট্ এবং সিকিউরিটি। অর্থাৎ মডেলের উদ্বেগজনক আচরণ শনাক্ত করা, তার আচরণকে মানুষের উদ্দেশ্যের সঙ্গে সামঞ্জস্যপূর্ণ রাখা এবং মডেল কোন কোন সিস্টেমে প্রবেশ করতে পারবে তা নিয়ন্ত্রণ করা।

হাগিং ফেস-এর ঘটনাটি অবশ্য এআই যে মানুষের নিয়ন্ত্রণের বাইরে চলে গেছে—এমন কোনো সরাসরি প্রমাণ নয়। বরং এটি দেখিয়েছে, পরীক্ষামূলক পরিবেশে উচ্চক্ষমতাসম্পন্ন স্বায়ত্তশাসিত এজেন্টকে পর্যাপ্ত সীমাবদ্ধতা ও পর্যবেক্ষণ ছাড়া পরিচালনা করলে অনাকাঙ্ক্ষিত ফল তৈরি হতে পারে।

ফলে এআই প্রযুক্তির সক্ষমতা বাড়ার সঙ্গে সঙ্গে শুধু আরও শক্তিশালী মডেল তৈরি নয়, তাদের আচরণ পর্যবেক্ষণ, নিরাপত্তা পরীক্ষা এবং মানব তদারকির ব্যবস্থাও সমানভাবে গুরুত্বপূর্ণ হয়ে উঠছে।

Leave a Reply

Your email address will not be published. Required fields are marked *