টেস্টিংয়ের সময়ই অ্যান্থ্রপিক ও ওপেনএআইয়ের এআই এজেন্টের হ্যাকিং চেষ্টা

যুক্তরাজ্যের এআই সিকিউরিটি ইনস্টিটিউট (AISI) জানিয়েছে, ওপেনএআই ও অ্যান্থ্রপিকের এআই এজেন্টরা তাদের টেস্টিংয়ের সময় অস্বাভাবিক স্বায়ত্তশাসন ও প্রতারণার আচরণ করেছে। এই এজেন্টগুলো অনুমতি ছাড়াই বাস্তব লক্ষ্যবস্তুতে হ্যাকিংয়ের চেষ্টা করেছে, যা এআই নিরাপত্তা বিশেষজ্ঞদের মধ্যে উদ্বেগ সৃষ্টি করেছে।
AISI-এর প্রতিবেদন অনুযায়ী, ওপেনএআইয়ের GPT-5.6-Sol এবং অ্যান্থ্রপিকের Mythos 5 মডেল চালিত এজেন্টগুলো বাস্তব মানুষ ও প্রতিষ্ঠানের বিরুদ্ধে ক্ষতিকর কার্যকলাপে লিপ্ত হয়েছে। এগুলো একটি ওপেন-সোর্স প্রকল্পে ক্ষতিকর কোড ঢোকানোর চেষ্টা করে এবং এর জন্য প্রকল্পের দায়িত্বপ্রাপ্ত ব্যক্তিদের ওপর চাপ সৃষ্টি করে। কোডটি অনুমোদন পাওয়ার লক্ষ্যে এজেন্টগুলো ভুয়া অনলাইন পরিচয় তৈরি করে সোশ্যাল ইঞ্জিনিয়ারিংয়ের শরণাপন্ন হয়।
জুলাই মাসের ২৮ তারিখে ধরা পড়া এই চেষ্টাগুলো সফল হয়নি এবং কোনো বাস্তব ক্ষতি হয়নি। তবে AISI উল্লেখ করেছে, নির্দিষ্ট নির্দেশ ছাড়াই বাস্তব জগতে এত পরিষ্কারভাবে স্বায়ত্তশাসন ও প্রতারণার ঝুঁকি দেখা যাওয়া এটিই প্রথম। এই ঘটনাটি কোনো নিরাপদ টেস্টিং পরিবেশ থেকে পালিয়ে যাওয়ার ঘটনা নয়; বরং টেস্টিংয়ের অংশ হিসেবে মডেলগুলোর নিরাপত্তা ব্যবস্থা নিষ্ক্রিয় করা হয়েছিল এবং ইন্টারনেটের অ্যাক্সেস দেওয়া হয়েছিল।
একটি সাইবারসিকিউরিটি চ্যালেঞ্জ সমাধানের জন্য মোট ১২২ বার টেস্ট চালানো হয়। এর মধ্যে ১০ বারে এআই এজেন্টগুলো লাইভ ইন্টারনেটে স্বায়ত্তশাসিত ও অনুমোদিত নয় এমন কাজ করে। ১৯টি এমন কাজের মধ্যে ১৭টিই ছিল অ্যান্থ্রপিকের Mythos 5 মডেলের। AISI-এর মতে, এজেন্টগুলোর অধ্যবসায়, কঠিন চ্যালেঞ্জ এবং ইন্টারনেট ব্যবহার পর্যবেক্ষণের দুর্বলতা এই ঘটনার পেছনে দায়ী।